علیبابا مدل Qwen۳.۸-Max را با ۲.۴تریلیون پارامتر رونمایی کرد

علیبابا در اوج رقابت فشرده هوش مصنوعی چین، بزرگترین و توانمندترین مدل خود را با نام Qwen3.۸-Max معرفی کرد؛ مدلی بازوزن با ۲.۴تریلیون پارامتر که در جداول Arena.AI به صدر مدلهای چینی و رتبه دوم جهانی در تحلیل بصری رسیده است.
شرکت چینی علیبابا (۹۹۸۸.HK) روز دوشنبه آنچه را «بزرگترین و توانمندترین» مدل هوش مصنوعی خود مینامد رونمایی کرد؛ مدلی با نام Qwen3.8-Max که از نظر اندازه، فاصله چندانی با مدلی از رقیب داخلی Moonshot AI که ماه گذشته عرضه شد، ندارد.
شرکتهای فناوری چینی ــ که نیرویی بزرگ در عرصه مدلهای «بازوزن» (open-weight) در جهان به شمار میآیند ــ در نبردی شدید و پرشتاب برای ساخت سامانههای قدرتمندتر درگیرند؛ سامانههایی که در عین حال نباید آنقدر گران باشند که هزینه اجرا و بهرهبرداری از آنها غیرقابلتحمل شود.
Qwen3.۸-Max دارای ۲.۴ تریلیون پارامتر است؛ پارامترهایی که تنظیمات عددیای هستند که مدل از دادهها میآموزد و با استفاده از آنها الگوها را تشخیص میدهد، پاسخ تولید میکند و وظایف را انجام میدهد. مدل Kimi K3 متعلق به Moonshot، ۲.۸ تریلیون پارامتر دارد.
عدد بالاتر الزاماً به معنای بهتر بودن یک مدل نیست، اما این رقم به معیار بهدقت رصدشدهای برای نشان دادن مقیاس محاسبات و دادههای پشتصحنه سامانههای پیشرفته هوش مصنوعی تبدیل شده است.
شرکتهای فناوری چینی مشتاقاند شمار پارامترهای مدلهای خود را منتشر کنند تا به آنها کمک کنند در میان جامعه توسعهدهندگان جایگاه پیدا کنند. مدلهای آنها معمولاً «بازوزن» هستند؛ یعنی تنظیمات یادگرفتهشدهی زیرین که به توسعهدهندگان امکان میدهد سامانه را اجرا یا آن را تطبیق دهند، برای دانلود در دسترس است.
در مقابل، شرکتهایی مانند OpenAI، Anthropic و Google (GOOGL.O) شمار پارامترهای مدلهای بستهی خود را منتشر نمیکنند.
مدل Qwen3.۸-Max در پلتفرم جمعسپاریشدهی مقایسه مدلها، یعنی Arena.AI رونمایی شد؛ جایی که این مدل بلافاصله به بالاترینرتبهی مدل چینی در بخش مدلهای متنی تبدیل شد، اگرچه همچنان پشت سر Claude Fable 5 و سه نسخهی Opus قرار دارد که همگی متعلق به Anthropic هستند.
اما در جدول رتبهبندی Arena.AI برای مدلهای هوش مصنوعی که تصاویر و سایر مواد بصری را تحلیل میکنند، Qwen3.۸-Max در رتبه دوم جهانی ایستاد؛ تنها پشت سر یکی از نسخههای Claude Fable ۵.
هر دوی Qwen3.8-Max و Kimi K3 قادرند با متن، تصویر و ویدئو کار کنند و تا ۱ میلیون توکن را در یک نوبت پردازش کنند.
«توکنها» بخشهایی از دادهاند؛ اغلب بخشهایی از کلمات یا کلمات کوتاه. رقم بزرگ توکن نشان میدهد مدل میتواند حجم عظیمی از محتوا را یکباره دریافت کند؛ برای مثال پروندههای حقوقی طولانی، یک کدبیس بزرگ نرمافزاری یا صدها صفحه سند.
علیبابا گفت مدل جدید از طراحی «ترکیب متخصصان» (mixture-of-experts) استفاده میکند؛ طرحی که کار را میان بخشهای تخصصی سامانه تقسیم میکند، بهجای آنکه برای هر درخواست، کل مدل را فعال کند. تنها ۹۵ میلیارد پارامتر در هر بار استفاده فعال میشوند که این امر هزینهها و تأخیر در پاسخ را کاهش میدهد.
این غول فناوری اعلام کرد مدل توانسته یک پروژه مهندسی نرمافزار را در مدت ۱۶ روز تکمیل کند.
قرار است Qwen3.8-Max هفتهی آینده از طریق پلتفرم Model Studio در Alibaba Cloud عرضه شود.
