اخبار روز برندهای جهان

علی‌بابا مدل Qwen۳.۸-Max را با ۲.۴تریلیون پارامتر رونمایی کرد

علی‌بابا در اوج رقابت فشرده هوش مصنوعی چین، بزرگ‌ترین و توانمندترین مدل خود را با نام Qwen3.۸-Max معرفی کرد؛ مدلی بازوزن با ۲.۴تریلیون پارامتر که در جداول Arena.AI به صدر مدل‌های چینی و رتبه دوم جهانی در تحلیل بصری رسیده است.

شرکت چینی علی‌بابا (۹۹۸۸.HK) روز دوشنبه آنچه را «بزرگ‌ترین و توانمندترین» مدل هوش مصنوعی خود می‌نامد رونمایی کرد؛ مدلی با نام Qwen3.8-Max که از نظر اندازه، فاصله چندانی با مدلی از رقیب داخلی Moonshot AI که ماه گذشته عرضه شد، ندارد.

شرکت‌های فناوری چینی ــ که نیرویی بزرگ در عرصه مدل‌های «بازوزن» (open-weight) در جهان به شمار می‌آیند ــ در نبردی شدید و پرشتاب برای ساخت سامانه‌های قدرتمندتر درگیرند؛ سامانه‌هایی که در عین حال نباید آن‌قدر گران باشند که هزینه اجرا و بهره‌برداری از آن‌ها غیرقابل‌تحمل شود.

Qwen3.۸-Max دارای ۲.۴ تریلیون پارامتر است؛ پارامترهایی که تنظیمات عددی‌ای هستند که مدل از داده‌ها می‌آموزد و با استفاده از آن‌ها الگوها را تشخیص می‌دهد، پاسخ تولید می‌کند و وظایف را انجام می‌دهد. مدل Kimi K3 متعلق به Moonshot، ۲.۸ تریلیون پارامتر دارد.

عدد بالاتر الزاماً به معنای بهتر بودن یک مدل نیست، اما این رقم به معیار به‌دقت‌ رصدشده‌ای برای نشان دادن مقیاس محاسبات و داده‌های پشت‌صحنه سامانه‌های پیشرفته هوش مصنوعی تبدیل شده است.

شرکت‌های فناوری چینی مشتاق‌اند شمار پارامترهای مدل‌های خود را منتشر کنند تا به آن‌ها کمک کنند در میان جامعه توسعه‌دهندگان جایگاه پیدا کنند. مدل‌های آن‌ها معمولاً «بازوزن» هستند؛ یعنی تنظیمات یادگرفته‌شده‌ی زیرین که به توسعه‌دهندگان امکان می‌دهد سامانه را اجرا یا آن را تطبیق دهند، برای دانلود در دسترس است.

در مقابل، شرکت‌هایی مانند OpenAI، Anthropic و Google (GOOGL.O) شمار پارامترهای مدل‌های بسته‌ی خود را منتشر نمی‌کنند.

مدل Qwen3.۸-Max در پلتفرم جمع‌سپاری‌شده‌ی مقایسه مدل‌ها، یعنی Arena.AI رونمایی شد؛ جایی که این مدل بلافاصله به بالاترین‌رتبه‌ی مدل چینی در بخش مدل‌های متنی تبدیل شد، اگرچه همچنان پشت سر Claude Fable 5 و سه نسخه‌ی Opus قرار دارد که همگی متعلق به Anthropic هستند.

اما در جدول رتبه‌بندی Arena.AI برای مدل‌های هوش مصنوعی که تصاویر و سایر مواد بصری را تحلیل می‌کنند، Qwen3.۸-Max در رتبه دوم جهانی ایستاد؛ تنها پشت سر یکی از نسخه‌های Claude Fable ۵.

هر دوی Qwen3.8-Max و Kimi K3 قادرند با متن، تصویر و ویدئو کار کنند و تا ۱ میلیون توکن را در یک نوبت پردازش کنند.

«توکن‌ها» بخش‌هایی از داده‌اند؛ اغلب بخش‌هایی از کلمات یا کلمات کوتاه. رقم بزرگ توکن نشان می‌دهد مدل می‌تواند حجم عظیمی از محتوا را یک‌باره دریافت کند؛ برای مثال پرونده‌های حقوقی طولانی، یک کدبیس بزرگ نرم‌افزاری یا صدها صفحه سند.

علی‌بابا گفت مدل جدید از طراحی «ترکیب متخصصان» (mixture-of-experts) استفاده می‌کند؛ طرحی که کار را میان بخش‌های تخصصی سامانه تقسیم می‌کند، به‌جای آنکه برای هر درخواست، کل مدل را فعال کند. تنها ۹۵ میلیارد پارامتر در هر بار استفاده فعال می‌شوند که این امر هزینه‌ها و تأخیر در پاسخ را کاهش می‌دهد.

این غول فناوری اعلام کرد مدل توانسته یک پروژه مهندسی نرم‌افزار را در مدت ۱۶ روز تکمیل کند.

قرار است Qwen3.8-Max هفته‌ی آینده از طریق پلتفرم Model Studio در Alibaba Cloud عرضه شود.

نمایش بیشتر

اخبار مرتبط

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

دکمه بازگشت به بالا