شرکت چینی علی‌بابا رسماً از جدیدترین و بزرگ‌ترین مدل هوش مصنوعی خود با نام «کوئن ۳.۸ مکس» (Qwen 3.8 Max) پرده برداشت؛ مدلی که به گفته کارشناسان از نظر توانمندی فاصله چندانی با هوش مصنوعی «مون شات» که ماه گذشته ارائه شده بود، ندارد. به گزارش خبرگزاری مهر به نقل از رویترز، این اقدام در حالی صورت می‌گیرد که شرکت‌های فناوری چین رقابتی فشرده را برای ساخت سیستم‌های هوش مصنوعی قدرتمندتر آغاز کرده‌اند و هم‌زمان به دنبال راه‌هایی برای کاهش هزینه‌های اجرا و فعال‌سازی این مدل‌ها هستند.

۲.۴ هزار میلیارد پارامتر؛ مقیاس تازه در مدل‌های چینی

مدل جدید علی‌بابا از ۲.۴ هزار میلیارد پارامتر برخوردار است. هرچند کارشناسان تأکید می‌کنند شمار بالاتر پارامترها لزوماً به معنای برتری یک مدل نیست، اما این شاخص همچنان معیاری کلیدی برای ارزیابی مقیاس محاسبات و حجم داده‌های به‌کاررفته در آموزش سیستم‌های هوش مصنوعی به شمار می‌رود. شرکت‌های فناوری چینی نیز معمولاً شمار پارامترهای مدل‌های خود را برای جلب توجه جامعه توسعه‌دهندگان نرم‌افزار اعلام می‌کنند.

یکی از ویژگی‌های برجسته مدل‌های چینی، متن‌باز بودن آن‌هاست؛ به این معنا که وزن‌های آموزش‌دیده و تنظیمات اصلی که به توسعه‌دهندگان امکان اجرا یا شخصی‌سازی سیستم را می‌دهد، به‌صورت آزاد در اختیار عموم قرار می‌گیرد.

جایگاه کوئن ۳.۸ مکس در جدول رده‌بندی Arena.AI

«کوئن ۳.۸ مکس» نخستین بار در پلتفرم مقایسه مدل‌ها با مشارکت جمعی Arena.AI معرفی شد و بلافاصله بالاترین رتبه را در میان مدل‌های متنی چینی به دست آورد. با این حال، این مدل همچنان از «فابل ۵» و سه نسخه هوش مصنوعی «اوپوس» که همگی محصولات شرکت آنتروپیک هستند، عقب‌تر قرار دارد.

اما در بخش مدل‌های تحلیل‌گر تصاویر و محتوای بصری، کوئن ۳.۸ مکس جایگاه دوم جهانی را تصاحب کرد و تنها پس از یکی از نسخه‌های «فابل ۵» ایستاد. این موفقیت نشان می‌دهد مدل جدید علی‌بابا نه فقط در پردازش متن، بلکه در درک محتوای بصری نیز عملکردی در سطح جهانی دارد.

پردازش یک میلیون توکن و معماری ترکیب متخصصان

«کوئن ۳.۸ مکس» و مدل «کیمی کی ۳» هر دو قادر به پردازش متن، تصویر و ویدیو هستند و می‌توانند تا یک میلیون توکن را به‌طور هم‌زمان پردازش کنند. این ظرفیت بالا، کاربرد مدل را در پروژه‌های بزرگ و مجموعه‌داده‌های حجیم گسترش می‌دهد.

علی‌بابا اعلام کرده که مدل جدیدش بر پایه طراحی «ترکیب متخصصان» (Mixture-of-Experts) ساخته شده است. در این معماری، به‌جای فعال‌سازی تمام مدل برای هر درخواست، کار میان بخش‌های تخصصی سیستم تقسیم می‌شود؛ به‌گونه‌ای که در هر لحظه تنها ۹۵ میلیارد پارامتر فعال است. این روش هزینه‌ها و زمان پاسخ‌دهی را به‌طور چشمگیری کاهش می‌دهد.

قابلیت‌های عملی و زمان عرضه

به گفته این شرکت فناوری چینی، مدل مذکور موفق شده یک پروژه مهندسی نرم‌افزار را تنها در ۱۶ روز به انجام برساند که گواهی بر توانایی آن در کارهای پیچیده برنامه‌نویسی و توسعه است.

قرار است «کوئن ۳.۸ مکس» هفته آینده از طریق پلتفرم «Model Studio» در سرویس ابر رایانشی علی‌بابا در دسترس کاربران قرار گیرد. با این عرضه، رقابت میان غول‌های فناوری چین و آمریکا در حوزه هوش مصنوعی وارد مرحله تازه‌ای خواهد شد.