شرکت چینی علیبابا رسماً از جدیدترین و بزرگترین مدل هوش مصنوعی خود با نام «کوئن ۳.۸ مکس» (Qwen 3.8 Max) پرده برداشت؛ مدلی که به گفته کارشناسان از نظر توانمندی فاصله چندانی با هوش مصنوعی «مون شات» که ماه گذشته ارائه شده بود، ندارد. به گزارش خبرگزاری مهر به نقل از رویترز، این اقدام در حالی صورت میگیرد که شرکتهای فناوری چین رقابتی فشرده را برای ساخت سیستمهای هوش مصنوعی قدرتمندتر آغاز کردهاند و همزمان به دنبال راههایی برای کاهش هزینههای اجرا و فعالسازی این مدلها هستند.
۲.۴ هزار میلیارد پارامتر؛ مقیاس تازه در مدلهای چینی
مدل جدید علیبابا از ۲.۴ هزار میلیارد پارامتر برخوردار است. هرچند کارشناسان تأکید میکنند شمار بالاتر پارامترها لزوماً به معنای برتری یک مدل نیست، اما این شاخص همچنان معیاری کلیدی برای ارزیابی مقیاس محاسبات و حجم دادههای بهکاررفته در آموزش سیستمهای هوش مصنوعی به شمار میرود. شرکتهای فناوری چینی نیز معمولاً شمار پارامترهای مدلهای خود را برای جلب توجه جامعه توسعهدهندگان نرمافزار اعلام میکنند.
یکی از ویژگیهای برجسته مدلهای چینی، متنباز بودن آنهاست؛ به این معنا که وزنهای آموزشدیده و تنظیمات اصلی که به توسعهدهندگان امکان اجرا یا شخصیسازی سیستم را میدهد، بهصورت آزاد در اختیار عموم قرار میگیرد.
جایگاه کوئن ۳.۸ مکس در جدول ردهبندی Arena.AI
«کوئن ۳.۸ مکس» نخستین بار در پلتفرم مقایسه مدلها با مشارکت جمعی Arena.AI معرفی شد و بلافاصله بالاترین رتبه را در میان مدلهای متنی چینی به دست آورد. با این حال، این مدل همچنان از «فابل ۵» و سه نسخه هوش مصنوعی «اوپوس» که همگی محصولات شرکت آنتروپیک هستند، عقبتر قرار دارد.
اما در بخش مدلهای تحلیلگر تصاویر و محتوای بصری، کوئن ۳.۸ مکس جایگاه دوم جهانی را تصاحب کرد و تنها پس از یکی از نسخههای «فابل ۵» ایستاد. این موفقیت نشان میدهد مدل جدید علیبابا نه فقط در پردازش متن، بلکه در درک محتوای بصری نیز عملکردی در سطح جهانی دارد.
پردازش یک میلیون توکن و معماری ترکیب متخصصان
«کوئن ۳.۸ مکس» و مدل «کیمی کی ۳» هر دو قادر به پردازش متن، تصویر و ویدیو هستند و میتوانند تا یک میلیون توکن را بهطور همزمان پردازش کنند. این ظرفیت بالا، کاربرد مدل را در پروژههای بزرگ و مجموعهدادههای حجیم گسترش میدهد.
علیبابا اعلام کرده که مدل جدیدش بر پایه طراحی «ترکیب متخصصان» (Mixture-of-Experts) ساخته شده است. در این معماری، بهجای فعالسازی تمام مدل برای هر درخواست، کار میان بخشهای تخصصی سیستم تقسیم میشود؛ بهگونهای که در هر لحظه تنها ۹۵ میلیارد پارامتر فعال است. این روش هزینهها و زمان پاسخدهی را بهطور چشمگیری کاهش میدهد.
قابلیتهای عملی و زمان عرضه
به گفته این شرکت فناوری چینی، مدل مذکور موفق شده یک پروژه مهندسی نرمافزار را تنها در ۱۶ روز به انجام برساند که گواهی بر توانایی آن در کارهای پیچیده برنامهنویسی و توسعه است.
قرار است «کوئن ۳.۸ مکس» هفته آینده از طریق پلتفرم «Model Studio» در سرویس ابر رایانشی علیبابا در دسترس کاربران قرار گیرد. با این عرضه، رقابت میان غولهای فناوری چین و آمریکا در حوزه هوش مصنوعی وارد مرحله تازهای خواهد شد.
نظرات (0)