کوالکام در آستانه برگزاری رویداد بزرگ سالانه خود، نخستین جزئیات فنی از واحد پردازش عصبی (NPU) جدید بهکار رفته در تراشه پرچمدار آیندهاش را منتشر کرد. این شرکت قرار است در ۲۲ سپتامبر در جریان اجلاس اسنپدراگون (Snapdragon Summit) از دو تراشه اسنپدراگون ۸ الیت نسل ۶ و اسنپدراگون ۸ الیت نسل ۶ پرو رونمایی کند و حالا تمرکز خود را بر مهمترین بخش هوش مصنوعی این تراشهها؛ یعنی هگزاگون NPU جدید گذاشته است.
معرفی در اجلاس اسنپدراگون؛ تمرکز بر نسخه پرو
اگرچه کوالکام بهطور رسمی نام دقیق تراشه مجهز به این NPU را اعلام نکرده، اما شواهد و لحن اطلاعرسانی نشان میدهد که این واحد جدید به نسخه پرو از نسل ششم اسنپدراگون ۸ الیت تعلق دارد. نسخه پرو همواره جایگاه تراشه کامل و بدون مصالحه کوالکام را داشته و امسال نیز به نظر میرسد بار اصلی نوآوری در حوزه هوش مصنوعی را بر دوش بکشد.
این رونمایی زودهنگام، بخشی از استراتژی کوالکام برای ایجاد هیجان پیش از رویداد اصلی است؛ رویدادی که انتظار میرود علاوه بر مشخصات فنی کامل، بنچمارکها و همکاری با سازندگان موبایل مانند iQOO و شیائومی را نیز به همراه داشته باشد.
قلب تپنده هوش عاملمحور: شتابدهنده Element
مهمترین تغییر در معماری جدید، افزوده شدن یک بلوک سختافزاری کاملا جدید به نام Element Accelerator است. کوالکام میگوید این شتابدهنده بهطور ویژه برای بارهای کاری مبتنی بر ترنسفورمر طراحی شده؛ همان معماری که امروز ستون فقرات مدلهای مولد و عاملمحور (Agentic AI) محسوب میشود.
به گفته این شرکت، شتابدهنده Element در کنار توسعههای اسکالر، برداری و ماتریسی موجود در هگزاگون، عملیاتی را که برای مدلهای بزرگ زبانی بیشترین اهمیت را دارند، بهصورت سختافزاری تسریع میکند. نتیجه این ترکیب، پاسخگویی سریعتر عاملها، استدلال کارآمدتر و ارائه تجربههای غنیتر بدون افزایش مصرف انرژی در دستگاههای موبایلی است.
کوالکام تاکید میکند که این NPU برای هوش مصنوعی همیشه روشن (Always-Running AI) طراحی شده؛ به این معنا که میتواند بدون نیاز به اتصال دائمی به فضای ابری، وظایف پیچیدهای مانند استدلال با زمینه طولانی، پردازش مدلهای چندوجهی (متن، تصویر، صدا)، اجرای همزمان چند عامل هوشمند و حلقههای عملیاتی با تاخیر بسیار کم را مدیریت کند.
حافظه مشترک ۵۰ درصد بزرگتر؛ خداحافظی با گلوگاه حافظه
یکی دیگر از ارتقاهای کلیدی، افزایش ۵۰ درصدی حافظه مشترک (Shared Memory) در داخل NPU است. این حافظه وظیفه دارد دادههای پرکاربرد مدلها را تا حد امکان نزدیک به هستههای پردازشی نگه دارد.
کوالکام توضیح میدهد که این تغییر به عاملهای هوشمند اجازه میدهد در حالی که با زمینههای طولانیتر، ابزارهای بیشتر و وظایف همزمان سروکار دارند، همچنان واکنشپذیر باقی بمانند. افزایش ظرفیت حافظه مشترک به معنای کاهش گلوگاههای حافظه و تجربهای سریعتر و روانتر در اجرای دستیارهای هوشمند روی خود دستگاه است؛ موضوعی که برای کاربر نهایی به معنای تاخیر کمتر و پاسخهای آنیتر خواهد بود.
جهش سرعت در مدلهای INT4 و بهینه برای معماری MoE
بر اساس اطلاعات رسمی، NPU جدید تا ۵۰ درصد سرعت پیشپردازش (Prefill) سریعتر را برای مدلهای کوانتیزهشده با دقت INT4 ارائه میدهد. مدلهای INT4 که با کاهش دقت محاسبات، حجم و مصرف انرژی را به شدت کم میکنند، امروز استاندارد اجرای مدلهای بزرگ روی موبایل هستند و این بهبود سرعت، تاثیر مستقیمی بر زمان انتظار کاربر برای تولید اولین توکن پاسخ دارد.
نکته مهم دیگر، سازگاری ویژه این معماری با مدلهای Mixture-of-Experts یا MoE است. در این مدلها، به جای فعالسازی تمام پارامترهای یک مدل عظیم برای هر توکن، تنها کسری از متخصصها (Experts) فعال میشوند. کوالکام میگوید هگزاگون جدید بهخوبی از این الگوی پراکنده پشتیبانی میکند و میتواند با صرف انرژی کمتر، مدلهای بسیار بزرگتر از حافظه فیزیکی دستگاه را بهصورت هوشمند اجرا کند.
- ۵۰ درصد حافظه مشترک بزرگتر برای نگهداری دادههای پرتکرار نزدیک به NPU
- شتابدهنده Element مخصوص ترنسفورمرها در کنار واحدهای اسکالر، برداری و ماتریسی
- ۵۰ درصد Prefill سریعتر در مدلهای INT4
- پشتیبانی بهینه از مدلهای MoE با فعالسازی جزئی پارامترها
- طراحی برای اجرای همزمان چند عامل، مدلهای چندوجهی و استدلال طولانیمدت
چشمانداز کوالکام: هوش مصنوعی بدون وابستگی به ابر
کوالکام NPU جدید را فراتر از یک ارتقای سختافزاری ساده توصیف میکند و آن را زیرساختی برای نسل بعدی تجربههای موبایلی میداند. تمرکز این شرکت بهوضوح از افزایش صرف قدرت خام به سمت هوش عاملمحور تغییر کرده است؛ جایی که دستیارهای هوشمند نه فقط به دستورات پاسخ میدهند، بلکه بهصورت مستقل ابزارها را فراخوانی میکنند، زمینه مکالمات طولانی را به خاطر میسپارند و چند وظیفه را بهصورت همزمان پیش میبرند.
با توجه به اینکه رقبایی مانند اپل و مدیاتک نیز به شدت بر روی NPU و هوش مصنوعی روی دستگاه سرمایهگذاری کردهاند، به نظر میرسد رقابت پرچمداران در سال ۲۰۲۷ بیش از هر زمان دیگری بر سر کارایی هوش مصنوعی آفلاین خواهد بود. جزئیات کاملتر از فرکانس هستهها، عملکرد گرافیکی و مصرف انرژی این تراشهها در اجلاس ۲۲ سپتامبر مشخص خواهد شد؛ رویدادی که گفته میشود کوالکام برای اولین بار سقف فرکانس ۵ گیگاهرتز را برای هستههای اصلی خود هدف گرفته است.
آنچه مسلم است، اسنپدراگون ۸ الیت نسل ۶ پرو با این NPU جدید، تلاش میکند شکاف میان قدرت پردازشی گوشیهای هوشمند و نیازهای فزاینده مدلهای هوش مصنوعی مولد را پر کند و تجربهای نزدیک به آنچه امروز تنها در سرورهای ابری ممکن است را به جیب کاربران بیاورد.
نظرات (0)