کوالکام در آستانه برگزاری رویداد بزرگ سالانه خود، نخستین جزئیات فنی از واحد پردازش عصبی (NPU) جدید به‌کار رفته در تراشه پرچمدار آینده‌اش را منتشر کرد. این شرکت قرار است در ۲۲ سپتامبر در جریان اجلاس اسنپدراگون (Snapdragon Summit) از دو تراشه اسنپدراگون ۸ الیت نسل ۶ و اسنپدراگون ۸ الیت نسل ۶ پرو رونمایی کند و حالا تمرکز خود را بر مهم‌ترین بخش هوش مصنوعی این تراشه‌ها؛ یعنی هگزاگون NPU جدید گذاشته است.

معرفی در اجلاس اسنپدراگون؛ تمرکز بر نسخه پرو

اگرچه کوالکام به‌طور رسمی نام دقیق تراشه مجهز به این NPU را اعلام نکرده، اما شواهد و لحن اطلاع‌رسانی نشان می‌دهد که این واحد جدید به نسخه پرو از نسل ششم اسنپدراگون ۸ الیت تعلق دارد. نسخه پرو همواره جایگاه تراشه کامل و بدون مصالحه کوالکام را داشته و امسال نیز به نظر می‌رسد بار اصلی نوآوری در حوزه هوش مصنوعی را بر دوش بکشد.

این رونمایی زودهنگام، بخشی از استراتژی کوالکام برای ایجاد هیجان پیش از رویداد اصلی است؛ رویدادی که انتظار می‌رود علاوه بر مشخصات فنی کامل، بنچمارک‌ها و همکاری با سازندگان موبایل مانند iQOO و شیائومی را نیز به همراه داشته باشد.

نمای نزدیک از NPU جدید هگزاگون کوالکام برای اسنپدراگون 8 الیت نسل 6 پرو

قلب تپنده هوش عامل‌محور: شتاب‌دهنده Element

مهم‌ترین تغییر در معماری جدید، افزوده شدن یک بلوک سخت‌افزاری کاملا جدید به نام Element Accelerator است. کوالکام می‌گوید این شتاب‌دهنده به‌طور ویژه برای بارهای کاری مبتنی بر ترنسفورمر طراحی شده؛ همان معماری که امروز ستون فقرات مدل‌های مولد و عامل‌محور (Agentic AI) محسوب می‌شود.

به گفته این شرکت، شتاب‌دهنده Element در کنار توسعه‌های اسکالر، برداری و ماتریسی موجود در هگزاگون، عملیاتی را که برای مدل‌های بزرگ زبانی بیشترین اهمیت را دارند، به‌صورت سخت‌افزاری تسریع می‌کند. نتیجه این ترکیب، پاسخ‌گویی سریع‌تر عامل‌ها، استدلال کارآمدتر و ارائه تجربه‌های غنی‌تر بدون افزایش مصرف انرژی در دستگاه‌های موبایلی است.

کوالکام تاکید می‌کند که این NPU برای هوش مصنوعی همیشه روشن (Always-Running AI) طراحی شده؛ به این معنا که می‌تواند بدون نیاز به اتصال دائمی به فضای ابری، وظایف پیچیده‌ای مانند استدلال با زمینه طولانی، پردازش مدل‌های چندوجهی (متن، تصویر، صدا)، اجرای هم‌زمان چند عامل هوشمند و حلقه‌های عملیاتی با تاخیر بسیار کم را مدیریت کند.

حافظه مشترک ۵۰ درصد بزرگ‌تر؛ خداحافظی با گلوگاه حافظه

یکی دیگر از ارتقاهای کلیدی، افزایش ۵۰ درصدی حافظه مشترک (Shared Memory) در داخل NPU است. این حافظه وظیفه دارد داده‌های پرکاربرد مدل‌ها را تا حد امکان نزدیک به هسته‌های پردازشی نگه دارد.

کوالکام توضیح می‌دهد که این تغییر به عامل‌های هوشمند اجازه می‌دهد در حالی که با زمینه‌های طولانی‌تر، ابزارهای بیشتر و وظایف هم‌زمان سروکار دارند، همچنان واکنش‌پذیر باقی بمانند. افزایش ظرفیت حافظه مشترک به معنای کاهش گلوگاه‌های حافظه و تجربه‌ای سریع‌تر و روان‌تر در اجرای دستیارهای هوشمند روی خود دستگاه است؛ موضوعی که برای کاربر نهایی به معنای تاخیر کمتر و پاسخ‌های آنی‌تر خواهد بود.

جهش سرعت در مدل‌های INT4 و بهینه برای معماری MoE

بر اساس اطلاعات رسمی، NPU جدید تا ۵۰ درصد سرعت پیش‌پردازش (Prefill) سریع‌تر را برای مدل‌های کوانتیزه‌شده با دقت INT4 ارائه می‌دهد. مدل‌های INT4 که با کاهش دقت محاسبات، حجم و مصرف انرژی را به شدت کم می‌کنند، امروز استاندارد اجرای مدل‌های بزرگ روی موبایل هستند و این بهبود سرعت، تاثیر مستقیمی بر زمان انتظار کاربر برای تولید اولین توکن پاسخ دارد.

نکته مهم دیگر، سازگاری ویژه این معماری با مدل‌های Mixture-of-Experts یا MoE است. در این مدل‌ها، به جای فعال‌سازی تمام پارامترهای یک مدل عظیم برای هر توکن، تنها کسری از متخصص‌ها (Experts) فعال می‌شوند. کوالکام می‌گوید هگزاگون جدید به‌خوبی از این الگوی پراکنده پشتیبانی می‌کند و می‌تواند با صرف انرژی کمتر، مدل‌های بسیار بزرگ‌تر از حافظه فیزیکی دستگاه را به‌صورت هوشمند اجرا کند.

  • ۵۰ درصد حافظه مشترک بزرگ‌تر برای نگهداری داده‌های پرتکرار نزدیک به NPU
  • شتاب‌دهنده Element مخصوص ترنسفورمرها در کنار واحدهای اسکالر، برداری و ماتریسی
  • ۵۰ درصد Prefill سریع‌تر در مدل‌های INT4
  • پشتیبانی بهینه از مدل‌های MoE با فعال‌سازی جزئی پارامترها
  • طراحی برای اجرای هم‌زمان چند عامل، مدل‌های چندوجهی و استدلال طولانی‌مدت

چشم‌انداز کوالکام: هوش مصنوعی بدون وابستگی به ابر

کوالکام NPU جدید را فراتر از یک ارتقای سخت‌افزاری ساده توصیف می‌کند و آن را زیرساختی برای نسل بعدی تجربه‌های موبایلی می‌داند. تمرکز این شرکت به‌وضوح از افزایش صرف قدرت خام به سمت هوش عامل‌محور تغییر کرده است؛ جایی که دستیارهای هوشمند نه فقط به دستورات پاسخ می‌دهند، بلکه به‌صورت مستقل ابزارها را فراخوانی می‌کنند، زمینه مکالمات طولانی را به خاطر می‌سپارند و چند وظیفه را به‌صورت هم‌زمان پیش می‌برند.

با توجه به اینکه رقبایی مانند اپل و مدیاتک نیز به شدت بر روی NPU و هوش مصنوعی روی دستگاه سرمایه‌گذاری کرده‌اند، به نظر می‌رسد رقابت پرچمداران در سال ۲۰۲۷ بیش از هر زمان دیگری بر سر کارایی هوش مصنوعی آفلاین خواهد بود. جزئیات کامل‌تر از فرکانس هسته‌ها، عملکرد گرافیکی و مصرف انرژی این تراشه‌ها در اجلاس ۲۲ سپتامبر مشخص خواهد شد؛ رویدادی که گفته می‌شود کوالکام برای اولین بار سقف فرکانس ۵ گیگاهرتز را برای هسته‌های اصلی خود هدف گرفته است.

آنچه مسلم است، اسنپدراگون ۸ الیت نسل ۶ پرو با این NPU جدید، تلاش می‌کند شکاف میان قدرت پردازشی گوشی‌های هوشمند و نیازهای فزاینده مدل‌های هوش مصنوعی مولد را پر کند و تجربه‌ای نزدیک به آنچه امروز تنها در سرورهای ابری ممکن است را به جیب کاربران بیاورد.