کوالکام پیش از معرفی نسل بعدی تراشههای پرچمدار Snapdragon با نام احتمالی اسنپدراگون ۸ الیت نسل ۶، جزئیات تازهای از NPU جدید Hexagon این تراشه را منتشر کرده است. این واحد پردازش عصبی برای اجرای هوش مصنوعی چندوجهی و عاملهای هوش مصنوعی روی خود گوشی طراحی شده و میتواند امکان اجرای محلی مدلهایی با حداکثر ۳۰ میلیارد پارامتر را فراهم کند.
🔹 کوالکام نسل جدید NPU هگزاگون را برای پردازش محلی هوش مصنوعی چندوجهی و عاملهای هوش مصنوعی توسعه داده است.
🔹 شتابدهنده جدید Element Accelerator در کنار واحدهای اسکالر، برداری و تنسور قرار میگیرد و استنتاج مدلهای ترنسفورمر را سرعت میبخشد.
🔹 حافظه اشتراکی بزرگتر وابستگی NPU به رم اصلی گوشی را کاهش میدهد و امکان نگهداری اطلاعات زمینهای بیشتری را فراهم میکند.
🔹 معماری جدید از مدلهای Mixture-of-Experts پشتیبانی میکند و اجرای محلی مدلهایی با حداکثر ۳۰ میلیارد پارامتر را ممکن میسازد.
🔹 کوالکام از افزایش ۵۰ درصدی عملکرد مرحله pre-fill برای مدلهای INT4 و بهبود سرعت رمزگشایی و تعداد توکنهای پردازششده در ثانیه خبر داده است.
کوالکام قرار است در ۳۱ شهریور ۱۴۰۵ (۲۲ سپتامبر ۲۰۲۶) و در رویداد بعدی Snapdragon Summit، نسل جدید تراشههای پرچمدار خود را معرفی کند. این خانواده شامل دو نسخه Elite خواهد بود و احتمال میرود نام Snapdragon 8 Elite Gen 6 برای آن انتخاب شود، هرچند نام رسمی این تراشهها هنوز مشخص نشده است.
این شرکت پیش از رونمایی رسمی، بهتدریج اطلاعاتی درباره پلتفرمهای جدید منتشر کرده است. کوالکام پیشتر اعلام کرده بود که تراشههای آینده به نخستین CPU گوشی هوشمند با فرکانس بیش از ۵ گیگاهرتز مجهز میشوند و سپس جزئیاتی از GPU ارتقایافته با فناوری بهبودیافته افزایش وضوح فریمها ارائه کرد.
اکنون تمرکز اطلاعات جدید روی واحد پردازش عصبی یا NPU قرار گرفته است؛ بخشی که در نسل آینده نقش مهمی در اجرای محلی قابلیتهای هوش مصنوعی خواهد داشت.
نسل جدید NPU هگزاگون با هدف اجرای برنامههای هوش مصنوعی چندوجهی روی خود دستگاه طراحی شده و کوالکام بهطور ویژه روی کاربردهای مبتنی بر عاملهای هوش مصنوعی تمرکز کرده است.
به گفته این شرکت، دو مورد از مهمترین تغییرات این نسل شامل شتابدهنده جدید Element Accelerator و حافظه اشتراکی بسیار بزرگتر هستند.
شتابدهنده Element Accelerator یک واحد تخصصی جدید است که در کنار واحدهای اسکالر، برداری و تنسور قرار میگیرد. کوالکام میگوید این بخش برای افزایش سرعت استنتاج مدلهای ترنسفورمر طراحی شده است.
طبق توضیحات کوالکام، این شتابدهنده میتواند به عاملهای هوش مصنوعی کمک کند تا سریعتر پاسخ دهند، استدلال را با بهرهوری بیشتری انجام دهند و تجربههای غنیتری ارائه کنند؛ آن هم بدون تحمیل هزینه مصرف انرژی بیشتر.
کوالکام میزان دقیق پهنای باند را اعلام نکرده است، اما میگوید چهار واحد شتابدهنده شامل تنسور، برداری، اسکالر و Element اکنون به حافظه اشتراکی بیشتری دسترسی دارند.
این تغییر هنگام تبادل داده از KV-cache، وابستگی به ماژول رم اصلی گوشی را کاهش میدهد. در عمل، NPU میتواند اطلاعات زمینهای بیشتری را در اختیار داشته باشد و فضای لازم برای اجرای پردازشهای سنگینتر، بهخصوص وظایف مبتنی بر عاملهای هوش مصنوعی، فراهم شود.
معماری جدید NPU هگزاگون از ساختارهای هوش مصنوعی طراحیشده برای مدلهای Mixture-of-Experts یا MoE نیز پشتیبانی خواهد کرد. این قابلیت میتواند اجرای مدلهای بزرگتر روی خود گوشی را امکانپذیر کند، زیرا در هر مرحله تنها بخشی از پارامترهای مدل فعال میشوند.
در مدلهای MoE، درخواست ورودی بر اساس ماهیت آن به مدلهای متخصص مناسب هدایت میشود. چنین روشی میزان محاسبات و پهنای باند حافظه موردنیاز را کاهش میدهد.
کوالکام اعلام کرده است که معماری جدید امکان اجرای محلی مدلهایی با حداکثر ۳۰ میلیارد پارامتر را فراهم خواهد کرد؛ بنابراین بخشی از پردازشهای سنگین هوش مصنوعی میتواند مستقیماً روی گوشی انجام شود.
کوالکام برای نسل جدید NPU از ۵۰ درصد عملکرد بالاتر در مرحله pre-fill، توان عملیاتی بیشتر در رمزگشایی، بهبود speculative decoding و افزایش تعداد کلی توکنهای پردازششده در ثانیه خبر داده است.
البته این ادعای ۵۰ درصدی مشخصاً به مدلهایی با دقت INT4 مربوط میشود و نباید آن را بهعنوان افزایش مستقیم ۵۰ درصدی عملکرد کلی هوش مصنوعی تراشه تفسیر کرد.
مجموع این تغییرات میتواند زمان پاسخدهی مدلهای هوش مصنوعی را کاهش دهد و اجرای سریعتر وظایف چندمرحلهای را امکانپذیر کند.
مهمترین مزیت معماری جدید، تقویت پردازش هوش مصنوعی بهصورت محلی روی دستگاه است. کوالکام میگوید مجموعه بهبودهای تراشههای آینده Snapdragon Elite باعث میشود گردشکارهای مبتنی بر عاملهای هوش مصنوعی، و نه صرفاً پرسشهای معمول از هوش مصنوعی، با بهرهوری و سرعت پاسخدهی بیشتری اجرا شوند.
🔴 همچنین بخوانید: بنچمارک اسنپدراگون ۸ الیت نسل ۶ پرو فاش شد؛ امتیاز ۴.۸۳ میلیون در AnTuTu
نسل جدید NPU هگزاگون اسنپدراگون ۸ الیت نسل ۶ کوالکام با اضافه شدن شتابدهنده Element Accelerator، حافظه اشتراکی بیشتر و پشتیبانی از معماری Mixture-of-Experts، برای اجرای وظایف پیچیدهتر هوش مصنوعی روی خود گوشی آماده میشود. امکان اجرای محلی مدلهای حداکثر ۳۰ میلیارد پارامتری نیز نشان میدهد که کوالکام در نسل بعدی تراشههای پرچمدار خود تمرکز ویژهای روی عاملهای هوش مصنوعی و پردازش محلی دارد.
به نظر شما در نسل بعدی گوشیهای مجهز به تراشههای پرچمدار اسنپدراگون، اجرای محلی عاملهای هوش مصنوعی تا چه اندازه کاربردی خواهد بود؟