حساب کاربری ندارید؟ ثبت نام کنید

کوالکام جزئیات NPU اسنپدراگون ۸ الیت نسل ۶ را اعلام کرد؛ اجرای محلی مدل‌های هوش مصنوعی تا ۳۰ میلیارد پارامتر

نوشته

1 ساعت قبل | بدون دیدگاه | پردازشگرها، کوالکام

کوالکام پیش از معرفی نسل بعدی تراشه‌های پرچم‌دار Snapdragon با نام احتمالی اسنپدراگون ۸ الیت نسل ۶، جزئیات تازه‌ای از NPU جدید Hexagon این تراشه را منتشر کرده است. این واحد پردازش عصبی برای اجرای هوش مصنوعی چندوجهی و عامل‌های هوش مصنوعی روی خود گوشی طراحی شده و می‌تواند امکان اجرای محلی مدل‌هایی با حداکثر ۳۰ میلیارد پارامتر را فراهم کند.

خلاصه خبر در یک نگاه

🔹 کوالکام نسل جدید NPU هگزاگون را برای پردازش محلی هوش مصنوعی چندوجهی و عامل‌های هوش مصنوعی توسعه داده است.
🔹 شتاب‌دهنده جدید Element Accelerator در کنار واحدهای اسکالر، برداری و تنسور قرار می‌گیرد و استنتاج مدل‌های ترنسفورمر را سرعت می‌بخشد.
🔹 حافظه اشتراکی بزرگ‌تر وابستگی NPU به رم اصلی گوشی را کاهش می‌دهد و امکان نگهداری اطلاعات زمینه‌ای بیشتری را فراهم می‌کند.
🔹 معماری جدید از مدل‌های Mixture-of-Experts پشتیبانی می‌کند و اجرای محلی مدل‌هایی با حداکثر ۳۰ میلیارد پارامتر را ممکن می‌سازد.
🔹 کوالکام از افزایش ۵۰ درصدی عملکرد مرحله pre-fill برای مدل‌های INT4 و بهبود سرعت رمزگشایی و تعداد توکن‌های پردازش‌شده در ثانیه خبر داده است.

نسل بعدی تراشه‌های پرچم‌دار اسنپدراگون چه زمانی معرفی می‌شود؟

کوالکام قرار است در ۳۱ شهریور ۱۴۰۵ (۲۲ سپتامبر ۲۰۲۶) و در رویداد بعدی Snapdragon Summit، نسل جدید تراشه‌های پرچم‌دار خود را معرفی کند. این خانواده شامل دو نسخه Elite خواهد بود و احتمال می‌رود نام Snapdragon 8 Elite Gen 6 برای آن انتخاب شود، هرچند نام رسمی این تراشه‌ها هنوز مشخص نشده است.

این شرکت پیش از رونمایی رسمی، به‌تدریج اطلاعاتی درباره پلتفرم‌های جدید منتشر کرده است. کوالکام پیش‌تر اعلام کرده بود که تراشه‌های آینده به نخستین CPU گوشی هوشمند با فرکانس بیش از ۵ گیگاهرتز مجهز می‌شوند و سپس جزئیاتی از GPU ارتقایافته با فناوری بهبودیافته افزایش وضوح فریم‌ها ارائه کرد.

اکنون تمرکز اطلاعات جدید روی واحد پردازش عصبی یا NPU قرار گرفته است؛ بخشی که در نسل آینده نقش مهمی در اجرای محلی قابلیت‌های هوش مصنوعی خواهد داشت.

واحد NPU جدید Hexagon برای عامل‌های هوش مصنوعی بهینه شده است

نسل جدید NPU هگزاگون با هدف اجرای برنامه‌های هوش مصنوعی چندوجهی روی خود دستگاه طراحی شده و کوالکام به‌طور ویژه روی کاربردهای مبتنی بر عامل‌های هوش مصنوعی تمرکز کرده است.

به گفته این شرکت، دو مورد از مهم‌ترین تغییرات این نسل شامل شتاب‌دهنده جدید Element Accelerator و حافظه اشتراکی بسیار بزرگ‌تر هستند.

نسل جدید NPU هگزاگون اسنپدراگون ۸ الیت نسل ۶

نسل جدید NPU هگزاگون اسنپدراگون ۸ الیت نسل ۶ کوالکام

شتاب‌دهنده Element Accelerator چه کاری انجام می‌دهد؟

شتاب‌دهنده Element Accelerator یک واحد تخصصی جدید است که در کنار واحدهای اسکالر، برداری و تنسور قرار می‌گیرد. کوالکام می‌گوید این بخش برای افزایش سرعت استنتاج مدل‌های ترنسفورمر طراحی شده است.

طبق توضیحات کوالکام، این شتاب‌دهنده می‌تواند به عامل‌های هوش مصنوعی کمک کند تا سریع‌تر پاسخ دهند، استدلال را با بهره‌وری بیشتری انجام دهند و تجربه‌های غنی‌تری ارائه کنند؛ آن هم بدون تحمیل هزینه مصرف انرژی بیشتر.

حافظه اشتراکی بزرگ‌تر، وابستگی NPU به رم گوشی را کاهش می‌دهد

کوالکام میزان دقیق پهنای باند را اعلام نکرده است، اما می‌گوید چهار واحد شتاب‌دهنده شامل تنسور، برداری، اسکالر و Element اکنون به حافظه اشتراکی بیشتری دسترسی دارند.

این تغییر هنگام تبادل داده از KV-cache، وابستگی به ماژول رم اصلی گوشی را کاهش می‌دهد. در عمل، NPU می‌تواند اطلاعات زمینه‌ای بیشتری را در اختیار داشته باشد و فضای لازم برای اجرای پردازش‌های سنگین‌تر، به‌خصوص وظایف مبتنی بر عامل‌های هوش مصنوعی، فراهم شود.

اجرای محلی مدل‌های هوش مصنوعی ۳۰ میلیارد پارامتری

معماری جدید NPU هگزاگون از ساختارهای هوش مصنوعی طراحی‌شده برای مدل‌های Mixture-of-Experts یا MoE نیز پشتیبانی خواهد کرد. این قابلیت می‌تواند اجرای مدل‌های بزرگ‌تر روی خود گوشی را امکان‌پذیر کند، زیرا در هر مرحله تنها بخشی از پارامترهای مدل فعال می‌شوند.

در مدل‌های MoE، درخواست ورودی بر اساس ماهیت آن به مدل‌های متخصص مناسب هدایت می‌شود. چنین روشی میزان محاسبات و پهنای باند حافظه موردنیاز را کاهش می‌دهد.

کوالکام اعلام کرده است که معماری جدید امکان اجرای محلی مدل‌هایی با حداکثر ۳۰ میلیارد پارامتر را فراهم خواهد کرد؛ بنابراین بخشی از پردازش‌های سنگین هوش مصنوعی می‌تواند مستقیماً روی گوشی انجام شود.

افزایش ۵۰ درصدی عملکرد pre-fill در مدل‌های INT4

کوالکام برای نسل جدید NPU از ۵۰ درصد عملکرد بالاتر در مرحله pre-fill، توان عملیاتی بیشتر در رمزگشایی، بهبود speculative decoding و افزایش تعداد کلی توکن‌های پردازش‌شده در ثانیه خبر داده است.

البته این ادعای ۵۰ درصدی مشخصاً به مدل‌هایی با دقت INT4 مربوط می‌شود و نباید آن را به‌عنوان افزایش مستقیم ۵۰ درصدی عملکرد کلی هوش مصنوعی تراشه تفسیر کرد.

مجموع این تغییرات می‌تواند زمان پاسخ‌دهی مدل‌های هوش مصنوعی را کاهش دهد و اجرای سریع‌تر وظایف چندمرحله‌ای را امکان‌پذیر کند.

تمرکز تراشه‌های جدید اسنپدراگون روی پردازش محلی هوش مصنوعی

مهم‌ترین مزیت معماری جدید، تقویت پردازش هوش مصنوعی به‌صورت محلی روی دستگاه است. کوالکام می‌گوید مجموعه بهبودهای تراشه‌های آینده Snapdragon Elite باعث می‌شود گردش‌کارهای مبتنی بر عامل‌های هوش مصنوعی، و نه صرفاً پرسش‌های معمول از هوش مصنوعی، با بهره‌وری و سرعت پاسخ‌دهی بیشتری اجرا شوند.

🔴 همچنین بخوانید: بنچمارک اسنپدراگون ۸ الیت نسل ۶ پرو فاش شد؛ امتیاز ۴.۸۳ میلیون در AnTuTu

جمع‌بندی

نسل جدید NPU هگزاگون اسنپدراگون ۸ الیت نسل ۶ کوالکام با اضافه شدن شتاب‌دهنده Element Accelerator، حافظه اشتراکی بیشتر و پشتیبانی از معماری Mixture-of-Experts، برای اجرای وظایف پیچیده‌تر هوش مصنوعی روی خود گوشی آماده می‌شود. امکان اجرای محلی مدل‌های حداکثر ۳۰ میلیارد پارامتری نیز نشان می‌دهد که کوالکام در نسل بعدی تراشه‌های پرچم‌دار خود تمرکز ویژه‌ای روی عامل‌های هوش مصنوعی و پردازش محلی دارد.

به نظر شما در نسل بعدی گوشی‌های مجهز به تراشه‌های پرچم‌دار اسنپدراگون، اجرای محلی عامل‌های هوش مصنوعی تا چه اندازه کاربردی خواهد بود؟

اشتراک در
اطلاع از
0 Comments
بازخورد (Feedback) های اینلاین
مشاهده همه دیدگاه ها
مطالب اخیر
امیرحسین ملکی