حساب کاربری ندارید؟ ثبت نام کنید

تراشه Jalapeño شرکت OpenAI در اولین بنچمارک‌ها قدرت‌نمایی کرد

نوشته

4 ساعت قبل | بدون دیدگاه | پردازشگرها، هوش مصنوعی

شرکت OpenAI جزئیات بیشتری از تراشه Jalapeño و نخستین نتایج بنچمارک این سیستم را در کنفرانس Hot Chips منتشر کرده است. نتایج آزمایش InferenceX متعلق به SemiAnalysis نشان می‌دهند Jalapeño در دو معیار تعداد توکن بیشتر به‌ازای هر کاربر و توان عملیاتی بیشتر به‌ازای هر کیلووات، عملکردی بالاتر از پردازنده‌های پیشرو استنتاج هوش مصنوعی موجود در بازار ارائه می‌دهد.

خلاصه خبر در یک نگاه:

🔷 تراشه Jalapeño اوپن‌ای‌آی برای استنتاج سریع و مقیاس‌پذیر هوش مصنوعی طراحی شده است.
🔷 نتایج InferenceX از تعداد توکن بیشتر به‌ازای هر کاربر و توان عملیاتی بالاتر به‌ازای هر کیلووات حکایت دارند.
🔷 مقایسه ارائه‌شده شامل یک سیستم مبتنی‌بر Nvidia Blackwell نیز می‌شود.
🔷 اوپن‌ای‌آی Jalapeño را با همکاری نزدیک برادکام توسعه داده است.
🔷 عرضه بسیار محدود این سیستم برای اواخر ۲۰۲۶ و استقرار گسترده‌تر آن برای سال ۲۰۲۷ برنامه‌ریزی شده است.

بنچمارک تراشه Jalapeño اوپن‌ای‌آی چه چیزی نشان می‌دهد؟

اوپن‌ای‌آی روز سه‌شنبه در کنفرانس Hot Chips نخستین مجموعه از نتایج بنچمارک Jalapeño را ارائه کرد. این شرکت سیستم جدید خود را با بنچمارک InferenceX از SemiAnalysis آزمایش کرده است.

طبق نتایج ارائه‌شده، Jalapeño هم ازنظر تعداد توکن پردازش‌شده برای هر کاربر و هم در زمینه توان عملیاتی به‌ازای هر کیلووات، از پردازنده‌های پیشرو استنتاج که درحال‌حاضر در دسترس هستند، عملکرد بهتری ثبت کرده است.

ریچارد هو، مدیر بخش سخت‌افزار اوپن‌ای‌آی، می‌گوید نتایج از پیشرفتی قابل‌توجه نسبت‌به فناوری‌های فعلی حکایت دارند. به‌گفته او، Jalapeño می‌تواند با مصرف مقدار مشخصی انرژی، حجم بیشتری از پردازش‌های هوش مصنوعی را انجام دهد و درعین‌حال پاسخ‌ها را سریع‌تر به کاربران برگرداند.

آیا Jalapeño واقعاً از Nvidia Blackwell سریع‌تر است؟

یکی از نکات قابل‌توجه، حضور یک سیستم Nvidia Blackwell در این مقایسه است. نتایج ارائه‌شده نشان می‌دهند Jalapeño در معیارهای مورد آزمایش عملکرد بهتری داشته است؛ بااین‌حال، این مقایسه به سخت‌افزارهای موجود در زمان اجرای بنچمارک مربوط می‌شود.

تراشه Jalapeño شرکت OpenAI

تراشه Jalapeño شرکت OpenAI

تراشه Jalapeño قرار نیست بلافاصله در مقیاس گسترده مستقر شود. ریچارد هو تخمین می‌زند اوپن‌ای‌آی در پایان سال ۲۰۲۶ تنها حجم بسیار محدودی از این سیستم را مستقر کند و عرضه در مقیاس قابل‌توجه‌تر در سال ۲۰۲۷ انجام شود.

تا آن زمان، انویدیا و سایر شرکت‌های فعال در بازار شتاب‌دهنده‌های هوش مصنوعی فرصت خواهند داشت نسل‌های جدیدتری از محصولات خود را عرضه کنند. بنابراین نتایج فعلی به‌تنهایی جایگاه رقابتی Jalapeño هنگام استقرار گسترده در سال ۲۰۲۷ را مشخص نمی‌کنند.

اوپن‌ای‌آی و برادکام چگونه Jalapeño را توسعه دادند؟

اوپن‌ای‌آی نخستین‌بار در اکتبر پروژه Jalapeño را معرفی کرد. این شرکت برای توسعه سخت‌افزار جدید خود همکاری نزدیکی با برادکام (Broadcom) داشته و حتی از مدل‌های هوش مصنوعی خود در فرایند توسعه استفاده کرده است.

برنامه اوپن‌ای‌آی تنها به ساخت یک نسل از سخت‌افزار محدود نمی‌شود. این شرکت قصد دارد Jalapeño را به یک پلتفرم چندنسلی تبدیل کند و محصولات هوش مصنوعی، مدل‌ها، تراشه‌ها و حافظه را به‌صورت هماهنگ توسعه دهد. این رویکرد به اوپن‌ای‌آی امکان می‌دهد سخت‌افزار را مطابق نیاز مدل‌ها و سرویس‌های خود طراحی کند، به‌جای اینکه صرفاً نرم‌افزار را با محدودیت‌های یک شتاب‌دهنده عمومی تطبیق دهد.

تراشه Jalapeño چگونه تأخیر استنتاج هوش مصنوعی را کاهش می‌دهد؟

اوپن‌ای‌آی در طراحی Jalapeño روی بخش‌هایی از فرایند استنتاج هوش مصنوعی (AI Inference) تمرکز کرده است که معمولاً می‌توانند گلوگاه ایجاد کنند. مراحل Prefill و ارتباط میان بخش‌های مختلف سیستم از مهم‌ترین نمونه‌ها هستند.

این شرکت می‌گوید Jalapeño را برای کاهش جابه‌جایی داده و تأخیرهای ارتباطی طراحی کرده است. کاهش این جابه‌جایی می‌تواند به پایین آمدن زمان انتظار و افزایش بهره‌وری سیستم در زمان سرویس‌دهی هم‌زمان به تعداد زیادی کاربر کمک کند.

تراشه Jalapeño شرکت OpenAI

حافظه KV Cache چه نقشی در Jalapeño دارد؟

یکی از بخش‌های مهم این معماری به KV Cache مربوط می‌شود؛ حافظه‌ای که مدل هنگام تولید پاسخ از آن برای نگهداری اطلاعات موردنیاز محاسبات استفاده می‌کند.

طبق توضیح اوپن‌ای‌آی، معماری Jalapeño اجازه می‌دهد وضعیت مدل، ازجمله KV Cache، به‌طور مشخص در محل مناسب قرار گیرد و محلی باقی بماند. سپس سیستم می‌تواند برای هر مرحله از استنتاج، ترکیب مناسب منابع پردازشی، حافظه و شبکه را فعال کند.

هدف از این طراحی کاهش انتقال غیرضروری داده و برطرف کردن گلوگاه‌هایی است که می‌توانند سرعت پاسخ‌دهی مدل‌های هوش مصنوعی را محدود کنند.

جمع‌بندی

نتایج اولیه InferenceX نشان می‌دهند Jalapeño روی دو مسئله کلیدی مراکز داده هوش مصنوعی، یعنی سرعت پاسخ‌دهی و بهره‌وری انرژی، تمرکز دارد. بااین‌حال، مقایسه عملکرد نهایی آن با نسل‌های آینده سخت‌افزار انویدیا و سایر رقبا زمانی معنی‌دارتر خواهد بود که سیستم اوپن‌ای‌آی به مرحله استقرار گسترده برسد.

به‌نظر شما ورود اوپن‌ای‌آی به حوزه تراشه‌های اختصاصی می‌تواند وابستگی این شرکت به پردازنده‌های هوش مصنوعی انویدیا را در سال‌های آینده کاهش دهد؟ دیدگاه خود را در بخش نظرات بنویسید.

اشتراک در
اطلاع از
0 Comments
بازخورد (Feedback) های اینلاین
مشاهده همه دیدگاه ها
رپورتاژ آگهی پربازده
رپورتاژ آگهی پربازده
ساحل عطایی