شرکت OpenAI جزئیات بیشتری از تراشه Jalapeño و نخستین نتایج بنچمارک این سیستم را در کنفرانس Hot Chips منتشر کرده است. نتایج آزمایش InferenceX متعلق به SemiAnalysis نشان میدهند Jalapeño در دو معیار تعداد توکن بیشتر بهازای هر کاربر و توان عملیاتی بیشتر بهازای هر کیلووات، عملکردی بالاتر از پردازندههای پیشرو استنتاج هوش مصنوعی موجود در بازار ارائه میدهد.
🔷 تراشه Jalapeño اوپنایآی برای استنتاج سریع و مقیاسپذیر هوش مصنوعی طراحی شده است.
🔷 نتایج InferenceX از تعداد توکن بیشتر بهازای هر کاربر و توان عملیاتی بالاتر بهازای هر کیلووات حکایت دارند.
🔷 مقایسه ارائهشده شامل یک سیستم مبتنیبر Nvidia Blackwell نیز میشود.
🔷 اوپنایآی Jalapeño را با همکاری نزدیک برادکام توسعه داده است.
🔷 عرضه بسیار محدود این سیستم برای اواخر ۲۰۲۶ و استقرار گستردهتر آن برای سال ۲۰۲۷ برنامهریزی شده است.
اوپنایآی روز سهشنبه در کنفرانس Hot Chips نخستین مجموعه از نتایج بنچمارک Jalapeño را ارائه کرد. این شرکت سیستم جدید خود را با بنچمارک InferenceX از SemiAnalysis آزمایش کرده است.
طبق نتایج ارائهشده، Jalapeño هم ازنظر تعداد توکن پردازششده برای هر کاربر و هم در زمینه توان عملیاتی بهازای هر کیلووات، از پردازندههای پیشرو استنتاج که درحالحاضر در دسترس هستند، عملکرد بهتری ثبت کرده است.
ریچارد هو، مدیر بخش سختافزار اوپنایآی، میگوید نتایج از پیشرفتی قابلتوجه نسبتبه فناوریهای فعلی حکایت دارند. بهگفته او، Jalapeño میتواند با مصرف مقدار مشخصی انرژی، حجم بیشتری از پردازشهای هوش مصنوعی را انجام دهد و درعینحال پاسخها را سریعتر به کاربران برگرداند.
یکی از نکات قابلتوجه، حضور یک سیستم Nvidia Blackwell در این مقایسه است. نتایج ارائهشده نشان میدهند Jalapeño در معیارهای مورد آزمایش عملکرد بهتری داشته است؛ بااینحال، این مقایسه به سختافزارهای موجود در زمان اجرای بنچمارک مربوط میشود.

تراشه Jalapeño شرکت OpenAI
تراشه Jalapeño قرار نیست بلافاصله در مقیاس گسترده مستقر شود. ریچارد هو تخمین میزند اوپنایآی در پایان سال ۲۰۲۶ تنها حجم بسیار محدودی از این سیستم را مستقر کند و عرضه در مقیاس قابلتوجهتر در سال ۲۰۲۷ انجام شود.
تا آن زمان، انویدیا و سایر شرکتهای فعال در بازار شتابدهندههای هوش مصنوعی فرصت خواهند داشت نسلهای جدیدتری از محصولات خود را عرضه کنند. بنابراین نتایج فعلی بهتنهایی جایگاه رقابتی Jalapeño هنگام استقرار گسترده در سال ۲۰۲۷ را مشخص نمیکنند.
اوپنایآی نخستینبار در اکتبر پروژه Jalapeño را معرفی کرد. این شرکت برای توسعه سختافزار جدید خود همکاری نزدیکی با برادکام (Broadcom) داشته و حتی از مدلهای هوش مصنوعی خود در فرایند توسعه استفاده کرده است.
برنامه اوپنایآی تنها به ساخت یک نسل از سختافزار محدود نمیشود. این شرکت قصد دارد Jalapeño را به یک پلتفرم چندنسلی تبدیل کند و محصولات هوش مصنوعی، مدلها، تراشهها و حافظه را بهصورت هماهنگ توسعه دهد. این رویکرد به اوپنایآی امکان میدهد سختافزار را مطابق نیاز مدلها و سرویسهای خود طراحی کند، بهجای اینکه صرفاً نرمافزار را با محدودیتهای یک شتابدهنده عمومی تطبیق دهد.
اوپنایآی در طراحی Jalapeño روی بخشهایی از فرایند استنتاج هوش مصنوعی (AI Inference) تمرکز کرده است که معمولاً میتوانند گلوگاه ایجاد کنند. مراحل Prefill و ارتباط میان بخشهای مختلف سیستم از مهمترین نمونهها هستند.
این شرکت میگوید Jalapeño را برای کاهش جابهجایی داده و تأخیرهای ارتباطی طراحی کرده است. کاهش این جابهجایی میتواند به پایین آمدن زمان انتظار و افزایش بهرهوری سیستم در زمان سرویسدهی همزمان به تعداد زیادی کاربر کمک کند.

یکی از بخشهای مهم این معماری به KV Cache مربوط میشود؛ حافظهای که مدل هنگام تولید پاسخ از آن برای نگهداری اطلاعات موردنیاز محاسبات استفاده میکند.
طبق توضیح اوپنایآی، معماری Jalapeño اجازه میدهد وضعیت مدل، ازجمله KV Cache، بهطور مشخص در محل مناسب قرار گیرد و محلی باقی بماند. سپس سیستم میتواند برای هر مرحله از استنتاج، ترکیب مناسب منابع پردازشی، حافظه و شبکه را فعال کند.
هدف از این طراحی کاهش انتقال غیرضروری داده و برطرف کردن گلوگاههایی است که میتوانند سرعت پاسخدهی مدلهای هوش مصنوعی را محدود کنند.
نتایج اولیه InferenceX نشان میدهند Jalapeño روی دو مسئله کلیدی مراکز داده هوش مصنوعی، یعنی سرعت پاسخدهی و بهرهوری انرژی، تمرکز دارد. بااینحال، مقایسه عملکرد نهایی آن با نسلهای آینده سختافزار انویدیا و سایر رقبا زمانی معنیدارتر خواهد بود که سیستم اوپنایآی به مرحله استقرار گسترده برسد.
بهنظر شما ورود اوپنایآی به حوزه تراشههای اختصاصی میتواند وابستگی این شرکت به پردازندههای هوش مصنوعی انویدیا را در سالهای آینده کاهش دهد؟ دیدگاه خود را در بخش نظرات بنویسید.