حساب کاربری ندارید؟ ثبت نام کنید

هوش مصنوعی Grok 4.7 رسماً معرفی شد؛ مدل ۲.۱ تریلیون پارامتری با تمرکز بر کدنویسی

نوشته

2 ساعت قبل | بدون دیدگاه | هوش مصنوعی

هوش مصنوعی Grok 4.7 پس از چند بار تأخیر در برنامه زمانی، رسماً توسط xAI عرضه شد. این نسخه با معماری بزرگ‌تر، تمرکز بیشتر بر برنامه‌نویسی پیچیده، فعالیت‌های حرفه‌ای و استدلال چندساعته توسعه یافته است. xAI همچنین قیمت استاندارد توکن‌ها را نسبت به Grok 4.6 تغییر نداده و دسترسی به این مدل را بدون فهرست انتظار در اختیار کاربران و توسعه‌دهندگان قرار داده است.

خلاصه خبر در یک نگاه

🔷 هوش مصنوعی Grok 4.7 با مدل پایه ۲.۱ تریلیون پارامتری عرضه شد.

🔷 این مدل برای کدنویسی پیچیده و فعالیت‌های حرفه‌ای چندساعته بهینه شده است.

🔷 قیمت استاندارد ورودی و خروجی توکن‌ها مشابه Grok 4.6 باقی مانده است.

🔷 داده‌های مهندسی داخلی اسپیس‌ایکس نیز در فرایند آموزش مدل استفاده شده‌اند.

🔷 گراک ۴.۷ در Cursor، Grok Build، API شرکت xAI و اپلیکیشن Grok در دسترس است.

هوش مصنوعی Grok 4.7 با ۲.۱ تریلیون پارامتر

در قلب Grok 4.7 یک مدل پایه جدید با ۲.۱ تریلیون پارامتر قرار دارد. این رقم نسبت به مدل قبلی با ۱.۵ تریلیون پارامتر، حدود ۴۰ درصد افزایش یافته است.

کمپانی xAI برای آموزش مدل جدید از یک فرایند یادگیری تقویتی طولانی‌تر استفاده کرده و مجموعه‌ای دشوارتر از مسائل چندساعته را در فرایند آموزش آن قرار داده است. هدف این تغییر، افزایش توانایی مدل در حل مسائل پیچیده و طولانی‌مدت عنوان شده است.

برای تقویت توانایی Grok 4.7 در حل مسائل مرتبط با سخت‌افزار و سیستم‌های فیزیکی، xAI بخشی از داده‌های آموزشی را نیز با سوابق مهندسی داخلی اسپیس‌ایکس (SpaceX) تکمیل کرده است. این داده‌ها شامل تله‌متری ماهواره‌های استارلینک (Starlink)، گزارش‌های تولید و اطلاعات مربوط به تحلیل خرابی‌ها می‌شوند.

عملکرد Grok 4.7 در بنچمارک‌های برنامه‌نویسی و تخصصی

افزایش مقیاس مدل و یکپارچه‌سازی بومی با ابزارهای ارزیابی در نتایج بنچمارک‌های فنی نیز دیده می‌شود. در آزمون DeepSWE v1.1 و در حالت تلاش بالا، Grok 4.7 به امتیاز ۷۱ درصد رسید؛ در حالی که Grok 4.6 امتیاز ۶۵.۲ درصد را ثبت کرده بود.

در آزمون برنامه‌نویسی CursorBench 4.0، مدل جدید به دقت ۴۶.۳ درصد دست یافت. این رقم از امتیاز ۴۱.۷ درصدی GPT-5.6 Sol Max بیشتر است، اما پایین‌تر از امتیاز ۵۱.۸ درصدی Claude Fable 5.1 قرار می‌گیرد.

گراک ۴.۷ در Terminal-Bench 4.0 نیز امتیاز ۳۸ درصد را ثبت کرده است. در حوزه‌های تخصصی، این مدل در آزمون مهندسی برق EEBench به امتیاز ۶۴ درصد رسید و در Harvey Legal Agent Benchmark نیز امتیاز آن به ۱۹.۶ درصد افزایش یافت.

گراک ۴.۷ در فعالیت‌های حرفه‌ای چندساعته

در آزمون‌های مربوط به عامل‌های هوش مصنوعی سازمانی که توسط Artificial Analysis مدیریت می‌شوند، Grok 4.7 در آزمون AA-Briefcase امتیاز ۱۶۵۷ الو (Elo) را به دست آورد. این نتیجه نسبت به Grok 4.6، ۱۱۱ امتیاز افزایش نشان می‌دهد.

این مدل در آزمون GDPval نیز به امتیاز ۱۶۹۵ الو رسید. Grok 4.7 در هر دو جدول امتیازات پایین‌تر از Claude Fable 5.1 قرار دارد، اما افزایش امتیاز آن نشان‌دهنده کاهش فاصله میان دو مدل در گردش‌کارهای حرفه‌ای چندساعته است.

ایلان ماسک اعلام کرده است که نسخه‌های آینده شامل Grok 4.8، Grok 4.9 و Grok 5 با هدف دستیابی به جایگاه پیشرو در سطح مدل‌های پیشرفته توسعه پیدا خواهند کرد.

سیستم ایمنی Grok 4.7 بازطراحی شده است

ایکس‌ای‌آی هم‌زمان با عرضه Grok 4.7، سیستم حفاظتی این مدل را نیز به‌طور کامل بازطراحی کرده است. شرکت یک ساختار ایمنی جدید معرفی کرده که در بنچمارک ایمنی زیستی LatchBio به امتیاز ۶۲.۴ درصد دست یافته است.

در آزمون داخلی HackerBench v0.3 که برای بررسی ریسک‌های سایبری طراحی شده، این مدل توانسته است تقریباً تمام درخواست‌های خطرناک دومنظوره را مسدود کند و تنها ۳.۳ درصد از آن‌ها را مسدود نکرده است؛ در حالی که درخواست‌های مشروع مربوط به تحقیقات امنیتی نیز به‌عنوان تهدید شناسایی نشده‌اند.

کمپانی xAI همچنین اعلام کرده است که تعدادی از شرکای منتخب حوزه امنیت سایبری، به ابزارهای ردتیمینگ این شرکت دسترسی دعوتی خواهند داشت تا از آن‌ها برای تحقیقات دفاعی استفاده کنند.

قیمت و دسترسی به هوش مصنوعی Grok 4.7

کمپانی xAI قیمت استاندارد استفاده از Grok 4.7 را مشابه Grok 4.6 تعیین کرده است:

  • توکن ورودی: ۲ دلار به ازای هر یک میلیون توکن
  • توکن خروجی: ۶ دلار به ازای هر یک میلیون توکن

یک نسخه پرسرعت نیز ارائه شده که سرعت تولید خروجی را دو برابر می‌کند، اما هزینه توکن در آن نیز دو برابر نسخه استاندارد است.

 

گراک ۴.۷ بدون نیاز به فهرست انتظار در سرویس‌هایی مانند Cursor، Grok Build، روترهای مدل شخص ثالث و API شرکت xAI در دسترس قرار گرفته است. این مدل همچنین به‌صورت بومی در اپلیکیشن Grok، شبکه اجتماعی X و دستیارهای صوتی داشبورد خودروهای تسلا ارائه می‌شود.

نظر شما چیست؟

هوش مصنوعی Grok 4.7 با مدل پایه ۲.۱ تریلیون پارامتری، فرایند آموزش طولانی‌تر و تمرکز بر استدلال چندساعته وارد بازار شده است. xAI همچنین برای بهبود عملکرد در مسائل مهندسی، از داده‌های داخلی اسپیس‌ایکس استفاده کرده و سیستم ایمنی مدل را بازطراحی کرده است.

🔴 همچنین بخوانید: ادعای بزرگ ایلان ماسک: تولید اولین فیلم بلند سینمایی «اودیسه» توسط هوش مصنوعی Grok

نظر شما درباره Grok 4.7 و استفاده از داده‌های مهندسی اسپیس‌ایکس در آموزش آن چیست؟

اشتراک در
اطلاع از
0 Comments
بازخورد (Feedback) های اینلاین
مشاهده همه دیدگاه ها
مطالب اخیر
سهیل سلیمانی