گوگل تنها سه هفته پس از عرضه مدل قبلی، انتشار جمینای 3.8 Flash را آغاز کرد. این سومین بهروزرسانی خانواده Flash در سه ماه اخیر است و بهبود عملکرد در مهندسی نرمافزار، وظایف عاملمحور و استدلال پیچیده چندمرحلهای را هدف قرار میدهد. گوگل همچنین مدل تخصصی Gemini 3.8 Flash Cyber را برای آزمایشهای امنیتی معرفی کرده است.
🔷 جمینای 3.8 Flash تنها سه هفته پس از مدل قبلی گوگل منتشر شده است.
🔷 مدل جدید در برنامهنویسی، وظایف عاملمحور و استدلال چندمرحلهای پیشرفت کرده است.
🔷 امتیاز Gemini 3.8 Flash در آزمون HLE-Verified به ۵۴٫۹ درصد میرسد.
🔷 قیمت اولیه API برابر ۰٫۷۵ دلار برای یک میلیون توکن ورودی و ۳٫۷۵ دلار برای یک میلیون توکن خروجی است.
🔷 گوگل مدل Gemini 3.8 Flash Cyber را نیز برای کشف خودکار آسیبپذیریهای امنیتی معرفی کرده است.
گوگل Gemini 3.8 Flash را مدل همهکاره و هوشمند خانواده Flash توصیف میکند. این نسخه در مقایسه با جمینای 3.7 Flash برای مهندسی نرمافزار، انجام وظایف عاملمحور و حل مسائل پیچیده و چندمرحلهای در حوزههای تخصصی ارتقا یافته است.
نتایج بنچمارکهای منتشرشده نیز از افزایش عملکرد نسبتبه نسل قبلی حکایت دارند. گوگل میگوید مدل جدید در برخی وظایف به سطح عملکرد مدلهای پیشرفتهتر و گرانتر نزدیک میشود.

مقایسه عملکرد و قیمت جمینای 3.8 Flash با مدلهای رقیب
یکی از مهمترین حوزههای پیشرفت Gemini 3.8 Flash مهندسی نرمافزار است. در بنچمارک DeepSWE v1.1 که توانایی مدلها را برای انجام مستقل وظایف طولانی مهندسی نرمافزار ارزیابی میکند، مدل جدید از بسیاری از مدلهای بزرگتر عملکرد بهتری داشته است.
این آزمون حل مستقل مسائل پیچیده مهندسی از ابتدا تا انتها را بررسی میکند. مزیت موردتأکید گوگل، دستیابی به این عملکرد با هزینه پایینتر نسبتبه مدلهای بزرگتر است.

عملکرد و هزینه جمینای 3.8 Flash در بنچمارک مهندسی نرمافزار DeepSWE v1.1
مدل جدید در آزمون HLE-Verified به امتیاز ۵۴٫۹ درصد دست یافته است. این بنچمارک توانایی استدلال چندمرحلهای را در حوزههایی مانند علوم، فناوری، مهندسی، ریاضیات، علوم انسانی و زمینههای حرفهای ارزیابی میکند.
جمینای 3.8 Flash در حوزههای تخصصی دیگری مانند امور مالی و حقوق نیز نسبتبه 3.7 Flash پیشرفت کرده است. عملکرد مدل در بنچمارکهایی مانند Vals Finance Agent V2 و Harvey’s Legal Agent Benchmark افزایش یافته است.

عملکرد جمینای 3.8 Flash در بنچمارک استدلال HLE-Verified
گوگل افزایش عملکرد مدل را به تغییر رویکرد آن هنگام مواجهه با مسائل دشوار نسبت میدهد. Gemini 3.8 Flash برای وظایف پیچیده مراحل استدلال بیشتری اجرا میکند و درصورت نیاز چندین بار به ابزارهای در دسترس مراجعه خواهد کرد.
این رویکرد یک پیامد نیز دارد: مدل ممکن است هنگام اجرای وظایف دشوار و در سطوح بالاتر تلاش، توکن بیشتری مصرف کند. بنابراین افزایش کیفیت پاسخ در برخی کاربردها میتواند با هزینه پردازشی بیشتر همراه باشد.
تاریخ توقف دانش مدل بستهبه حوزه متفاوت است. گوگل برای برخی حوزهها مارس ۲۰۲۶ را اعلام کرده است، درحالیکه دانش مدل در برخی زمینههای دیگر ممکن است تنها تا ژانویه ۲۰۲۵ را پوشش دهد.
این تفاوت بهمعنای آن است که کاربران نباید برای اطلاعات جدید و حساس به زمان صرفاً به دانش داخلی مدل تکیه کنند و در چنین کاربردهایی استفاده از ابزارهای جستوجو یا منابع بهروز اهمیت دارد.
گوگل بار دیگر یک قیمت اولیه برای استفاده توسعهدهندگان از مدل جدید درنظر گرفته است. این قیمت تا ۳۱ دسامبر ۲۰۲۶ (۱۰ دی ۱۴۰۵) اعمال میشود.
| نوع مصرف | قیمت بهازای یک میلیون توکن |
|---|---|
| توکن ورودی | ۰٫۷۵ دلار |
| توکن خروجی | ۳٫۷۵ دلار |
مصرف توکن بیشتر در وظایف پیچیده میتواند روی هزینه نهایی API اثر بگذارد؛ بهخصوص زمانی که مدل در سطح تلاش بالاتر، مراحل استدلال یا فراخوانی ابزار بیشتری انجام دهد.

گوگل جمینای 3.8 Flash
جمینای 3.8 Flash هماکنون در اپلیکیشن Gemini برای مشترکان Google AI Pro و Google AI Ultra در دسترس قرار گرفته است. گوگل مدل جدید را به AI Mode و Gemini در Google Sheets نیز اضافه کرده است.
توسعهدهندگان میتوانند ازطریق Google Antigravity، Google AI Studio و Gemini API به مدل جدید دسترسی داشته باشند.
گوگل همزمان Gemini 3.8 Flash Cyber را نیز معرفی کرده است؛ مدلی تخصصی که روی کشف خودکار آسیبپذیریهای امنیتی تمرکز دارد و جایگزین نسخه 3.5 میشود.
این مدل فعلاً ازطریق برنامه جدید Fairwind Program در اختیار آزمایشکنندگان مورداعتماد قرار میگیرد و برخلاف Gemini 3.8 Flash عمومی، دسترسی گستردهای ندارد.

عملکرد جمینای 3.8 Flash Cyber در کشف آسیبپذیریهای C/C++
تیم امنیت Chrome در آزمایشهای خود دریافت که Gemini 3.8 Flash Cyber در مقایسه با بهترین مدلهای تجاری بزرگتر، ۲٫۶ برابر وصله صحیح بیشتری برای آسیبپذیریهای Chrome تولید کرده است.
شرکت امنیتی Wiz نیز در بنچمارک داخلی تست نفوذ خود، افزایش Recall بین ۷٫۵ تا ۹٫۷ درصد را ثبت کرده است. هزینه استفاده در این آزمایش بین ۲٫۳ تا ۵٫۲ برابر کمتر از دیگر مدلهای پیشرفته مقایسهشده بود.
تیم Cloud Vulnerability Research گوگل نیز با استفاده از این مدل یک آسیبپذیری بنیادی و بحرانی را در کمتر از دو ساعت شناسایی کرده است؛ فرایندی که کشف آن با روشهای پژوهشی معمول میتواند ماهها زمان ببرد.
جمینای 3.8 Flash سومین ارتقای خانواده Flash طی سه ماه است و تمرکز آن بر افزایش عملکرد بدون رفتن بهسمت هزینه مدلهای بزرگتر قرار دارد. مهندسی نرمافزار، استدلال چندمرحلهای و وظایف عاملمحور مهمترین حوزههای پیشرفت این نسخه هستند و مدل Cyber نیز همین خانواده را بهسمت کاربردهای تخصصی امنیت سایبری گسترش میدهد.
بهنظر شما پیشرفت سریع مدلهای Flash مهمتر است یا کاهش مصرف توکن و هزینه اجرای آنها؟ دیدگاهتان را در بخش نظرات بنویسید.