حساب کاربری ندارید؟ ثبت نام کنید

هوش مصنوعی کیمی K3 معرفی شد؛ مدل متن‌باز ۲.۸ تریلیون پارامتری با پنجره زمینه یک میلیون توکنی

نوشته

4 روز قبل | بدون دیدگاه | هوش مصنوعی

شرکت کیمی از مدل هوش مصنوعی چندوجهی جدید خود با نام Kimi K3 رونمایی کرده است؛ مدلی با مجموع ۲.۸ تریلیون پارامتر که می‌تواند تصاویر و ویدئوها را به‌صورت بومی پردازش کند و از پنجره زمینه‌ای تا یک میلیون توکن پشتیبانی می‌کند. Kimi این محصول را نخستین مدل باز در محدوده تقریبی ۳ تریلیون پارامتر معرفی کرده و قصد دارد وزن‌های کامل آن را تا ۵ مرداد ۱۴۰۵ (۲۷ ژوئیه ۲۰۲۶) منتشر کند. این مدل برای پروژه‌های طولانی برنامه‌نویسی، کارهای دانشی و استدلال‌های پیچیده طراحی شده است.

خلاصه خبر در یک نگاه

🔷 هوش مصنوعی کیمی K3 با ۲.۸ تریلیون پارامتر و پنجره زمینه یک میلیون توکنی معرفی شد.

🔷 این مدل تصاویر و ویدئوها را به‌صورت بومی پردازش می‌کند.

🔷 وزن‌های کامل مدل قرار است تا ۵ مرداد ۱۴۰۵ منتشر شوند.

🔷 مدل K3 در برخی بنچمارک‌ها با مدل‌های اختصاصی پیشرو رقابت می‌کند.

🔷 آزمایش مستقل Artificial Analysis عملکرد قوی، اما نرخ توهم ۵۱ درصدی را گزارش کرده است.

🔷 مدل K3 هم‌اکنون از طریق وب، اپلیکیشن‌ها، Kimi Code و API در دسترس است.

مشخصات اصلی مدل هوش مصنوعی کیمی K3

بر اساس اطلاعات رسمی، Kimi K3 یک مدل چندوجهی با معماری بسیار بزرگ است که برای پردازش وظایف طولانی و پیچیده توسعه یافته است.

ویژگی مشخصات Kimi K3
تعداد کل پارامترها ۲.۸ تریلیون
پنجره زمینه یک میلیون توکن
ورودی‌های پشتیبانی‌شده متن، تصویر و ویدئو
معماری Mixture of Experts
کاربرد اصلی برنامه‌نویسی طولانی‌مدت، کار دانشی و استدلال پیچیده
انتشار وزن‌های مدل تا ۲۷ ژوئیه ۲۰۲۶

عملکرد Kimi K3 در بنچمارک‌های رسمی

طبق بنچمارک‌های منتشرشده از سوی Kimi، مدل K3 همچنان از دو مدل اختصاصی Claude Fable 5 و GPT 5.6 Sol عقب‌تر است، اما توانسته از سایر مدل‌های آزمایش‌شده، از جمله برخی نسخه‌های Claude Opus و رقیب چینی GLM-5.2 عملکرد بهتری ثبت کند.

این شرکت اعلام کرده نتایج با حداکثر یا سطح بالای شدت استدلال به دست آمده‌اند. K3 در دو مورد از شش بنچمارک برنامه‌نویسی رتبه نخست را کسب کرده و در سایر آزمایش‌ها در جایگاه دوم یا سوم قرار گرفته است.

در آزمون‌های عامل‌های عمومی نیز K3 در سه مورد از شش آزمایش برنده شده، در حالی که Fable 5 در هر دو آزمون عامل‌های بصری رتبه نخست را به دست آورده است.

در مجموع ۳۵ آزمون، K3 حدود هفت بار در رتبه اول قرار گرفته و در بیشتر آزمایش‌های دیگر جایگاه دوم یا سوم را ثبت کرده است. با این حال، باید توجه داشت که برای اجرای این بنچمارک‌ها از سه سیستم عامل مختلف شامل KimiCode ،Claude Code و Codex استفاده شده و همه نتایج تحت شرایط کاملاً یکسان جمع‌آوری نشده‌اند.

مدل هوش مصنوعی کیمی K3

مدل هوش مصنوعی کیمی K3

مدل هوش مصنوعی کیمی K3

آزمایش مستقل Artificial Analysis چه می‌گوید؟

آزمایشگاه مستقل Artificial Analysis نیز ارزیابی اولیه خود از Kimi K3 را منتشر کرده است. این مدل در شاخص Artificial Analysis Intelligence Index امتیاز ۵۷ را کسب کرده و در سطحی نزدیک به Opus 4.8 و GPT-5.5 قرار گرفته است.

با این حال، K3 همچنان پشت سر Claude Fable 5 و GPT-5.6 Sol قرار دارد.

مدل امتیاز Intelligence Index
Claude Fable 5 ۶۰
GPT-5.6 Sol ۵۹
Kimi K3 ۵۷
Claude Opus 4.8 ۵۶
آزمایش مستقل Artificial Analysis

آزمایش مستقل Artificial Analysis

پیشرفت بزرگ در وظایف عامل‌محور

کیمی K3 در ارزیابی GDPval v2 به امتیاز Elo برابر با ۱۶۶۸ رسیده که نسبت به امتیاز ۱۱۹۰ مدل K2.6 جهش قابل‌توجهی محسوب می‌شود.

در این آزمون، K3 از مدل‌های زیر جلو افتاده است:

  • GLM-5.2 با امتیاز ۱۵۱۴
  • GPT-5.5 با امتیاز ۱۴۹۴
  • Claude Opus 4.8 با امتیاز ۱۶۰۰

با این حال، Claude Fable 5 با امتیاز ۱۷۶۰ همچنان عملکرد بهتری داشته است.

مدل K3 همچنین در آزمون AutomationBench-AA با امتیاز ۵۳ درصد رتبه نخست را به دست آورده است. این ارزیابی بر اجرای گردش‌کارهای خودکار در سرویس‌های نرم‌افزاری تمرکز دارد.

عملکرد در کارهای دانشی طولانی‌مدت

در آزمون خصوصی AA-Briefcase که برای ارزیابی کارهای دانشی طولانی‌مدت طراحی شده، K3 به امتیاز Elo برابر با ۱۵۴۷ رسیده است؛ رقمی که ۷۳۲ امتیاز بیشتر از K2.6 محسوب می‌شود.

تنها Claude Fable 5 در این آزمون امتیاز بالاتری کسب کرده است. Artificial Analysis مدل K3 را محصولی متعادل توصیف کرده که کیفیت تحلیل و امتیازدهی آن به Fable 5 نزدیک است، هرچند GPT-5.6 Sol همچنان در کیفیت ارائه خروجی برتری دارد.

دقت بیشتر، اما نرخ توهم بالاتر

یکی از نکات مهم ارزیابی مستقل، افزایش هم‌زمان دقت و نرخ توهم K3 است.

  • دقت پاسخ‌ها از ۳۳ درصد در K2.6 به ۴۶ درصد در K3 رسیده است.
  • امتیاز AA-Omniscience از مثبت ۶ به مثبت ۱۸ افزایش یافته است.
  • نرخ توهم از ۳۹ درصد به ۵۱ درصد رسیده است.

این نتایج نشان می‌دهد K3 پاسخ‌های صحیح بیشتری تولید می‌کند، اما در مواردی که پاسخ را نمی‌داند نیز بیشتر از گذشته اطلاعات ساختگی ارائه می‌دهد.

کیمی K3 برای پروژه‌های کامل نرم‌افزاری طراحی شده است

به گفته Kimi، کاربرد اصلی K3 انجام پروژه‌های توسعه نرم‌افزار طولانی‌مدت با حداقل نظارت انسانی است. این مدل می‌تواند کدبیس‌های بزرگ را تحلیل کند، ابزارهای ترمینال را هماهنگ کند و در طول مراحل متعدد یک پروژه تمرکز خود را حفظ کند.

مدل K3 همچنین از روشی با نام Vision in the Loop استفاده می‌کند. در این رویکرد، مدل تصویر خروجی را بررسی می‌کند، کد را تغییر می‌دهد و سپس نتیجه بصری را دوباره ارزیابی می‌کند.

کیمی این قابلیت را مناسب حوزه‌های زیر می‌داند:

  • توسعه بازی
  • طراحی رابط کاربری
  • طراحی به کمک رایانه (CAD)
  • توسعه برنامه‌های تعاملی و بصری

نمونه پروژه‌های ساخته‌شده با K3

کیمی برای نمایش توانایی‌های K3 چند نمونه پروژه را ارائه کرده است؛ از جمله یک بازی سه‌بعدی جهان‌باز که در مرورگر و با استفاده از Three.js، WebGPU و GPU Compute ساخته شده است.

بر اساس توضیحات شرکت، محیط بازی به‌صورت رویه‌ای توسط K3 تولید شده و مدل سه‌بعدی اسب و سوارکار با استفاده از یک ابزار خارجی ساخته شده است.

دیگر نمونه‌ها عبارت‌اند از:

  • شبیه‌سازی تعاملی سیاه‌چاله
  • شبیه‌سازی پرتاب و بازگشت موشک Long March 10
  • شبیه‌ساز کنسول Game Boy Advance

معماری Mixture of Experts با ۸۹۶ متخصص

کیمی K3 از معماری Mixture of Experts استفاده می‌کند و در هر مرحله تنها ۱۶ متخصص از مجموع ۸۹۶ متخصص را فعال می‌کند.

این مدل همچنین به معماری توجه جدیدی با نام Kimi Delta Attention مجهز شده است. به گفته Kimi، این فناوری در زمینه‌های یک میلیون توکنی می‌تواند سرعت رمزگشایی را تا ۶.۳ برابر افزایش دهد.

قابلیت دیگری با نام Attention Residuals نیز طبق ادعای شرکت، بهره‌وری آموزش را حدود ۲۵ درصد افزایش می‌دهد، در حالی که کمتر از ۲ درصد سربار محاسباتی ایجاد می‌کند.

قیمت API مدل Kimi K3

بر اساس مستندات رسمی API، هزینه استفاده از Kimi K3 به شرح زیر است:

مدل ورودی با Cache Hit ورودی بدون Cache Hit خروجی
Kimi K3 ۰.۳۰ دلار ۳ دلار ۱۵ دلار
Kimi K2.6 ۰.۱۶ دلار ۰.۹۵ دلار ۴ دلار
Claude Sonnet 5 ۰.۳۰ دلار ۳ دلار ۱۵ دلار
Claude Fable 5 ۱ دلار ۱۰ دلار ۵۰ دلار
GPT-5.6 Sol ۰.۵۰ دلار ۵ دلار ۳۰ دلار

تمام قیمت‌ها برای یک میلیون توکن محاسبه شده‌اند. هزینه خروجی شامل توکن‌های استدلال نیز می‌شود و قیمت‌ها به طول زمینه وابسته نیستند.

کش‌کردن به‌صورت خودکار انجام می‌شود؛ موضوعی که استفاده از پیشوندهای ثابت و طولانی را برای عامل‌های هوش مصنوعی و کدبیس‌های بزرگ مقرون‌به‌صرفه‌تر می‌کند.

هزینه واقعی هر وظیفه

طبق ارزیابی Artificial Analysis، میانگین هزینه K3 برای هر وظیفه در Intelligence Index برابر با ۰.۹۴ دلار است.

  • Kimi K3: حدود ۰.۹۴ دلار
  • GPT-5.6 Sol: حدود ۱.۰۴ دلار
  • Claude Opus 4.8: حدود ۱.۸۰ دلار
  • GLM-5.2: حدود ۰.۳۲ دلار
  • DeepSeek V4 Pro: حدود ۰.۰۴ دلار

در نتیجه، K3 از برخی مدل‌های اختصاصی ارزان‌تر است، اما در مقایسه با مدل‌های متن‌باز چینی مانند GLM-5.2 و DeepSeek V4 Pro هزینه بالاتری دارد.

مصرف توکن کمتر نسبت به K2.6

مدل K3 برای تکمیل مجموعه ۹ ارزیابی حدود ۱۳۲ میلیون توکن خروجی مصرف کرده است، در حالی که K2.6 برای همان آزمون‌ها به حدود ۱۶۶ میلیون توکن نیاز داشت.

این کاهش حدود ۲۱ درصدی مصرف توکن در حالی ثبت شده که K3 امتیازی ۱۳ واحد بالاتر از مدل قبلی خود کسب کرده است. با وجود این، به دلیل قیمت بالاتر هر توکن، هزینه نهایی بیشتر وظایف احتمالاً همچنان از K2.6 بیشتر خواهد بود.

دسترسی به Kimi K3

کیمی K3 هم‌اکنون از طریق سرویس‌ها و پلتفرم‌های زیر در دسترس است:

  • وب‌سایت Kimi.com
  • اپلیکیشن iOS
  • اپلیکیشن Android
  • اپلیکیشن HarmonyOS
  • نسخه دسکتاپ Kimi Work از نسخه 3.1.0 به بعد
  • Kimi Code
  • OpenRouter با شناسه moonshotai/kimi-k3

در OpenRouter، این مدل در حال حاضر تنها از طریق زیرساخت خود Moonshot ارائه می‌شود. وزن‌های باز مدل نیز قرار است تا پایان ژوئیه منتشر شوند.

نسخه سازمانی و Hosted Agent

کیمی برای شرکت‌ها نسخه‌ای جداگانه ارائه می‌دهد که شامل مدیریت اعضا و امکان تفکیک حساب‌های شخصی و سازمانی است.

این شرکت همچنین در حال توسعه پلتفرمی با نام Kimi Hosted Agent است که محیط‌ها و زمان‌اجرای ایزوله برای وظایف طولانی‌مدت فراهم خواهد کرد. کاربران علاقه‌مند می‌توانند در فهرست انتظار این سرویس ثبت‌نام کنند.

مدل هوش مصنوعی کیمی K3

مدل هوش مصنوعی کیمی K3

جمع‌بندی

کیمی K3 یکی از بزرگ‌ترین مدل‌های هوش مصنوعی باز معرفی‌شده تاکنون است و با ۲.۸ تریلیون پارامتر، پنجره زمینه یک میلیون توکنی و قابلیت پردازش بومی تصویر و ویدئو، مستقیماً بازار مدل‌های پیشرفته را هدف قرار داده است. نتایج اولیه نشان می‌دهد K3 در برنامه‌نویسی، عامل‌های هوش مصنوعی و کارهای دانشی طولانی‌مدت عملکرد رقابتی دارد و در برخی آزمون‌ها به مدل‌های اختصاصی برتر نزدیک می‌شود. با این حال، افزایش نرخ توهم به ۵۱ درصد، تفاوت شرایط اجرای بنچمارک‌ها و هزینه بالاتر نسبت به برخی مدل‌های باز، نکاتی هستند که باید در ارزیابی نهایی آن مورد توجه قرار گیرند.

نظر شما چیست؟ آیا مدل‌های متن‌باز بزرگی مانند Kimi K3 می‌توانند فاصله خود را با مدل‌های اختصاصی پیشرو کاملاً از بین ببرند؟

اشتراک در
اطلاع از
0 Comments
بازخورد (Feedback) های اینلاین
مشاهده همه دیدگاه ها
رپورتاژ آگهی پربازده
رپورتاژ آگهی پربازده
امیرحسین ملکی