حساب کاربری ندارید؟ ثبت نام کنید

مدل هوش مصنوعی Claude Opus 5.5 آنتروپیک با عملکرد هم‌تراز با Fable 5.1 اما هزینه کمتر معرفی شد

نوشته

2 ساعت قبل | بدون دیدگاه | هوش مصنوعی

آنتروپیک از مدل Claude Opus 5.5 به‌عنوان نخستین عضو خانواده جدید مدل‌های هوش مصنوعی خود رونمایی کرد. این شرکت می‌گوید مدل جدید در اکثر وظایف عملکردی در سطح Claude Fable 5.1 ارائه می‌دهد، اما در مقایسه با Opus 5 هزینه عملیاتی بسیار کمتری دارد و خروجی را با سرعت بالاتری تولید می‌کند. براساس بنچمارک‌های منتشرشده توسط آنتروپیک، Opus 5.5 در بسیاری از آزمون‌ها بالاتر از Fable 5.1 و GPT-6 Astra قرار گرفته است. مدل‌های Claude Sonnet 5.5 و Haiku 5.5 نیز قرار است طی هفته‌های آینده با بهبودهایی مشابه در عملکرد، بهره‌وری و ایمنی عرضه شوند.

خلاصه خبر در یک نگاه

🔹 مدل Claude Opus 5.5 نخستین عضو خانواده جدید مدل‌های آنتروپیک است و در اکثر وظایف عملکردی هم‌سطح Fable 5.1 دارد.
🔹 هزینه کلی اجرای مدل طبق اعلام آنتروپیک حدود ۴۰ درصد کمتر از Opus 5 است و سرعت تولید خروجی بیش از ۳۰ درصد افزایش یافته است.
🔹 قیمت هر یک میلیون توکن ورودی و خروجی به‌ترتیب ۴ و ۲۰ دلار تعیین شده که ۲۰ درصد کمتر از نسل قبل است.
🔹 آنتروپیک روی بهبود کیفیت نگارش، کاهش پیچیدگی پاسخ‌ها و افزایش تدابیر ایمنی در حوزه‌های حساس تمرکز کرده است.
🔹 مدل Claude Opus 5.5 هم‌اکنون روی پلتفرم‌های مختلف از جمله AWS ،Google Cloud و Microsoft Azure در دسترس است.

عملکرد مدل هوش مصنوعی Claude Opus 5.5 در بنچمارک‌ها

آنتروپیک می‌گوید Claude Opus 5.5 در «اکثر وظایف» به سطح عملکرد Fable 5.1 رسیده و در عین حال هزینه اجرای آن نسبت به Opus 5 حدود ۴۰ درصد کاهش یافته است.

نتایج منتشرشده از سوی این شرکت نشان می‌دهند Opus 5.5 در آزمون Terminal-Bench 4.0 برای کدنویسی عامل‌محور امتیاز ۶۶٫۴ درصد را کسب کرده است. امتیاز Fable 5.1 در همین آزمون ۵۵٫۸ درصد، Opus 5 برابر با ۵۲٫۳ درصد، GPT-6 Astra برابر با ۵۷٫۹ درصد و GPT-5.6 Sol برابر با ۳۷٫۳ درصد اعلام شده است.

بااین‌حال، Opus 5.5 در تمام آزمون‌ها بالاترین امتیاز را ندارد. برای مثال GPT-6 Astra در AutomationBench امتیاز ۴۱٫۴ درصد را در برابر ۴۰ درصد Opus 5.5 کسب کرده و در Terminal-Bench-Science نیز با امتیاز ۶۴٫۶ درصد بالاتر از نتیجه ۵۸٫۷ درصدی مدل آنتروپیک قرار گرفته است.

مدل هوش مصنوعی Claude Opus 5.5

مدل هوش مصنوعی Claude Opus 5.5

کاهش قیمت و مصرف توکن Claude Opus 5.5

یکی از تغییرات اصلی نسل جدید به هزینه استفاده مربوط می‌شود. قیمت Claude Opus 5.5 برای هر یک میلیون توکن ورودی ۴ دلار و برای هر یک میلیون توکن خروجی ۲۰ دلار تعیین شده است.

در مقایسه، Opus 5 برای همین میزان توکن ورودی و خروجی به‌ترتیب ۵ و ۲۵ دلار هزینه داشت. بنابراین قیمت مستقیم توکن‌ها در نسل جدید ۲۰ درصد کاهش یافته است.

هزینه خواندن کش نیز با کاهش ۶۰ درصدی از ۰٫۵۰ دلار به ۰٫۲۰ دلار رسیده است. آنتروپیک می‌گوید با در نظر گرفتن قیمت و تعداد توکن‌های مصرفی، هزینه عملیاتی کلی حدود ۴۰ درصد کمتر از Opus 5 خواهد بود.

مدل جدید توکن‌های کمتری مصرف می‌کند و سرعت تولید خروجی آن نیز بیش از ۳۰ درصد افزایش یافته است.

افزایش محدودیت استفاده برای مشترکان Claude

محدودیت استفاده پنج‌ساعته مشترکان ۲۰ درصد افزایش خواهد یافت. آنتروپیک می‌گوید با در نظر گرفتن هزینه پایین‌تر مدل، این محدودیت‌ها در مجموع امکان استفاده ۲۵ درصد بیشتری را فراهم می‌کنند.

کاربران همچنین می‌توانند یک بار بازنشانی محدودیت را ذخیره کنند تا در زمان موردنیاز از آن استفاده شود.

ادعای آنتروپیک درباره نسبت قیمت به عملکرد در کدنویسی

آنتروپیک برای نمایش نسبت قیمت به عملکرد Opus 5.5 به بنچمارک‌های کدنویسی استناد کرده است. طبق ادعای این شرکت، مدل جدید در FrontierCode با حدود ۲۰ درصد هزینه هر وظیفه GPT-6 Astra عملکرد بالاتری ارائه می‌دهد.

آنتروپیک همچنین می‌گوید Opus 5.5 در Terminal-Bench 4.0 می‌تواند با ۴۰ درصد هزینه، عملکردی مشابه Astra داشته باشد. در CursorBench نیز این شرکت از برتری ۱۱ امتیازی نسبت به GPT-5.6 Sol با حدود یک‌سوم هزینه سخن گفته است.

کاهش قیمت Opus 5.5 در شرایطی صورت گرفته که رقابت قیمتی میان شرکت‌های فعال در حوزه هوش مصنوعی افزایش یافته و مدل‌های چینی نیز با هزینه‌های پایین‌تر وارد بازار شده‌اند.

بنچمارک مدل هوش مصنوعی Claude Opus 5.5

بنچمارک مدل هوش مصنوعی Claude Opus 5.5

پاسخ‌های طبیعی‌تر و کاهش سبک نگارشی «Claudish»

آنتروپیک علاوه بر عملکرد و هزینه، روی نحوه ارتباط مدل با کاربران نیز تمرکز کرده است. این شرکت می‌گوید Opus 5.5 اطلاعات مهم‌تر را زودتر ارائه می‌دهد، اصطلاحات تخصصی غیرضروری کمتری به کار می‌برد و دستورالعمل‌های مربوط به سبک نگارش را دقیق‌تر دنبال می‌کند.

آزمایش‌کنندگان اولیه، نوشته‌های این مدل را شفاف‌تر و قابل‌فهم‌تر توصیف کرده‌اند. این تغییرات پاسخی به انتقادهایی است که درباره سبک فرمولی و پیچیده برخی مدل‌های فعلی Claude مطرح شده و گاهی از آن با عنوان «Claudish» یاد می‌شود.

تدابیر ایمنی جدید Claude Opus 5.5

مدل Opus 5.5 نخستین عضو خانواده Opus است که تدابیر ایمنی آن در حوزه‌های امنیت سایبری، زیست‌شناسی و توسعه مدل‌های زبانی پیشرفته با Fable 5.1 هم‌سطح شده است.

آنتروپیک می‌گوید زمانی که این تدابیر فعال شوند، درخواست کاربر به‌صورت شفاف به مدل دیگری هدایت خواهد شد.

کاربران همچنان می‌توانند از مدل برای پیدا کردن و برطرف کردن باگ‌های کد استفاده کنند، اما بیشتر وظایف مرتبط با امنیت سایبری به Opus 4.8 منتقل می‌شوند. درخواست‌هایی که توسط طبقه‌بندی‌کننده‌ها در حوزه زیست‌شناسی یا توسعه مدل‌های زبانی پیشرفته شناسایی شوند نیز به Opus 5 هدایت خواهند شد.

سازمان‌های تأییدشده می‌توانند از طریق برنامه Life Sciences Verification Program برای استفاده از مدل در تحقیقات زیستی درخواست دهند. آنتروپیک همچنین قصد دارد طی هفته‌های آینده Cyber Verification Program را به Opus 5.5 گسترش دهد.

تمرکز بیشتر آنتروپیک بر ایمنی مدل‌های قدرتمند

آنتروپیک قصد دارد محیط‌های مورد استفاده برای یادگیری تقویتی را با سخت‌گیری بیشتری بررسی کند. این شرکت محیط‌های آموزشی معیوب را یکی از منابع مهم رفتارهای ناهم‌راستا در مدل‌ها می‌داند.

این شرکت همچنین روی بهبود پاداش‌های هم‌راستاسازی، روش‌های خودکار ایجاد سناریوهای آموزشی ایمنی و سازوکارهای قوی‌تر برای ایمنی و نظارت کار می‌کند.

آنتروپیک خواستار استانداردهای ایمنی بالاتری برای مدل‌هایی شده است که ممکن است توانایی خودکارسازی کامل تحقیقات هوش مصنوعی را داشته باشند و معتقد است سیاست‌گذاری عمومی باید نقش بیشتری در تعیین این استانداردها ایفا کند.

دو سازمان Frontier Design و METR نیز پیش از انتشار، Opus 5.5 را آزمایش کرده‌اند.

مقابله با استخراج قابلیت‌های Claude از طریق Distillation

آنتروپیک هم‌زمان تدابیر جدیدی برای مقابله با آنچه حملات Distillation می‌نامد، معرفی کرده است. به گفته شرکت، مهاجمان می‌توانند با استفاده از هزاران حساب جعلی، قابلیت‌های یک مدل را در مقیاس صنعتی استخراج کرده و مدل‌های قدرتمندی بدون تدابیر ایمنی آن ایجاد کنند.

آنتروپیک در این زمینه به گزارش تهدید سپتامبر ۲۰۲۶ اشاره کرده که فعالیت‌های غیرقانونی Distillation شناسایی و متوقف‌شده توسط این شرکت را مستند می‌کند.

مدل Opus 5.5 با قابلیت Preserved Thinking عرضه شده است؛ سازوکاری ضد Distillation که نخستین بار همراه Fable 5.1 معرفی شد و از ویرایش زمینه قبلی Claude توسط کاربران API برای استخراج فرایند استدلال جلوگیری می‌کند.

این محدودیت برای حساب‌های API ساخته‌شده از ۳۱ اوت ۲۰۲۶ (۹ شهریور ۱۴۰۵) به بعد، روی Fable 5.1 و Opus 5.5 اعمال می‌شود.

واترمارک برای انطباق با قانون هوش مصنوعی اتحادیه اروپا

مدل Claude Opus 5.5 از سازوکارهای واترمارک برای انطباق با قانون هوش مصنوعی اتحادیه اروپا بهره می‌برد.

امکان اجرای مدل با غیرفعال کردن حالت «Thinking» نیز دیگر وجود ندارد. در عین حال، Opus 5.5 با قابلیت Zero Data Retention در دسترس قرار گرفته است.

دسترسی به Claude Opus 5.5

مدل Claude Opus 5.5 هم‌اکنون روی تمام پلتفرم‌های پشتیبانی‌شده از جمله Amazon Web Services ،Google Cloud و Microsoft Azure در دسترس است.

توسعه‌دهندگانی که از Claude Platform استفاده می‌کنند، می‌توانند با شناسه مدل claude-opus-5-5 به نسخه جدید دسترسی داشته باشند.

آنتروپیک همچنین اعلام کرده است که مدل‌های Claude Sonnet 5.5 و Claude Haiku 5.5 طی هفته‌های آینده عرضه خواهند شد و قرار است بهبودهای مشابهی در عملکرد، بهره‌وری و ایمنی ارائه دهند.

برای شما در انتخاب یک مدل هوش مصنوعی پیشرفته، کاهش هزینه و افزایش سرعت اهمیت بیشتری دارد یا عملکرد بهتر در کدنویسی و وظایف عامل‌محور؟

اشتراک در
اطلاع از
0 Comments
بازخورد (Feedback) های اینلاین
مشاهده همه دیدگاه ها
مطالب اخیر
امیرحسین ملکی