آنتروپیک از مدل Claude Opus 5.5 بهعنوان نخستین عضو خانواده جدید مدلهای هوش مصنوعی خود رونمایی کرد. این شرکت میگوید مدل جدید در اکثر وظایف عملکردی در سطح Claude Fable 5.1 ارائه میدهد، اما در مقایسه با Opus 5 هزینه عملیاتی بسیار کمتری دارد و خروجی را با سرعت بالاتری تولید میکند. براساس بنچمارکهای منتشرشده توسط آنتروپیک، Opus 5.5 در بسیاری از آزمونها بالاتر از Fable 5.1 و GPT-6 Astra قرار گرفته است. مدلهای Claude Sonnet 5.5 و Haiku 5.5 نیز قرار است طی هفتههای آینده با بهبودهایی مشابه در عملکرد، بهرهوری و ایمنی عرضه شوند.
🔹 مدل Claude Opus 5.5 نخستین عضو خانواده جدید مدلهای آنتروپیک است و در اکثر وظایف عملکردی همسطح Fable 5.1 دارد.
🔹 هزینه کلی اجرای مدل طبق اعلام آنتروپیک حدود ۴۰ درصد کمتر از Opus 5 است و سرعت تولید خروجی بیش از ۳۰ درصد افزایش یافته است.
🔹 قیمت هر یک میلیون توکن ورودی و خروجی بهترتیب ۴ و ۲۰ دلار تعیین شده که ۲۰ درصد کمتر از نسل قبل است.
🔹 آنتروپیک روی بهبود کیفیت نگارش، کاهش پیچیدگی پاسخها و افزایش تدابیر ایمنی در حوزههای حساس تمرکز کرده است.
🔹 مدل Claude Opus 5.5 هماکنون روی پلتفرمهای مختلف از جمله AWS ،Google Cloud و Microsoft Azure در دسترس است.
آنتروپیک میگوید Claude Opus 5.5 در «اکثر وظایف» به سطح عملکرد Fable 5.1 رسیده و در عین حال هزینه اجرای آن نسبت به Opus 5 حدود ۴۰ درصد کاهش یافته است.
نتایج منتشرشده از سوی این شرکت نشان میدهند Opus 5.5 در آزمون Terminal-Bench 4.0 برای کدنویسی عاملمحور امتیاز ۶۶٫۴ درصد را کسب کرده است. امتیاز Fable 5.1 در همین آزمون ۵۵٫۸ درصد، Opus 5 برابر با ۵۲٫۳ درصد، GPT-6 Astra برابر با ۵۷٫۹ درصد و GPT-5.6 Sol برابر با ۳۷٫۳ درصد اعلام شده است.
بااینحال، Opus 5.5 در تمام آزمونها بالاترین امتیاز را ندارد. برای مثال GPT-6 Astra در AutomationBench امتیاز ۴۱٫۴ درصد را در برابر ۴۰ درصد Opus 5.5 کسب کرده و در Terminal-Bench-Science نیز با امتیاز ۶۴٫۶ درصد بالاتر از نتیجه ۵۸٫۷ درصدی مدل آنتروپیک قرار گرفته است.
یکی از تغییرات اصلی نسل جدید به هزینه استفاده مربوط میشود. قیمت Claude Opus 5.5 برای هر یک میلیون توکن ورودی ۴ دلار و برای هر یک میلیون توکن خروجی ۲۰ دلار تعیین شده است.
در مقایسه، Opus 5 برای همین میزان توکن ورودی و خروجی بهترتیب ۵ و ۲۵ دلار هزینه داشت. بنابراین قیمت مستقیم توکنها در نسل جدید ۲۰ درصد کاهش یافته است.
هزینه خواندن کش نیز با کاهش ۶۰ درصدی از ۰٫۵۰ دلار به ۰٫۲۰ دلار رسیده است. آنتروپیک میگوید با در نظر گرفتن قیمت و تعداد توکنهای مصرفی، هزینه عملیاتی کلی حدود ۴۰ درصد کمتر از Opus 5 خواهد بود.
مدل جدید توکنهای کمتری مصرف میکند و سرعت تولید خروجی آن نیز بیش از ۳۰ درصد افزایش یافته است.
محدودیت استفاده پنجساعته مشترکان ۲۰ درصد افزایش خواهد یافت. آنتروپیک میگوید با در نظر گرفتن هزینه پایینتر مدل، این محدودیتها در مجموع امکان استفاده ۲۵ درصد بیشتری را فراهم میکنند.
کاربران همچنین میتوانند یک بار بازنشانی محدودیت را ذخیره کنند تا در زمان موردنیاز از آن استفاده شود.
آنتروپیک برای نمایش نسبت قیمت به عملکرد Opus 5.5 به بنچمارکهای کدنویسی استناد کرده است. طبق ادعای این شرکت، مدل جدید در FrontierCode با حدود ۲۰ درصد هزینه هر وظیفه GPT-6 Astra عملکرد بالاتری ارائه میدهد.
آنتروپیک همچنین میگوید Opus 5.5 در Terminal-Bench 4.0 میتواند با ۴۰ درصد هزینه، عملکردی مشابه Astra داشته باشد. در CursorBench نیز این شرکت از برتری ۱۱ امتیازی نسبت به GPT-5.6 Sol با حدود یکسوم هزینه سخن گفته است.
کاهش قیمت Opus 5.5 در شرایطی صورت گرفته که رقابت قیمتی میان شرکتهای فعال در حوزه هوش مصنوعی افزایش یافته و مدلهای چینی نیز با هزینههای پایینتر وارد بازار شدهاند.
آنتروپیک علاوه بر عملکرد و هزینه، روی نحوه ارتباط مدل با کاربران نیز تمرکز کرده است. این شرکت میگوید Opus 5.5 اطلاعات مهمتر را زودتر ارائه میدهد، اصطلاحات تخصصی غیرضروری کمتری به کار میبرد و دستورالعملهای مربوط به سبک نگارش را دقیقتر دنبال میکند.
آزمایشکنندگان اولیه، نوشتههای این مدل را شفافتر و قابلفهمتر توصیف کردهاند. این تغییرات پاسخی به انتقادهایی است که درباره سبک فرمولی و پیچیده برخی مدلهای فعلی Claude مطرح شده و گاهی از آن با عنوان «Claudish» یاد میشود.
مدل Opus 5.5 نخستین عضو خانواده Opus است که تدابیر ایمنی آن در حوزههای امنیت سایبری، زیستشناسی و توسعه مدلهای زبانی پیشرفته با Fable 5.1 همسطح شده است.
آنتروپیک میگوید زمانی که این تدابیر فعال شوند، درخواست کاربر بهصورت شفاف به مدل دیگری هدایت خواهد شد.
کاربران همچنان میتوانند از مدل برای پیدا کردن و برطرف کردن باگهای کد استفاده کنند، اما بیشتر وظایف مرتبط با امنیت سایبری به Opus 4.8 منتقل میشوند. درخواستهایی که توسط طبقهبندیکنندهها در حوزه زیستشناسی یا توسعه مدلهای زبانی پیشرفته شناسایی شوند نیز به Opus 5 هدایت خواهند شد.
سازمانهای تأییدشده میتوانند از طریق برنامه Life Sciences Verification Program برای استفاده از مدل در تحقیقات زیستی درخواست دهند. آنتروپیک همچنین قصد دارد طی هفتههای آینده Cyber Verification Program را به Opus 5.5 گسترش دهد.
آنتروپیک قصد دارد محیطهای مورد استفاده برای یادگیری تقویتی را با سختگیری بیشتری بررسی کند. این شرکت محیطهای آموزشی معیوب را یکی از منابع مهم رفتارهای ناهمراستا در مدلها میداند.
این شرکت همچنین روی بهبود پاداشهای همراستاسازی، روشهای خودکار ایجاد سناریوهای آموزشی ایمنی و سازوکارهای قویتر برای ایمنی و نظارت کار میکند.
آنتروپیک خواستار استانداردهای ایمنی بالاتری برای مدلهایی شده است که ممکن است توانایی خودکارسازی کامل تحقیقات هوش مصنوعی را داشته باشند و معتقد است سیاستگذاری عمومی باید نقش بیشتری در تعیین این استانداردها ایفا کند.
دو سازمان Frontier Design و METR نیز پیش از انتشار، Opus 5.5 را آزمایش کردهاند.
آنتروپیک همزمان تدابیر جدیدی برای مقابله با آنچه حملات Distillation مینامد، معرفی کرده است. به گفته شرکت، مهاجمان میتوانند با استفاده از هزاران حساب جعلی، قابلیتهای یک مدل را در مقیاس صنعتی استخراج کرده و مدلهای قدرتمندی بدون تدابیر ایمنی آن ایجاد کنند.
آنتروپیک در این زمینه به گزارش تهدید سپتامبر ۲۰۲۶ اشاره کرده که فعالیتهای غیرقانونی Distillation شناسایی و متوقفشده توسط این شرکت را مستند میکند.
مدل Opus 5.5 با قابلیت Preserved Thinking عرضه شده است؛ سازوکاری ضد Distillation که نخستین بار همراه Fable 5.1 معرفی شد و از ویرایش زمینه قبلی Claude توسط کاربران API برای استخراج فرایند استدلال جلوگیری میکند.
این محدودیت برای حسابهای API ساختهشده از ۳۱ اوت ۲۰۲۶ (۹ شهریور ۱۴۰۵) به بعد، روی Fable 5.1 و Opus 5.5 اعمال میشود.
مدل Claude Opus 5.5 از سازوکارهای واترمارک برای انطباق با قانون هوش مصنوعی اتحادیه اروپا بهره میبرد.
امکان اجرای مدل با غیرفعال کردن حالت «Thinking» نیز دیگر وجود ندارد. در عین حال، Opus 5.5 با قابلیت Zero Data Retention در دسترس قرار گرفته است.
مدل Claude Opus 5.5 هماکنون روی تمام پلتفرمهای پشتیبانیشده از جمله Amazon Web Services ،Google Cloud و Microsoft Azure در دسترس است.
توسعهدهندگانی که از Claude Platform استفاده میکنند، میتوانند با شناسه مدل claude-opus-5-5 به نسخه جدید دسترسی داشته باشند.
آنتروپیک همچنین اعلام کرده است که مدلهای Claude Sonnet 5.5 و Claude Haiku 5.5 طی هفتههای آینده عرضه خواهند شد و قرار است بهبودهای مشابهی در عملکرد، بهرهوری و ایمنی ارائه دهند.
برای شما در انتخاب یک مدل هوش مصنوعی پیشرفته، کاهش هزینه و افزایش سرعت اهمیت بیشتری دارد یا عملکرد بهتر در کدنویسی و وظایف عاملمحور؟