شرکت آنتروپیک از Claude Haiku 5.5 بهعنوان سریعترین و مقرونبهصرفهترین مدل کوچک خود رونمایی کرده است. این مدل علاوه بر کاهش قابل توجه قیمت نسبت به Haiku 4.5، در بنچمارکهای دانش، استدلال، کار با کامپیوتر و کدنویسی عاملمحور پیشرفت بزرگی نشان میدهد. همزمان، هزینه استفاده از کش در Sonnet 5.5 نیز کاهش یافته است.
🔹 مدل Claude Haiku 5.5 بهطور متوسط حدود ۷۵ درصد ارزانتر از Haiku 4.5 است.
🔹 برای پرامپتهای حداکثر ۱۰۰ هزار توکن، قیمت در برخی بخشها تا ۹۰ درصد کاهش یافته است.
🔹 امتیاز OSWorld 2.1 از ۱۵.۷ درصد در Haiku 4.5 به ۷۲.۴ درصد در مدل جدید رسیده است.
🔹 برای نخستینبار در خانواده Haiku امکان تنظیم سطح استدلال و ایجاد تعادل میان هزینه و عملکرد وجود دارد.
🔹 شرکت Anthropic هزینه خواندن کش Sonnet 5.5 را نیز ۵۰ درصد کاهش داده و اعتبار ماهانه API ارائه میکند.
شرکت آنتروپیک مدل Haiku 5.5 را برای وظایفی طراحی کرده که حجم درخواست بالا، سرعت زیاد و هزینه پایین در آنها اهمیت دارد. خلاصهسازی، اجرای کوئریهای پایگاه داده، طبقهبندی اطلاعات و پشتیبانی زنده مشتریان از نمونه کاربردهای این مدل هستند.
طبق اعلام آنتروپیک، هزینه استفاده از Haiku 5.5 بهطور متوسط حدود ۷۵ درصد کمتر از Haiku 4.5 است.
کاهش هزینه برای درخواستهایی با پرامپت حداکثر ۱۰۰ هزار توکن بیشتر است. آنتروپیک میگوید تقریباً ۹۰ درصد درخواستهای قبلی Haiku در این محدوده قرار داشتهاند و قیمت در چنین درخواستهایی میتواند تا ۹۰ درصد کمتر شود.
در مقابل، برای پرامپتهای طولانیتر از ۱۰۰ هزار توکن، تعرفه Haiku 5.5 به پنج برابر قیمت حالت عادی افزایش پیدا میکند.
با وجود کاهش چشمگیر تعرفه هر توکن، آنتروپیک به نکته مهمی درباره هزینه واقعی استفاده از مدل اشاره کرده است. Haiku 5.5 از Tokenizer بهروزشدهای استفاده میکند که برای انجام یک وظیفه مشخص، اندکی توکن بیشتری نسبت به نسل قبل مصرف میکند.
تغییر مشابهی پیشتر در مدلهای سری Opus 4.x دیده شده بود که تنها بهدلیل تغییر Tokenizer، مصرف توکن آنها حدود ۳۰ درصد افزایش پیدا کرد.
بنابراین صرفهجویی واقعی در هزینه استفاده از Haiku 5.5 احتمالاً کمتر از چیزی خواهد بود که مقایسه مستقیم قیمت هر توکن نشان میدهد.
نتایج ارائهشده توسط آنتروپیک نشان میدهند مدل جدید نسبت به Haiku 4.5 در چندین حوزه پیشرفت قابل توجهی داشته است.
در بنچمارک دانش GDPval-AA v2.1، امتیاز Haiku 5.5 به ۱۶۲۰ رسیده است؛ بیش از دو برابر امتیاز ۷۳۵ مدل Haiku 4.5.
در آزمون Humanity’s Last Exam نیز مدل جدید بدون استفاده از ابزارها امتیاز ۴۵.۹ درصد و با ابزارها امتیاز ۵۷.۴ درصد را ثبت کرده است. مدل قبلی در همین دو حالت بهترتیب تنها ۱۰.۲ و ۱۸.۷ درصد امتیاز داشت.
یکی از برجستهترین پیشرفتهای نسل جدید در قابلیت Computer Use دیده میشود؛ قابلیتی که مدل از طریق آن میتواند بهصورت مستقل با کامپیوتر کار کند.
مدل Haiku 5.5 در زیرمجموعه آفلاین بنچمارک OSWorld 2.1 امتیاز ۷۲.۴ درصد را کسب کرده است، در حالی که Haiku 4.5 تنها ۱۵.۷ درصد امتیاز داشت.
این پیشرفت در کنار قیمت پایین و سرعت بالای مدل اهمیت ویژهای دارد، زیرا وظایف مبتنی بر کنترل کامپیوتر معمولاً حجم زیادی از توکنها را مصرف میکنند.
در آزمون کدنویسی عاملمحور Terminal-Bench 4.0 نیز Haiku 5.5 امتیاز ۳۹.۲ درصد را ثبت کرده است؛ در حالی که امتیاز Haiku 4.5 در این آزمون صفر بود.
مدل جدید در FrontierCode 1.1 نیز امتیاز ۴۶.۴ درصد و در بنچمارک استدلال بصری Chartography بدون ابزار امتیاز ۴۶.۴ درصد را به دست آورده است.
شرکت آنتروپیک در نتایج خود مدل اقتصادی GPT-6 Luna را نیز برای مقایسه قرار داده است. براساس ارقام ارائهشده، Haiku 5.5 در تمام دستههایی که برای هر دو مدل نتیجه منتشر شده، امتیاز بالاتری کسب کرده است.
با این حال، مقایسه با Sonnet 5.5 نشان میدهد مدل کوچک جدید Anthropic همچنان در بیشتر این آزمونها فاصله محسوسی با مدل بزرگتر این شرکت دارد.
مدل Haiku 5.5 نخستین عضو خانواده Haiku است که از سطوح قابل تنظیم استدلال پشتیبانی میکند. کاربران میتوانند با تغییر میزان استدلال، میان کیفیت خروجی و هزینه پردازش تعادل ایجاد کنند.
به گفته آنتروپیک، این مدل برای وظایف با محدوده مشخص مانند فشردهسازی محتوا، خلاصهسازی و فعالیت بهعنوان زیرعامل مناسبتر است.
برای وظایف پیچیده کدنویسی عاملمحور، Anthropic همچنان استفاده از Sonnet 5.5 و Opus 5.5 را گزینه مناسبتری میداند.
محافظتهای امنیت سایبری Haiku 5.5 نسبت به نسل قبلی سختگیرانهتر شدهاند، اما این مدل در مقایسه با Sonnet 5.5 دامنه گستردهتری از فعالیتهای دفاعی امنیت سایبری را مجاز میداند؛ موضوعی که بخشی از آن به توانایی کلی پایینتر مدل مربوط میشود.
با این حال، تست نفوذ همچنان مسدود است. سازمانهایی که به دسترسی گستردهتری نیاز دارند میتوانند برای برنامههای تأیید Anthropic در حوزه علوم زیستی و امنیت سایبری درخواست دهند.
مدل Haiku 5.5 از هماکنون روی تمام پلتفرمهای اعلامشده Anthropic در دسترس است و امکان استفاده از آن از طریق Amazon Web Services، Google Cloud و Microsoft Azure نیز وجود دارد.
شرکت آنتروپیک در کنار معرفی Haiku 5.5، هزینه خواندن کش Sonnet 5.5 را ۵۰ درصد کاهش داده است. قیمت این بخش از ۰.۲۰ دلار به ۰.۱۰ دلار بهازای هر یک میلیون توکن رسیده است.
Anthropic میگوید این تغییر باید هزینه بیشتر وظایف عاملمحور را حدود ۲۰ درصد کاهش دهد.
شرکت آنتروپیک همچنین ارائه اعتبار ماهانه API را آغاز کرده است تا کاربران بتوانند ابزارها، برنامهها و عاملهای مبتنی بر API را آزمایش کنند.
| نوع اشتراک | اعتبار ماهانه API |
|---|---|
| Max-5x | ۱۰۰ دلار |
| Max-20x | ۲۰۰ دلار |
| Team | تا ۵۰۰ دلار در ماه |
در کنار تغییرات مدلها و قیمتگذاری، آنتروپیک در حال بهروزرسانی SDKهای Python و TypeScript خود نیز هست.
این بهروزرسانی پشتیبانی آزمایشی از قابلیتهای Computer Use و Browser Use را اضافه میکند و به توسعهدهندگان اجازه میدهد قابلیت تعامل مدل با کامپیوتر و مرورگر را در برنامهها و عاملهای خود به کار بگیرند.
Claude Haiku 5.5 با تمرکز بر سرعت، هزینه پایین و وظایف پرتعداد عرضه شده و طبق نتایج منتشرشده توسط آنتروپیک، نسبت به Haiku 4.5 در حوزههایی مانند دانش، استدلال، کنترل کامپیوتر و کدنویسی عاملمحور پیشرفت قابل توجهی دارد. کاهش قیمت تا ۹۰ درصد برای درخواستهای کوتاهتر، امکان تنظیم سطح استدلال و بهبود چشمگیر Computer Use از مهمترین تغییرات این نسل هستند. در همین حال، Sonnet 5.5 همچنان در وظایف پیچیدهتر عملکرد بالاتری ارائه میدهد و هزینه خواندن کش آن نیز کاهش یافته است.
به نظر شما کاهش شدید قیمت و جهش عملکرد Haiku 5.5 میتواند مدلهای کوچک و سریع را به گزینه اصلی برای عاملهای هوش مصنوعی و وظایف روزمره تبدیل کند؟