حساب کاربری ندارید؟ ثبت نام کنید

آنتروپیک مدل Claude Haiku 5.5 را معرفی کرد؛ جهش عملکرد با کاهش چشمگیر هزینه استفاده

نوشته

4 ساعت قبل | بدون دیدگاه | هوش مصنوعی

شرکت آنتروپیک از Claude Haiku 5.5 به‌عنوان سریع‌ترین و مقرون‌به‌صرفه‌ترین مدل کوچک خود رونمایی کرده است. این مدل علاوه بر کاهش قابل توجه قیمت نسبت به Haiku 4.5، در بنچمارک‌های دانش، استدلال، کار با کامپیوتر و کدنویسی عامل‌محور پیشرفت بزرگی نشان می‌دهد. هم‌زمان، هزینه استفاده از کش در Sonnet 5.5 نیز کاهش یافته است.

خلاصه خبر در یک نگاه

🔹 مدل Claude Haiku 5.5 به‌طور متوسط حدود ۷۵ درصد ارزان‌تر از Haiku 4.5 است.
🔹 برای پرامپت‌های حداکثر ۱۰۰ هزار توکن، قیمت در برخی بخش‌ها تا ۹۰ درصد کاهش یافته است.
🔹 امتیاز OSWorld 2.1 از ۱۵.۷ درصد در Haiku 4.5 به ۷۲.۴ درصد در مدل جدید رسیده است.
🔹 برای نخستین‌بار در خانواده Haiku امکان تنظیم سطح استدلال و ایجاد تعادل میان هزینه و عملکرد وجود دارد.
🔹 شرکت Anthropic هزینه خواندن کش Sonnet 5.5 را نیز ۵۰ درصد کاهش داده و اعتبار ماهانه API ارائه می‌کند.

مدل Claude Haiku 5.5 برای چه کاربردهایی ساخته شده است؟

شرکت آنتروپیک مدل Haiku 5.5 را برای وظایفی طراحی کرده که حجم درخواست بالا، سرعت زیاد و هزینه پایین در آن‌ها اهمیت دارد. خلاصه‌سازی، اجرای کوئری‌های پایگاه داده، طبقه‌بندی اطلاعات و پشتیبانی زنده مشتریان از نمونه کاربردهای این مدل هستند.

طبق اعلام آنتروپیک، هزینه استفاده از Haiku 5.5 به‌طور متوسط حدود ۷۵ درصد کمتر از Haiku 4.5 است.

کاهش هزینه برای درخواست‌هایی با پرامپت حداکثر ۱۰۰ هزار توکن بیشتر است. آنتروپیک می‌گوید تقریباً ۹۰ درصد درخواست‌های قبلی Haiku در این محدوده قرار داشته‌اند و قیمت در چنین درخواست‌هایی می‌تواند تا ۹۰ درصد کمتر شود.

در مقابل، برای پرامپت‌های طولانی‌تر از ۱۰۰ هزار توکن، تعرفه Haiku 5.5 به پنج برابر قیمت حالت عادی افزایش پیدا می‌کند.

مدل Claude Haiku 5.5

مدل Claude Haiku 5.5

تغییر Tokenizer می‌تواند بخشی از کاهش هزینه را خنثی کند

با وجود کاهش چشمگیر تعرفه هر توکن، آنتروپیک به نکته مهمی درباره هزینه واقعی استفاده از مدل اشاره کرده است. Haiku 5.5 از Tokenizer به‌روزشده‌ای استفاده می‌کند که برای انجام یک وظیفه مشخص، اندکی توکن بیشتری نسبت به نسل قبل مصرف می‌کند.

تغییر مشابهی پیش‌تر در مدل‌های سری Opus 4.x دیده شده بود که تنها به‌دلیل تغییر Tokenizer، مصرف توکن آن‌ها حدود ۳۰ درصد افزایش پیدا کرد.

بنابراین صرفه‌جویی واقعی در هزینه استفاده از Haiku 5.5 احتمالاً کمتر از چیزی خواهد بود که مقایسه مستقیم قیمت هر توکن نشان می‌دهد.

جهش عملکرد Claude Haiku 5.5 در بنچمارک‌ها

نتایج ارائه‌شده توسط آنتروپیک نشان می‌دهند مدل جدید نسبت به Haiku 4.5 در چندین حوزه پیشرفت قابل توجهی داشته است.

در بنچمارک دانش GDPval-AA v2.1، امتیاز Haiku 5.5 به ۱۶۲۰ رسیده است؛ بیش از دو برابر امتیاز ۷۳۵ مدل Haiku 4.5.

در آزمون Humanity’s Last Exam نیز مدل جدید بدون استفاده از ابزارها امتیاز ۴۵.۹ درصد و با ابزارها امتیاز ۵۷.۴ درصد را ثبت کرده است. مدل قبلی در همین دو حالت به‌ترتیب تنها ۱۰.۲ و ۱۸.۷ درصد امتیاز داشت.

بزرگ‌ترین پیشرفت Haiku 5.5 در کنترل کامپیوتر

یکی از برجسته‌ترین پیشرفت‌های نسل جدید در قابلیت Computer Use دیده می‌شود؛ قابلیتی که مدل از طریق آن می‌تواند به‌صورت مستقل با کامپیوتر کار کند.

مدل Haiku 5.5 در زیرمجموعه آفلاین بنچمارک OSWorld 2.1 امتیاز ۷۲.۴ درصد را کسب کرده است، در حالی که Haiku 4.5 تنها ۱۵.۷ درصد امتیاز داشت.

این پیشرفت در کنار قیمت پایین و سرعت بالای مدل اهمیت ویژه‌ای دارد، زیرا وظایف مبتنی بر کنترل کامپیوتر معمولاً حجم زیادی از توکن‌ها را مصرف می‌کنند.

مدل Claude Haiku 5.5

مدل Claude Haiku 5.5

پیشرفت قابل توجه در کدنویسی عامل‌محور

در آزمون کدنویسی عامل‌محور Terminal-Bench 4.0 نیز Haiku 5.5 امتیاز ۳۹.۲ درصد را ثبت کرده است؛ در حالی که امتیاز Haiku 4.5 در این آزمون صفر بود.

مدل جدید در FrontierCode 1.1 نیز امتیاز ۴۶.۴ درصد و در بنچمارک استدلال بصری Chartography بدون ابزار امتیاز ۴۶.۴ درصد را به دست آورده است.

مدل Haiku 5.5 در تمام آزمون‌های مقایسه‌شده از GPT-6 Luna جلوتر است

شرکت آنتروپیک در نتایج خود مدل اقتصادی GPT-6 Luna را نیز برای مقایسه قرار داده است. براساس ارقام ارائه‌شده، Haiku 5.5 در تمام دسته‌هایی که برای هر دو مدل نتیجه منتشر شده، امتیاز بالاتری کسب کرده است.

با این حال، مقایسه با Sonnet 5.5 نشان می‌دهد مدل کوچک جدید Anthropic همچنان در بیشتر این آزمون‌ها فاصله محسوسی با مدل بزرگ‌تر این شرکت دارد.

تنظیم سطح استدلال برای نخستین‌بار در یک مدل Haiku

مدل Haiku 5.5 نخستین عضو خانواده Haiku است که از سطوح قابل تنظیم استدلال پشتیبانی می‌کند. کاربران می‌توانند با تغییر میزان استدلال، میان کیفیت خروجی و هزینه پردازش تعادل ایجاد کنند.

به گفته آنتروپیک، این مدل برای وظایف با محدوده مشخص مانند فشرده‌سازی محتوا، خلاصه‌سازی و فعالیت به‌عنوان زیرعامل مناسب‌تر است.

برای وظایف پیچیده کدنویسی عامل‌محور، Anthropic همچنان استفاده از Sonnet 5.5 و Opus 5.5 را گزینه مناسب‌تری می‌داند.

تغییر محدودیت‌های امنیت سایبری در Haiku 5.5

محافظت‌های امنیت سایبری Haiku 5.5 نسبت به نسل قبلی سخت‌گیرانه‌تر شده‌اند، اما این مدل در مقایسه با Sonnet 5.5 دامنه گسترده‌تری از فعالیت‌های دفاعی امنیت سایبری را مجاز می‌داند؛ موضوعی که بخشی از آن به توانایی کلی پایین‌تر مدل مربوط می‌شود.

با این حال، تست نفوذ همچنان مسدود است. سازمان‌هایی که به دسترسی گسترده‌تری نیاز دارند می‌توانند برای برنامه‌های تأیید Anthropic در حوزه علوم زیستی و امنیت سایبری درخواست دهند.

عرضه Claude Haiku 5.5 روی پلتفرم‌های ابری مختلف

مدل Haiku 5.5 از هم‌اکنون روی تمام پلتفرم‌های اعلام‌شده Anthropic در دسترس است و امکان استفاده از آن از طریق Amazon Web Services، Google Cloud و Microsoft Azure نیز وجود دارد.

قیمت مدل Claude Haiku 5.5

قیمت مدل Claude Haiku 5.5

کاهش قیمت Sonnet 5.5 هم‌زمان با معرفی مدل جدید

شرکت آنتروپیک در کنار معرفی Haiku 5.5، هزینه خواندن کش Sonnet 5.5 را ۵۰ درصد کاهش داده است. قیمت این بخش از ۰.۲۰ دلار به ۰.۱۰ دلار به‌ازای هر یک میلیون توکن رسیده است.

Anthropic می‌گوید این تغییر باید هزینه بیشتر وظایف عامل‌محور را حدود ۲۰ درصد کاهش دهد.

اعتبار ماهانه API برای مشترکان Anthropic

شرکت آنتروپیک همچنین ارائه اعتبار ماهانه API را آغاز کرده است تا کاربران بتوانند ابزارها، برنامه‌ها و عامل‌های مبتنی بر API را آزمایش کنند.

نوع اشتراک اعتبار ماهانه API
Max-5x ۱۰۰ دلار
Max-20x ۲۰۰ دلار
Team تا ۵۰۰ دلار در ماه

قابلیت Computer Use به SDKهای Anthropic می‌آید

در کنار تغییرات مدل‌ها و قیمت‌گذاری، آنتروپیک در حال به‌روزرسانی SDKهای Python و TypeScript خود نیز هست.

این به‌روزرسانی پشتیبانی آزمایشی از قابلیت‌های Computer Use و Browser Use را اضافه می‌کند و به توسعه‌دهندگان اجازه می‌دهد قابلیت تعامل مدل با کامپیوتر و مرورگر را در برنامه‌ها و عامل‌های خود به کار بگیرند.

جمع‌بندی

Claude Haiku 5.5 با تمرکز بر سرعت، هزینه پایین و وظایف پرتعداد عرضه شده و طبق نتایج منتشرشده توسط آنتروپیک، نسبت به Haiku 4.5 در حوزه‌هایی مانند دانش، استدلال، کنترل کامپیوتر و کدنویسی عامل‌محور پیشرفت قابل توجهی دارد. کاهش قیمت تا ۹۰ درصد برای درخواست‌های کوتاه‌تر، امکان تنظیم سطح استدلال و بهبود چشمگیر Computer Use از مهم‌ترین تغییرات این نسل هستند. در همین حال، Sonnet 5.5 همچنان در وظایف پیچیده‌تر عملکرد بالاتری ارائه می‌دهد و هزینه خواندن کش آن نیز کاهش یافته است.

به نظر شما کاهش شدید قیمت و جهش عملکرد Haiku 5.5 می‌تواند مدل‌های کوچک و سریع را به گزینه اصلی برای عامل‌های هوش مصنوعی و وظایف روزمره تبدیل کند؟

اشتراک در
اطلاع از
0 Comments
بازخورد (Feedback) های اینلاین
مشاهده همه دیدگاه ها
مطالب اخیر
امیرحسین ملکی