🔷 مدل جدید Imagine Image 2.0 شرکت xAI برای تولید و ویرایش تصاویر مبتنیبر هوش مصنوعی است.
🔷 این مدل در رتبهبندی Arena کمی پایینتر از GPT Images 2.0 قرار دارد.
🔷 ابزارهایی مانند Magic Wand، حذف پسزمینه و ویرایش چندمرجعی به آن اضافه شدهاند.
🔷 امکان ترکیب حداکثر پنج تصویر ورودی در قابلیت Multi-Ref Editing وجود دارد.
🔷 شرکت xAI قالبهای آمادهای برای ویرایش عکس، عکاسی محصول، بازاریابی و طراحی ارائه کرده است.
به گفته xAI، مدل Imagine Image 2.0 برای اجرای دقیقتر دستورهای کاربر، حفظ تمیزی تایپوگرافی و چیدمان در تصاویر پیچیده و همچنین ایجاد ثبات بصری در چندین نسل از تصاویر طراحی شده است.
این مدل اکنون در grok.com/imagine و اپلیکیشن Grok برای گوشیهای iOS و Android در دسترس است. دسترسی API به Imagine Image 2.0 نیز طبق اعلام xAI در آینده نزدیک ارائه خواهد شد.
بر اساس رتبهبندی Arena در ۷ اوت ۲۰۲۶ (۱۶ مرداد ۱۴۰۵)، نسخه سریعتر این مدل با نام Low در هر دو دسته اصلی، رتبه دوم جهانی را بهدست آورده است.
در هر دو آزمون، GPT-Image-2 از مدل جدید xAI امتیاز بالاتری کسب کرده است. مدلهایی مانند Reve 2.1 ،Muse-Image متا، Qwen-Image-3.0-Pro علیبابا، Gemini گوگل و SeedDream بایتدنس نیز در رتبههای پایینتر قرار گرفتهاند.
مدل Imagine Image 2.0 همچنین در این آزمونها فاصله قابلتوجهی با نسخه Quality مدل قبلی خود ایجاد کرده است.
شرکت xAI چند ابزار ویرایش را برای استفاده در فرایندهای چندمرحلهای به Imagine Image 2.0 اضافه کرده است.
شرکت xAI همچنین مجموعهای از قالبهای از پیش تنظیمشده را معرفی کرده است که فرایندهای رایج تولید و ویرایش تصویر را در قالب نقاط شروع آماده در اختیار کاربر قرار میدهند.
این قالبها حوزههایی مانند موارد زیر را پوشش میدهند:
شرکت xAI قابلیت دیگری را نیز نمایش داده است که میتواند شخصیتها، مکانها و اشیا را بهصورت جداگانه تولید کند و در عین حال سبک بصری را در تمام تصاویر ثابت نگه دارد.
این شرکت قابلیت مذکور را گامی در مسیر ایجاد فرایندهای کاملتر برای پیشتولید ویدیو میداند؛ مسیری که میتواند امکان ساخت اجزای مختلف یک پروژه ویدیویی با سبک بصری یکسان را فراهم کند.
هوش مصنوعی Imagine Image 2.0 جدیدترین مدل تصویری xAI است که علاوه بر تولید تصویر، مجموعهای از ابزارهای ویرایش و قالبهای آماده را ارائه میدهد. این مدل در رتبهبندی Arena فعلاً پشت سر GPT-Image-2 قرار دارد، اما قابلیتهایی مانند ویرایش چندمرجعی، تغییر هوشمند نسبت تصویر و حفظ ثبات بصری میتوانند آن را برای فرایندهای پیچیدهتر تولید محتوا کاربردیتر کنند.
نظر شما درباره Imagine Image 2.0 چیست؟ آیا ابزارهای جدید xAI میتوانند این مدل را به رقیبی جدی برای GPT-Image-2 تبدیل کنند؟