حساب کاربری ندارید؟ ثبت نام کنید

شرکت xAI از مدل هوش مصنوعی Imagine Image 2.0 با ابزارهای ویرایش و قالب‌های آماده رونمایی کرد

نوشته

6 ساعت قبل | بدون دیدگاه | هوش مصنوعی

شرکت xAI به‌تازگی مدل تولید و ویرایش تصویر مبتنی‌بر هوش مصنوعی Imagine Image 2.0 را به‌عنوان حالت جدید «Quality Mode» در وب‌سایت Grok Imagine و اپلیکیشن‌های Grok برای iOS و Android منتشر کرده است. این مدل در بنچمارک‌های Arena کمی پایین‌تر از GPT-Image-2 شرکت OpenAI قرار گرفته و API آن نیز به‌زودی در دسترس قرار می‌گیرد.

خلاصه خبر در یک نگاه

🔷 مدل جدید Imagine Image 2.0 شرکت xAI برای تولید و ویرایش تصاویر مبتنی‌بر هوش مصنوعی است.

🔷 این مدل در رتبه‌بندی Arena کمی پایین‌تر از GPT Images 2.0 قرار دارد.

🔷 ابزارهایی مانند Magic Wand، حذف پس‌زمینه و ویرایش چندمرجعی به آن اضافه شده‌اند.

🔷 امکان ترکیب حداکثر پنج تصویر ورودی در قابلیت Multi-Ref Editing وجود دارد.

🔷 شرکت xAI قالب‌های آماده‌ای برای ویرایش عکس، عکاسی محصول، بازاریابی و طراحی ارائه کرده است.

مدل هوش مصنوعی Imagine Image 2.0 چه قابلیت‌هایی دارد؟

به گفته xAI، مدل Imagine Image 2.0 برای اجرای دقیق‌تر دستورهای کاربر، حفظ تمیزی تایپوگرافی و چیدمان در تصاویر پیچیده و همچنین ایجاد ثبات بصری در چندین نسل از تصاویر طراحی شده است.

این مدل اکنون در grok.com/imagine و اپلیکیشن Grok برای گوشی‌های iOS و Android در دسترس است. دسترسی API به Imagine Image 2.0 نیز طبق اعلام xAI در آینده نزدیک ارائه خواهد شد.

مدل هوش مصنوعی Imagine Image 2.0

مدل هوش مصنوعی Imagine Image 2.0

عملکرد Imagine Image 2.0 در بنچمارک Arena

بر اساس رتبه‌بندی Arena در ۷ اوت ۲۰۲۶ (۱۶ مرداد ۱۴۰۵)، نسخه سریع‌تر این مدل با نام Low در هر دو دسته اصلی، رتبه دوم جهانی را به‌دست آورده است.

در هر دو آزمون، GPT-Image-2 از مدل جدید xAI امتیاز بالاتری کسب کرده است. مدل‌هایی مانند Reve 2.1 ،Muse-Image متا، Qwen-Image-3.0-Pro علی‌بابا، Gemini گوگل و SeedDream بایت‌دنس نیز در رتبه‌های پایین‌تر قرار گرفته‌اند.

مدل Imagine Image 2.0 همچنین در این آزمون‌ها فاصله قابل‌توجهی با نسخه Quality مدل قبلی خود ایجاد کرده است.

عملکرد Imagine Image 2.0 در بنچمارک Arena

عملکرد Imagine Image 2.0 در بنچمارک Arena

ابزارهای ویرایش تصویر در Imagine Image 2.0

شرکت xAI چند ابزار ویرایش را برای استفاده در فرایندهای چندمرحله‌ای به Imagine Image 2.0 اضافه کرده است.

  • Magic Wand: امکان اعمال تغییرات فقط روی بخش انتخاب‌شده تصویر را فراهم می‌کند.
  • Segmentation: به کاربر اجازه می‌دهد نواحی دقیق تصویر را انتخاب کند.
  • Background Removal: پس‌زمینه را حذف کرده و سوژه را با پس‌زمینه شفاف خروجی می‌دهد.
  • Multi-Ref Editing: امکان ترکیب حداکثر پنج تصویر ورودی در یک فرایند تولید را فراهم می‌کند.
  • Smart Resize: تصویر موجود را به نسبت ابعاد دلخواه تبدیل می‌کند و فضای اضافه را به‌صورت خودکار توسط مدل تکمیل می‌کند.

قالب‌های آماده برای تولید تصاویر

شرکت xAI همچنین مجموعه‌ای از قالب‌های از پیش تنظیم‌شده را معرفی کرده است که فرایندهای رایج تولید و ویرایش تصویر را در قالب نقاط شروع آماده در اختیار کاربر قرار می‌دهند.

این قالب‌ها حوزه‌هایی مانند موارد زیر را پوشش می‌دهند:

  • ویرایش عکس
  • عکاسی محصول
  • محتوای بازاریابی
  • ابزارهای طراحی
  • دارایی‌های گرافیکی بازی‌ها
  • ایموجی‌های استریم

مدل Imagine Image 2.0 به سمت تولید ویدیو حرکت می‌کند

شرکت xAI قابلیت دیگری را نیز نمایش داده است که می‌تواند شخصیت‌ها، مکان‌ها و اشیا را به‌صورت جداگانه تولید کند و در عین حال سبک بصری را در تمام تصاویر ثابت نگه دارد.

این شرکت قابلیت مذکور را گامی در مسیر ایجاد فرایندهای کامل‌تر برای پیش‌تولید ویدیو می‌داند؛ مسیری که می‌تواند امکان ساخت اجزای مختلف یک پروژه ویدیویی با سبک بصری یکسان را فراهم کند.

جمع‌بندی

هوش مصنوعی Imagine Image 2.0 جدیدترین مدل تصویری xAI است که علاوه بر تولید تصویر، مجموعه‌ای از ابزارهای ویرایش و قالب‌های آماده را ارائه می‌دهد. این مدل در رتبه‌بندی Arena فعلاً پشت سر GPT-Image-2 قرار دارد، اما قابلیت‌هایی مانند ویرایش چندمرجعی، تغییر هوشمند نسبت تصویر و حفظ ثبات بصری می‌توانند آن را برای فرایندهای پیچیده‌تر تولید محتوا کاربردی‌تر کنند.

نظر شما درباره Imagine Image 2.0 چیست؟ آیا ابزارهای جدید xAI می‌توانند این مدل را به رقیبی جدی برای GPT-Image-2 تبدیل کنند؟

اشتراک در
اطلاع از
0 Comments
بازخورد (Feedback) های اینلاین
مشاهده همه دیدگاه ها
رپورتاژ آگهی پربازده
رپورتاژ آگهی پربازده
امیرحسین ملکی