🔷 مدل هوش مصنوعی Gemini Omni 1.1 Flash قابلیت گسترش ویدئو با حفظ پیوستگی صحنه را ارائه میدهد.
🔷 امکان تعیین فریم ابتدایی و پایانی برای ساخت ویدئو بین دو فریم فراهم شده است.
🔷 تولید ویدئوی 360p برای پیشنمایش و نمونهسازی سریع تا 60 درصد سریعتر است.
🔷 این مدل امکان تولید خروجی 1080p و 4K از طریق Upscaling را دارد.
🔷 مدل جدید همچنین از ویدئوی مرجع تا سه ثانیه پشتیبانی میکند.
گوگل Gemini Omni 1.1 Flash را بهعنوان نسخه بهروزشده مدل تولید ویدئوی خود معرفی کرده است. این نسخه قابلیتهایی را در اختیار کاربران قرار میدهد که کنترل بیشتری روی ادامه صحنه، فریمهای کلیدی، وضوح خروجی و استفاده از ویدئوهای مرجع فراهم میکنند.
یکی از قابلیتهای جدید Gemini Omni 1.1 Flash، امکان ادامه دادن یک ویدئوی موجود از نقطهای است که به پایان رسیده است. این مدل میتواند تا 10 ثانیه از ویدئوی قبلی را تحلیل کند؛ در حالی که مدلهای قبلی تنها آخرین ثانیه ویدئو را در نظر میگرفتند.
این زمینه بیشتر به مدل کمک میکند تا هنگام ادامه دادن صحنه، پیوستگی بصری و روایی را بهتر حفظ کند.
ویدئوها در بازههای 10 ثانیهای قابل گسترش هستند و طول کلی ویدئو میتواند در مجموع به 40 ثانیه برسد.
مدل هوش مصنوعی Gemini Omni 1.1 Flash به کاربران اجازه میدهد فریم ابتدایی و پایانی یک شات را مشخص کنند. سپس مدل ویدئوی بین این دو فریم کلیدی را تولید میکند.
این قابلیت برای مواردی مانند زیر کاربرد دارد:
یکی دیگر از قابلیتهای جدید Gemini Omni 1.1 Flash، امکان تولید ویدئو با وضوح 360p است. گوگل میگوید تولید ویدئو در این وضوح میتواند تا 60 درصد سریعتر انجام شود و هزینه آن نیز حدود یکسوم تولید ویدئوی 720p است.
حالت 360p میتواند برای نمونهسازی سریع، تکرار و اصلاح استوریبرد و رندر سریع در پلتفرمهای توسعهدهندگان مورد استفاده قرار گیرد.
مدل Gemini Omni 1.1 Flash امکان ارائه خروجیهای 1080p و 4K را نیز فراهم کرده است. این وضوحهای بالاتر از طریق فرایند Upscaling برای ویدئوهای تولیدشده ارائه میشوند.
گوگل همچنین امکان استفاده از ویدئوی مرجع را به ورودی چندوجهی Gemini Omni 1.1 Flash اضافه کرده است. کاربران میتوانند ویدئوی مرجعی با حداکثر طول 3 ثانیه در اختیار مدل قرار دهند.
این ویدئو میتواند زمینه بصری بیشتری در اختیار مدل قرار دهد و هنگام تولید یک صحنه، به حفظ ثبات شخصیتها کمک کند.
مدل Gemini Omni 1.1 Flash از طریق Gemini API در Google AI Studio در حال عرضه است. شرکتها نیز میتوانند از Omni 1.1 از طریق API پلتفرم Gemini Enterprise Agent Platform استفاده کنند.
گوگل برای این مدل مستندات توسعهدهندگان، Cookbook و راهنماهای پرامپتنویسی برای قابلیتهایی مانند گسترش صحنه، استفاده از ویدئوی مرجع و Upscaling ارائه میکند.
همچنین Gemini Omni 1.1 از امروز بهصورت جهانی در سرویس Google Flow برای مشترکان Google AI Plus ،Pro و Ultra در دسترس قرار گرفته است. قابلیت گسترش صحنه نیز برای همین گروه از کاربران در اپلیکیشن Gemini بهصورت جهانی ارائه شده است.
مدل Gemini Omni 1.1 Flash با تمرکز بر کنترل بیشتر فرایند تولید ویدئو، قابلیتهایی مانند گسترش صحنه تا 40 ثانیه، تعیین فریمهای ابتدایی و پایانی، تولید سریع 360p، خروجی 1080p و 4K و استفاده از ویدئوی مرجع را به مدل گوگل اضافه میکند.
🔴 همچنین بخوانید: گوگل از Nano Banana 2 Lite و Gemini Omni Flash رونمایی کرد؛ تولید تصویر در ۴ ثانیه و ساخت ویدیو از طریق API
نظر شما درباره قابلیتهای جدید Gemini Omni 1.1 Flash چیست؟ آیا این ابزار میتواند در تولید محتوای ویدئویی کاربردی باشد؟