تحولی در تولید ویدئوهای هوش مصنوعی؛ «گوگل فلو» با مدل Gemini Omni ۱.۱ هوشمندتر از همیشه شد
گوگل در بهروزرسانی اخیر خود، قابلیتهای پلتفرم «فلو» (Flow) را بهطور چشمگیری ارتقا داده است.
به گزارش هفت صبح با ادغام مدل جدید Gemini Omni 1.1 Flash، سازندگان ویدئو اکنون کنترل بسیار دقیقتری بر خروجیهای هوش مصنوعی دارند. این آپدیتِ کاربردی، امکانات کلیدی نظیر درونیابی فریمهای ابتدا و انتها، قابلیت گسترش صحنهها و پشتیبانی از خروجی با کیفیت ۴K را به ابزارهای در دسترس کاربران اضافه کرده است.
از یک ابزار فیلمسازی تا استودیوی خلاق AI
گوگل فلو که در ابتدا به عنوان یک «زمین بازی» فیلمسازی مبتنی بر فناوری Veo متولد شد، اکنون به یک استودیوی خلاق جامع تبدیل شده است که قابلیتهای تولید و ویرایش تصویر، ویدئو و صوت را در یک محیط واحد گرد هم آورده است. با معرفی Gemini Omni 1.1 Flash، گوگل این پلتفرم را یک گام دیگر به تولید حرفهای و تبدیل ایدههای خام به ویدئوهای سینمایی نزدیکتر کرده است.
کنترل دقیق بر روایت ویدئویی
یکی از مهمترین ویژگیهای این بهروزرسانی، ارتقای قابلیت «گسترش صحنه» است. برخلاف گذشته که هوش مصنوعی تنها فریم نهایی را بررسی میکرد، مدل جدید میتواند تا ۱۰ ثانیه از ویدئوی موجود را تحلیل کند تا پیوستگی بصری و روایی در کلیپهای طولانیتر حفظ شود.
علاوه بر این، کاربران اکنون امکان تعیین فریمهای ابتدا و انتهای یک پلان را دارند؛ مدل Omni 1.1 با تحلیل این دو نقطه، محتوای میان آنها را تولید میکند. این ویژگی آزادی عمل بینظیری در طراحی حرکت دوربین، انتقالها (Transitions) و ایجاد حلقههای ویدئویی (Looping) به فیلمسازان میدهد.
پیشنویسهای سریعتر، خروجیهای باکیفیتتر
گوگل با هدف کاهش هزینهها و تسهیل فرآیند ایدهپردازی، امکان تولید پیشنویسهای ۳۶۰p را با سرعت ۶۰ درصد بیشتر و هزینهای معادل یکسومِ تولیدات استاندارد فراهم کرده است. این رویکرد به سازندگان اجازه میدهد پیش از صرف هزینه برای رندرهای سنگین، ایدههای خود را تست و اصلاح کنند. پس از نهایی شدن کانسپت، کاربران میتوانند به راحتی خروجی نهایی را با کیفیت ۱۰۸۰p یا ۴K دریافت کنند.
حفظ ثبات شخصیت و استایل با ویدئوهای مرجع
یکی دیگر از قابلیتهای کاربردی این نسخه، امکان ارائه ویدئوهای مرجع است. کاربران میتوانند تا سه ثانیه از یک ویدئوی مجزا را به عنوان مرجع به مدل Omni 1.1 ارائه دهند. این ویژگی به مدل کمک میکند تا زمینه بصری و ویژگیهای ظاهری شخصیتها را در طول تولید ویدئوی جدید حفظ کند؛ چالشی که تا پیش از این یکی از نقاط ضعف اصلی تولید ویدئو با هوش مصنوعی بود.
این بهروزرسانی هماکنون برای مشترکین سرویسهای Google AI Plus، Pro و Ultra در سراسر جهان در دسترس است. همچنین توسعهدهندگان میتوانند از طریق Google AI Studio و پلتفرم Gemini Enterprise Agent، به این ابزارهای کنترلی دسترسی پیدا کنند.