کاربر گرامی

برای استفاده از محتوای اختصاصی و ویدئو ها باید در وب سایت هفت صبح ثبت نام نمایید

با ثبت نام و خرید اشتراک به نسخه PDF روزنامه، مطالب و ویدئو‌های اختصاصی و تمامی امکانات دسترسی خواهید داشت.

کدخبر: ۶۰۱۶۱۳۰۶
تاریخ خبر:

تحولی در تولید ویدئوهای هوش مصنوعی؛ «گوگل فلو» با مدل Gemini Omni ۱.۱ هوشمندتر از همیشه شد

تحولی در تولید ویدئوهای هوش مصنوعی؛ «گوگل فلو» با مدل Gemini Omni 1.1 هوشمندتر از همیشه شد

گوگل در به‌روزرسانی اخیر خود، قابلیت‌های پلتفرم «فلو» (Flow) را به‌طور چشمگیری ارتقا داده است.

به گزارش هفت صبح با ادغام مدل جدید Gemini Omni 1.1 Flash، سازندگان ویدئو اکنون کنترل بسیار دقیق‌تری بر خروجی‌های هوش مصنوعی دارند. این آپدیتِ کاربردی، امکانات کلیدی نظیر درون‌یابی فریم‌های ابتدا و انتها، قابلیت گسترش صحنه‌ها و پشتیبانی از خروجی با کیفیت ۴K را به ابزارهای در دسترس کاربران اضافه کرده است.

 

از یک ابزار فیلم‌سازی تا استودیوی خلاق AI

گوگل فلو که در ابتدا به عنوان یک «زمین بازی» فیلم‌سازی مبتنی بر فناوری Veo متولد شد، اکنون به یک استودیوی خلاق جامع تبدیل شده است که قابلیت‌های تولید و ویرایش تصویر، ویدئو و صوت را در یک محیط واحد گرد هم آورده است. با معرفی Gemini Omni 1.1 Flash، گوگل این پلتفرم را یک گام دیگر به تولید حرفه‌ای و تبدیل ایده‌های خام به ویدئوهای سینمایی نزدیک‌تر کرده است.

 

کنترل دقیق بر روایت ویدئویی

یکی از مهم‌ترین ویژگی‌های این به‌روزرسانی، ارتقای قابلیت «گسترش صحنه» است. برخلاف گذشته که هوش مصنوعی تنها فریم نهایی را بررسی می‌کرد، مدل جدید می‌تواند تا ۱۰ ثانیه از ویدئوی موجود را تحلیل کند تا پیوستگی بصری و روایی در کلیپ‌های طولانی‌تر حفظ شود.

علاوه بر این، کاربران اکنون امکان تعیین فریم‌های ابتدا و انتهای یک پلان را دارند؛ مدل Omni 1.1 با تحلیل این دو نقطه، محتوای میان آن‌ها را تولید می‌کند. این ویژگی آزادی عمل بی‌نظیری در طراحی حرکت دوربین، انتقال‌ها (Transitions) و ایجاد حلقه‌های ویدئویی (Looping) به فیلم‌سازان می‌دهد.

 

پیش‌نویس‌های سریع‌تر، خروجی‌های باکیفیت‌تر

گوگل با هدف کاهش هزینه‌ها و تسهیل فرآیند ایده‌پردازی، امکان تولید پیش‌نویس‌های ۳۶۰p را با سرعت ۶۰ درصد بیشتر و هزینه‌ای معادل یک‌سومِ تولیدات استاندارد فراهم کرده است. این رویکرد به سازندگان اجازه می‌دهد پیش از صرف هزینه برای رندرهای سنگین، ایده‌های خود را تست و اصلاح کنند. پس از نهایی شدن کانسپت، کاربران می‌توانند به راحتی خروجی نهایی را با کیفیت ۱۰۸۰p یا ۴K دریافت کنند.

 

حفظ ثبات شخصیت و استایل با ویدئوهای مرجع

یکی دیگر از قابلیت‌های کاربردی این نسخه، امکان ارائه ویدئوهای مرجع است. کاربران می‌توانند تا سه ثانیه از یک ویدئوی مجزا را به عنوان مرجع به مدل Omni 1.1 ارائه دهند. این ویژگی به مدل کمک می‌کند تا زمینه بصری و ویژگی‌های ظاهری شخصیت‌ها را در طول تولید ویدئوی جدید حفظ کند؛ چالشی که تا پیش از این یکی از نقاط ضعف اصلی تولید ویدئو با هوش مصنوعی بود.

این به‌روزرسانی هم‌اکنون برای مشترکین سرویس‌های Google AI Plus، Pro و Ultra در سراسر جهان در دسترس است. همچنین توسعه‌دهندگان می‌توانند از طریق Google AI Studio و پلتفرم Gemini Enterprise Agent، به این ابزارهای کنترلی دسترسی پیدا کنند.

کدخبر: ۶۰۱۶۱۳۰۶
تاریخ خبر:
ارسال نظر