جوجل تطلق تحديث Gemini Omni 1.1 Flash مع دعم تمديد الفيديو إلى 40 ثانية

أعلنت شركة جوجل عن إصدار جديد من نموذج الذكاء الاصطناعي التوليدي تحت اسم Gemini Omni 1.1 Flash، الذي يطرح مجموعة من القدرات المتطورة لإنشاء وتحرير مقاطع الفيديو، مثل تمديد المشاهد الحالية وتوليد لقطات بين إطارين محددين، بالإضافة إلى استخدام مقاطع فيديو قصيرة كمرجع لإنتاج محتوى بصري متناسق، ويتميز النموذج بإمكانية إنتاج فيديوهات بدقة تصل إلى 4K.
طرح النموذج عبر منصات جوجل المخصصة للمطورين والمتابعين في خطط AI Plus وAI Pro وAI Ultra، حيث أصبح متاحًا عالميًا من خلال منصة Google Flow وتطبيق Gemini، ما يسهل على صناع المحتوى الوصول إلى هذه التقنيات المتقدمة.
يتفوق Gemini Omni 1.1 Flash بقدرته على تحليل حتى 10 ثوانٍ من اللقطات السابقة عند تمديد الفيديو، بعدما كانت الإصدارات السابقة تعتمد فقط على اللقطة الأخيرة، ويمكن للمطورين تمديد الفيديو بزيادات تصل إلى 10 ثوانٍ لكل مرة، بحيث يصل مجموع التمديد إلى 40 ثانية، ما يمنح مساحة أكبر لاستكمال المشاهد مع الاحتفاظ بعناصرها البصرية والسردية.
تتيح الخاصية الجديدة أيضًا للمستخدمين تحديد الإطار الأول والأخير للمشهد، ليقوم النموذج بتوليد اللقطات الموصلة بينهما، كما يدعم التعامل مع حركات الكاميرا المعقدة كالدوارن والتكبير، على سبيل المثال، ويشمل أيضًا أنواع الانتقالات التي تساعد على إنتاج مقاطع متصلة أو قابلة للتكرار، وبذلك يتيح النموذج للمبدعين التحكم بنتيجة الفيديو دون الحاجة إلى إنشائه كاملاً اعتمادًا على وصف نصي فقط.
داخل نموذج Gemini Omni 1.1 Flash، أصبح بالإمكان استخدام مقطع فيديو قصير يصل طوله إلى 3 ثوانٍ كمرجع عند إنتاج فيديو جديد، ما يساعد في الحفاظ على التفاصيل الدقيقة مثل أشكال الشخصيات والبيئة البصرية، وقد قدمت جوجل إمكانية استخدام عدة مقاطع مرجعية لإعادة تشكيل حركات مختلفة داخل فيديو واحد متواصل.
أضافت جوجل أيضًا خيار إنتاج الفيديو بجودة منخفضة تصل إلى 360p لتسهيل التجارب السريعة، إذ يساعد هذا الأسلوب المطورين وصناع المحتوى في اختبار الأفكار الأولية قبل الانتقال إلى جودة أعلى، حيث يقدم إنشاء هذه المسودات أداء أسرع بنحو 60% مقارنة بدقة 720p، كما تكلفته تبلغ حوالي ثلث تكلفة إنتاج فيديو بجودة 720p، وهو خيار موجه بشكل خاص لتطوير النماذج الأولية ولوحات القصة، مع إمكانية التبديل لاحقًا لإنتاج نسخ نهائية بدقة 1080p أو 4K.
يستطيع المطورون الوصول إلى النموذج عبر Gemini API داخل Google AI Studio، في حين يمكن لعملاء المؤسسات استخدامه عبر Agent Platform API، وقد نشرت جوجل وثائق وأدلة متكاملة لاستخدام النموذج، تتضمن أمثلة جاهزة وإرشادات لكتابة الأوامر الخاصة بإنشاء الفيديو، وبات Gemini Omni 1.1 Flash متاحًا عالميًا للمشتركين في الخطط المختلفة عبر Google Flow، مع توفير خاصية تمديد المشاهد ضمن تطبيق Gemini.
بدأ النموذج بالفعل في الاندماج ضمن عمليات إنتاج الفيديو لدى عدد من الشركات والمنصات مثل Adobe وFigma Weave وGMI Cloud وRunway، مما يعكس توجّه جوجل نحو تطوير أدوات ذكاء اصطناعي لا تقتصر على إنشاء الفيديو من الصفر فقط، بل تفهم المشاهد القائمة وتستكملها مع التحكم في الحركات والانتقالات بما يحافظ على تماسك المشهد.




