Google تطلق Gemini Omni 1.1 Flash بقدرات فيديو متطورة

أطلقت Google تحديثًا جديدًا لنموذج الفيديو Gemini Omni 1.1 Flash، مضيفةً إليه تمديد المشاهد حتى 40 ثانية، والتحكم بالإطارات، ومعاينة أسرع، إلى جانب رفع جودة الفيديو إلى دقة 4K.

تفاصيل إطلاق Gemini Omni 1.1 Flash

قدمت Google نموذج Gemini Omni 1.1 Flash باعتباره تحديثًا يركز على منح المطورين وصناع المحتوى تحكمًا أكبر في إنشاء وتعديل مقاطع الفيديو بالذكاء الاصطناعي، مع تحسين استمرارية المشاهد وجودة المخرجات.

  • يتيح النموذج تمديد المشاهد تدريجيًا حتى مدة إجمالية تصل إلى 40 ثانية، مع الحفاظ على اتساق الشخصيات والإضاءة وتسلسل الأحداث.
  • يستطيع تحليل ما يصل إلى 10 ثوانٍ من الفيديو السابق لإنشاء امتداد أكثر سلاسة للمشهد.
  • يسمح بتحديد الإطار الأول والأخير للمقطع، ثم إنشاء الحركة الانتقالية بينهما.
  • يمكن استخدام هذه الميزة لإنشاء حركات كاميرا وانتقالات ولقطات متكررة بصورة أكثر تحكمًا.
  • يوفر وضع معاينة بدقة 360p لتجربة الأفكار بسرعة قبل إنتاج النسخة النهائية.
  • يمكن رفع جودة المقاطع النهائية إلى 1080p أو 4K للحصول على مخرجات مناسبة للاستخدامات الاحترافية.
  • يدعم النموذج استخدام الصور ومقاطع الفيديو المرجعية للمساعدة في الحفاظ على العناصر البصرية المطلوبة.
  • أصبح Gemini Omni 1.1 Flash متاحًا للمطورين عبر أدوات Google المخصصة لبناء تطبيقات الذكاء الاصطناعي.

وتأتي هذه المزايا في وقت تتنافس فيه شركات الذكاء الاصطناعي على تقديم نماذج قادرة على إنتاج فيديو أكثر اتساقًا وقابلية للتحكم. كما حصل Gemini Omni 1.1 Flash على المركز الأول في تقييم Text-to-Video ضمن Arena، بينما جاء في المركز الثاني ضمن Image-to-Video وفق النتائج المنشورة حديثًا.

الأهداف المستقبلية لـGemini Omni 1.1 Flash

تسعى Google من خلال هذه القدرات إلى جعل إنشاء الفيديو بالذكاء الاصطناعي أقرب إلى سير عمل احترافي يمكن التحكم في تفاصيله، بدل الاعتماد على إنشاء مقطع عشوائي من وصف نصي واحد.

ومن أبرز الاستخدامات والأهداف المستقبلية:

  • مساعدة صناع المحتوى على إنتاج مقاطع أطول وأكثر ترابطًا.
  • تسهيل إنشاء الإعلانات ومقاطع التواصل الاجتماعي والفيديوهات التوضيحية.
  • منح المطورين تحكمًا أكبر في حركة الكاميرا وتسلسل المشاهد.
  • تقليل تكلفة ووقت تجربة الأفكار من خلال المعاينات منخفضة الدقة.
  • تحسين جودة الفيديو النهائي باستخدام الرفع إلى دقة 4K.
  • تطوير عمليات إنتاج فيديو يمكن تعديلها تدريجيًا بدل إعادة إنشاء المقطع بالكامل.
  • زيادة قدرة الذكاء الاصطناعي على الحفاظ على هوية الشخصيات والعناصر البصرية بين اللقطات.

ومع استمرار تطور نماذج الفيديو، يمكن أن تصبح هذه الأدوات جزءًا من مراحل الإنتاج الفعلية، خصوصًا في تصميم المشاهد الأولية والإعلانات والمحتوى الرقمي، مع تقليل الوقت المطلوب بين الفكرة والنتيجة النهائية.

يمثل Gemini Omni 1.1 Flash خطوة جديدة من Google نحو فيديو أكثر قابلية للتحكم، إذ يجمع بين تمديد المشاهد والتحكم بالإطارات والمعاينة السريعة ورفع الدقة إلى 4K. ومع تصدره تقييمات Text-to-Video في Arena، تزداد المنافسة على مستقبل صناعة الفيديو بالذكاء الاصطناعي.

مقالات مشابهة