Black Forest Labs تطلق FLUX 3 Video لإنشاء فيديوهات
أعلنت شركة Black Forest Labs عن إطلاق FLUX 3 Video، وهو نموذج ذكاء اصطناعي متعدد الوسائط قادر على إنشاء فيديوهات تصل مدتها إلى 20 ثانية بدقة HD مع صوت مدمج، اعتمادًا على الأوامر النصية أو الصور، مع خطط لإطلاق نسخة مفتوحة الأوزان خلال الفترة المقبلة.

تفاصيل الخبر
كشفت Black Forest Labs عن الإتاحة العامة للإصدار الأول من FLUX 3 Video عبر واجهة BFL API وعدد من الشركاء، ليقدم تجربة متقدمة في إنشاء الفيديوهات باستخدام الذكاء الاصطناعي. ويُعد FLUX 3 نموذجًا متعدد الوسائط يستطيع التعامل مع النصوص والصور والفيديو والصوت، مع التركيز على إنتاج محتوى طبيعي ومتناسق.
ويستطيع النموذج إنشاء مقاطع فيديو تصل مدتها إلى 20 ثانية بدقة HD (720p)، مع إمكانية الحصول على دقة Full HD (1080p) عبر تقنيات تحسين الجودة، إضافة إلى إنشاء الصوت الأصلي بالتزامن مع الفيديو دون الحاجة إلى أدوات خارجية.
ومن أبرز مزايا FLUX 3 Video:
- إنشاء فيديوهات من النصوص (Text-to-Video).
- تحويل الصور إلى فيديو مع دعم الإطارات المفتاحية (Image-to-Video).
- استكمال مقاطع الفيديو الحالية مع الحفاظ على الحركة والصوت.
- إنتاج فيديوهات متعددة المشاهد وزوايا التصوير في مقطع واحد.
- إنشاء الحوارات والمؤثرات الصوتية والأصوات المحيطة بشكل تلقائي.
- دعم عدد كبير من اللغات مع مزامنة دقيقة لحركة الشفاه.
- فهم التعليمات البسيطة والمعقدة وإنتاج مشاهد متناسقة.
- توفير وضع المسودة (Draft Mode) لإنشاء معاينات سريعة ومنخفضة التكلفة قبل إنتاج النسخة النهائية.
وأكدت الشركة أن FLUX 3 يعتمد على مفهوم “نماذج الواقع”، حيث يسعى إلى فهم العالم بجميع وسائطه بدلًا من التركيز على أسلوب بصري واحد، مما يمنحه القدرة على إنتاج فيديوهات سينمائية أو واقعية أو تعليمية أو إبداعية حسب طبيعة الطلب.
وأوضحت Black Forest Labs أن اختبارات التقييم الداخلية أظهرت تفوق FLUX 3 في إنشاء الفيديو من النصوص، مع تحقيق نتائج منافسة لأفضل النماذج الحالية في تحويل الصور إلى فيديو.
كما أشارت الشركة إلى أنها طبقت إجراءات متعددة لتعزيز الاستخدام المسؤول للنموذج، بالتعاون مع جهات خارجية متخصصة، بهدف الحد من إساءة الاستخدام واكتشاف المحتوى المخالف قبل الإطلاق.
الأهداف المستقبلية
تخطط Black Forest Labs لتوسيع قدرات FLUX 3 خلال الإصدارات القادمة، مع التركيز على زيادة التحكم في عملية إنشاء الفيديو ودعم مزيد من الوسائط. وتشمل أبرز الخطط المستقبلية:
- دعم إنشاء الفيديو باستخدام مزيج من الصور والفيديو والصوت في وقت واحد.
- إضافة أدوات أكثر تقدمًا للتحكم في المشاهد والحركة.
- إطلاق FLUX 3 Image لإنشاء الصور وتحريرها.
- توفير FLUX 3 Dev كنسخة مفتوحة الأوزان للمطورين.
- تحسين جودة الفيديو والصوت في الإصدارات القادمة.
- توسيع استخدام النموذج في التعليم، والإعلانات، وصناعة المحتوى، والإنتاج الإعلامي.
ويمثل FLUX 3 خطوة جديدة في تطور نماذج الذكاء الاصطناعي متعددة الوسائط، حيث لم يعد التركيز مقتصرًا على إنشاء الفيديو فقط، بل امتد إلى دمج الصوت، والحوار، والمعرفة بالعالم داخل نموذج واحد قادر على إنتاج محتوى أكثر واقعية وتنوعًا.
يعزز إطلاق FLUX 3 Video المنافسة في سوق إنشاء الفيديو بالذكاء الاصطناعي، بفضل دعمه للصوت المدمج، وتعدد اللغات، وإمكانيات التحكم المتقدمة. ومع اقتراب إطلاق النسخة مفتوحة الأوزان، قد يصبح النموذج خيارًا مهمًا للمطورين وصناع المحتوى الباحثين عن أدوات أكثر مرونة واحترافية.
