Google تطلق Gemini Omni Flash لتوليد الفيديو وتعديله بالمحادثة
يتيح Gemini Omni Flash إنشاء مقاطع فيديو وتعديلها بأوامر طبيعية اعتمادًا على مدخلات نصية وصورية ومرئية.
صناعة وتعديل الفيديوهات أصبحت أسرع من الخيال مع Gemini Omni Flash.
صناعة وتعديل الفيديوهات أصبحت أسرع من الخيال مع Gemini Omni Flash. أطلقت جوجل نموذجها المتعدد الوسائط الجديد الذي يستطيع توليد مقاطع فيديو عالية الجودة وتعديلها بناءً على الأوامر الصوتية في غضون ثوانٍ قليلة. المصدر: Google Keynote #فيديو #تصميم #جوجل #أفق_الذكاء
نموذج يجمع الفهم وصناعة الفيديو
أعلنت Google نموذج Gemini Omni Flash، وهو أول نموذج في عائلة Gemini Omni. يجمع النموذج بين قدرات Gemini في فهم التعليمات وبين نماذج الوسائط التوليدية لإنشاء الفيديو أو تعديل مقطع موجود عبر أوامر مكتوبة بلغة طبيعية.
كيف يعمل؟
يمكن للمستخدم الجمع بين نصوص وصور ومقاطع فيديو كمراجع، ثم طلب تغييرات متتابعة من خلال المحادثة. تقول Google إن النموذج يحافظ على سياق التعديلات السابقة وعلى قدر من ثبات الشخصيات والعناصر داخل المشهد.
الإتاحة والاستخدام
بدأ طرح Omni Flash في تطبيق Gemini وGoogle Flow وYouTube Shorts، ثم أتيح للمطورين في نسخة تجريبية عامة عبر Google AI Studio وGemini API. يستهدف النموذج صناعة المقاطع القصيرة وتحريرها بسرعة أكبر دون الاعتماد الكامل على أدوات المونتاج التقليدية.
قيود ينبغي معرفتها
تقتصر المخرجات الحالية على مقاطع قصيرة، كما تشير وثائق Google إلى قيود في ثبات الشخصيات ومعالجة بعض المراجع المرئية. وكل فيديو مولد يتضمن علامة SynthID للمساعدة على تمييز المحتوى المصنوع بالذكاء الاصطناعي.
المصادر والتحقق
حالة التحقق: متحقق · درجة الثقة: 98%
المصدر الأصلي