واشنطن-سانا
أطلقت شركة غوغل إصداراً جديداً من نموذج الذكاء الاصطناعي التوليدي «Gemini Omni 1.1 Flash»، مزوداً بقدرات متقدمة لإنشاء مقاطع الفيديو وتحريرها، تشمل استكمال المشاهد الموجودة وتوليد لقطات انتقالية بين إطارين محددين، والاستعانة بمقاطع قصيرة كمرجع، إضافة إلى دعم إنتاج الفيديو بدقة تصل إلى 4K.
وذكر موقع «Android Authority» التقني في تقرير نشره أول أمس، أن النموذج الجديد يستطيع تحليل ما يصل إلى 10 ثوانٍ من اللقطات السابقة عند تمديد مقطع فيديو، بدلاً من الاعتماد على الثانية الأخيرة فقط كما في الإصدارات السابقة، كما يتيح تمديد المقطع على مراحل مدة كل منها 10 ثوانٍ، وصولاً إلى 40 ثانية، مع الحفاظ على العناصر البصرية وتسلسل المشهد.
ويتيح النموذج للمستخدم تحديد الإطار الأول والأخير للمشهد، ليتولى توليد اللقطات اللازمة للانتقال بينهما، بما في ذلك حركات الكاميرا المعقدة وعمليات التكبير والدوران، فضلاً عن انتقالات تساعد على إنتاج مشاهد متصلة أو قابلة للتكرار.
كما يدعم استخدام مقطع فيديو قصير تصل مدته إلى ثلاث ثوانٍ مرجعاً لإنشاء فيديو جديد، ما يساعد في الحفاظ على تفاصيل الشخصيات والبيئة والحركة، فيما أضافت غوغل خيار إنتاج الفيديو بدقة 360 بكسلاً لتسريع اختبار الأفكار وإنشاء النماذج الأولية، قبل الانتقال إلى دقة 1080 بكسلاً أو 4K.
وأتاحت غوغل النموذج الجديد للمطورين عبر «Gemini API» ومنصة «Google AI Studio»، ولعملاء المؤسسات عبر «Agent Platform API»، كما أصبح متاحاً للمشتركين في خطط «AI Plus» و«AI Pro» و«AI Ultra» عبر منصتي «Google Flow» وتطبيق «Gemini».
وتأتي هذه الخطوة في إطار توجه غوغل نحو تطوير أدوات للذكاء الاصطناعي لا تقتصر على إنشاء مقاطع الفيديو من الصفر، بل تتيح أيضاً استكمال المشاهد وتحريرها والحفاظ على اتساق عناصرها وتسلسلها البصري.