Gemini Omni: يمكنها الآن تمديد الفيديو لـ 40 ثانية ورفع جودته إلى 4K

تحديثات Gemini Omni تتيح تمديد الفيديو إلى 40 ثانية وترقيته لدقة 4K. اكتشف كيف تعزز هذه الميزات تجربة إنشاء المحتوى.

أهم ما تحتاج إلى معرفته

  • يمكن للمبدعين الآن تحديد الإطارين الأول والأخير لمقاطع الفيديو التي يولدها Gemini، مما يتيح ربط المشاهد بسلاسة وإنشاء حركات كاميرا معقدة أو حلقات متواصلة، مع دعم المراجع المرئية للحفاظ على اتساق العناصر.
  • تتيح Omni 1.1 إنشاء معاينات بدقة 360p أسرع بنسبة 60% وتكلف ثلث سعر المخرجات العادية، مما يسهل اختبار الأفكار وتعديل المطالبات بكفاءة قبل الإنتاج النهائي.
  • يتوفر Omni 1.1 Flash للمطورين عبر Gemini API و Google AI Studio، بينما يمكن للمشتركين في Google Flow (AI Plus و Pro و Ultra) الوصول إلى ميزات مثل تمديد المشاهد مباشرةً في تطبيق Gemini.

إن إنشاء فيديو قصير بالذكاء الاصطناعي أمر، لكن جعل عدة لقطات تبدو وكأنها جزء من نفس الفيديو يمثل تحديًا أكبر بكثير. تتصدى Google لهذا التحدي مجددًا من خلال Gemini Omni 1.1 Flash، أحدث نموذج لتوليد الفيديو بالذكاء الاصطناعي، والذي يهدف إلى منح المبدعين والمطورين تحكمًا أكبر بكثير في ما يحدث بين الإطار الأول والأخير.

يتمثل التغيير الأبرز في مدى قدرة Gemini على تذكر الفيديو الحالي عند طلب مواصلة مشهد. يمكن لـ Omni 1.1 تحليل ما يصل إلى 10 ثوانٍ من اللقطات السابقة للحصول على السياق، بدلاً من الاعتماد على الثانية الأخيرة فقط. سيساعد هذا في الحفاظ على اتساق الشخصيات والبيئات والاتجاه العام للمشهد بشكل أكبر، بدلاً من التخمين الفعال لما يجب أن يحدث بعد ذلك.

مقاطع الفيديو بالذكاء الاصطناعي لم تعد تنتهي بهذه السرعة

تمنح Google أيضًا المبدعين مساحة أكبر بكثير لمواصلة تلك المشاهد. يمكن تمديد مقاطع الفيديو بزيادات قدرها 10 ثوانٍ حتى تصل إلى مدة إجمالية قدرها 40 ثانية. قد لا تبدو هذه المدة طويلة بشكل خاص مقارنةً بالفيديو التقليدي، لكنها تفتح مجالًا أوسع بكثير لتسلسلات الفيديو التي يولدها الذكاء الاصطناعي، والتي تحتوي على بداية ووسط ونهاية حقيقية.

زهرة، نبات، عباد الشمس

يمكن للمبدعين أيضًا توفير الإطار الأول والأخير الذي يرغبون فيه للقطة. يقوم Gemini بعد ذلك بتوليد كل ما يلزم لربط الإطارين. يمكن أن يكون هذا مفيدًا لإنشاء حركة كاميرا حول موضوع معين، أو التكبير بسلاسة بين التكوينات، أو بناء مقطع مصمم للتشغيل المتكرر (loop) دون قفزة واضحة. كما يدعم النظام المراجع المرئية (video references). يمكنك تزويد Gemini بما يصل إلى ثلاث ثوانٍ من اللقطات الموجودة مسبقًا لمنح النموذج سياقًا بصريًا إضافيًا، وهو ما تقول Google إنه سيساعد في الحفاظ على عناصر مثل مظهر الشخصيات عبر المشاهد التي يتم إنشاؤها.

لا تحتاج إلى عرض كل شيء بدقة 4K

ليس من الضروري أن تبدأ كل تجربة بأقصى جودة، وإحدى الإضافات الأكثر عملية في Omni 1.1 تعترف بذلك تمامًا. يمكن للمطورين إنشاء معاينات بدقة 360p تدعي Google أنها أسرع بنسبة تصل إلى 60% من مخرجاتها العادية بدقة 720p، بينما تكلف حوالي ثلث التكلفة. وهذا يسهل اختبار فكرة بسرعة، أو تعديل المطالبات (prompts)، أو العمل على عدة إصدارات قبل إنفاق المزيد من الوقت والمال على النتيجة النهائية. بمجرد أن تكون راضيًا عن النتيجة، يمكن لـ Omni 1.1 إنتاج لقطات بدقة 1080p أو ترقية الفيديو النهائي إلى دقة تصل إلى 4K.

مائي، ماء، حيوان

تتيح الشركة بالفعل Omni 1.1 Flash للمطورين عبر Gemini API في Google AI Studio، بينما يمكن للشركات الوصول إليه من خلال Agent Platform للمؤسسات من Google. لا تحتاج بالضرورة إلى بناء تطبيق لتجربة بعض هذه الميزات. يتم طرح Omni 1.1 عالميًا في Google Flow للمشتركين في AI Plus و Pro و Ultra. كما ستتوفر ميزة تمديد المشاهد لهؤلاء المشتركين مباشرة داخل Gemini app، مما يجعل تجربة إحدى أحدث قدرات النموذج وأكثرها إثارة للاهتمام أسهل بكثير.

التعليقات مغلقة.