على عكس النماذج التقليدية التي تعالج المدخلات بشكل تسلسلي، يعالج Gemini Omni Flash النصوص والصور والصوت والفيديو كمدخل موحد واحد وينتج فيديو كمخرج — وهي قدرة تُعرف باسم "من أي إلى أي" (any-to-any) AAB. يولد النموذج مقاطع فيديو بجودة 720p ولمدة تتراوح بين 3 و10 ثوانٍ بمعدل 24 إطارًا في الثانية، وبنسب أبعاد 16:9 أو 9:16 أو 1:1، مع صوت متزامن يتم إنشاؤه في نفس العملية HG.
يمكنك إدخال ما يصل إلى سبع صور مرجعية، ومقطع فيديو واحد، ونص وصفي في أمر واحد، وسيقوم النموذج بدمجها في مقطع فيديو متماسك BG. على سبيل المثال، يمكن للمستخدم تقديم صور منتج، وفيديو خلفية، ووصف نصي، وسينشئ Omni Flash مقطعًا ترويجيًا قصيرًا.
أبرز ميزة في النموذج هي التحرير التلقائي للفيديو عبر المحادثة، والتي تتيحها واجهة التفاعل (Interactions API) AA. بدلاً من تصدير المقاطع إلى أداة تحرير منفصلة، يمكن للمستخدمين تحسين المخرجات بشكل متكرر من خلال اللغة الطبيعية — تبديل الشخصيات، تبديل المنتجات، تغيير الأنماط، إضافة العناصر، وتغيير الإضاءة — مع الحفاظ على الأجزاء التي يريد المستخدم الاحتفاظ بها AA. كل خطوة في المحادثة تنتج مقطع فيديو جديد، ويفهم النموذج السياق من الخطوات السابقة A.
تم تحديد سعر واجهة برمجة التطبيقات (API) بـ 0.10 دولار لكل ثانية من الفيديو المُنشأ، أي ما يعادل دولار واحد لكل مقطع مدته 10 ثوانٍ AH. هذا السعر يتطابق مع نموذج Veo 3.1 Fast، مما يجعل Omni Flash بديلاً أقل تكلفة وأسرع لتوليد الفيديو Y. السعر أيضًا 1.50 دولار لكل مليون رمز (token) مدخل، و17.50 دولار لكل مليون رمز فيديو مخرج H.
للمستهلكين، Gemini Omni Flash مجاني على YouTube Shorts للمستخدمين الذين تبلغ أعمارهم 18 عامًا أو أكثر AWN. وهو أيضًا مشمول في باقات الاشتراك Google AI Plus و Pro و Ultra AG.
الحد الأقصى للمقطع وهو 10 ثوانٍ هو قرار منتج متعمد عند الإطلاق، مع خطط لتمديد المدة في الإصدارات المستقبلية HY. وصفت جوجل هذه الخطوة بأنها استراتيجية طرح مسؤولة توازن بين القدرات والسلامة T. يلاحظ بعض المعلقين أن هذا الحد قد يكون قيدًا تقنيًا من جانب النشر وليس قيدًا في بنية النموذج نفسه N.
كل مقطع يتم إنشاؤه أو تحريره باستخدام Omni Flash يتضمن علامة مائية رقمية غير مرئية من SynthID YNN. يمكن للمستخدمين التحقق من المحتوى المُنشأ بالذكاء الاصطناعي من خلال تطبيق Gemini، وGemini في متصفح Chrome، وبحث جوجل عن طريق طرح سؤال مثل: "هل تم إنشاء هذا الفيديو باستخدام ذكاء جوجل الاصطناعي؟" NB. على الأسطح المدعومة من جوجل، يحمل المحتوى أيضًا بيانات اعتماد C2PA NC. لا يوجد خيار في واجهة API لتعطيل هذه الميزة DG.
في 1 يوليو 2026، أضافت Adobe نموذج Gemini Omni Flash كنموذج شريك داخل Adobe Firefly، مما يتيح تحرير الفيديو باللغة الإنجليزية المبسطة باستخدام واجهة Firefly ونظام الائتمانات الخاص بها D. تكلفة الاستخدام 30 ائتمانًا لكل ثانية من الفيديو D. يأتي هذا التكامل بعد شراكة أوسع تم الإعلان عنها في Google I/O لجلب موصل Adobe إلى Gemini B. يمكن للمستخدمين الوصول إليه من القائمة المنسدلة للنماذج في وحدة النص إلى فيديو A.
إلى جانب Omni Flash، تم إطلاق Nano Banana 2 Lite (المعروف بـ gemini-3.1-flash-lite-image)، وهو أسرع وأرخص نموذج للصور في عائلة Nano Banana من جوجل AA. يولد النموذج الصور في أقل من 4 ثوانٍ بسعر أقل من 0.04 دولار لكل 1,000 صورة BHB. تم الإعلان عن توفره العام في 30 يونيو 2026 على Google Cloud، وهو متاح في Google AI Studio و Gemini API و Gemini Enterprise Agent Platform HCB.
عرضت جوجل استوديو منتجات Omni (Omni Product Studio) في Google I/O 2026، وهو تطبيق نموذجي يحول صور المنتجات الثابتة إلى فيديوهات تجارية سينمائية باستخدام Gemini Omni Flash GC.
تحرير مقاطع الفيديو المرفوعة محظور للمستخدمين في المنطقة الاقتصادية الأوروبية (EEA)، وسويسرا، والمملكة المتحدة A. تشير تقارير المجتمع أيضًا إلى حظر في الهند وبعض الولايات الأمريكية A. النموذج أيضًا لا يحرر بشكل موثوق سوى المقاطع التي أنشأها هو نفسه — وليس الملفات المرفوعة العشوائية — كإجراء أمان لمنع إساءة استخدام التزييف العميق (deepfake) A. تم حجب قدرات تحرير الصوت والكلام عمدًا عند الإطلاق بسبب مخاوف التزييف العميق TGL.