Till skillnad från traditionella pipeline-modeller som bearbetar input sekventiellt, hanterar Gemini Omni Flash text, bilder, ljud och video som en enda enhetlig input och producerar video som output – en förmåga som kallas "any-to-any" AAB. Modellen genererar 3–10 sekunders 720p-klipp i 24 fps med bildförhållandena 16:9, 9:16 eller 1:1, samt synkroniserat ljud som skapas i samma pass HG.
Du kan mata modellen med upp till sju referensbilder, ett videoklipp och en kort textbeskrivning i en enda prompt, och den smälter samman dem till en sammanhängande video BG. En användare skulle till exempel kunna ladda upp produktbilder, en bakgrundsvideo och en beskrivning, och Omni Flash skulle generera ett kort reklamklipp.
Den mest framträdande funktionen är konversationsbaserad videoredigering, möjliggjord av Interactions API AA. Istället för att exportera klipp till ett separat redigeringsverktyg kan användare iterativt förfina resultatet genom naturligt språk – byta karaktärer, produkter, stilar, lägga till objekt eller ändra belysning – medan modellen bevarar de delar av videon som användaren vill behålla AA. Varje steg i konversationen producerar en ny video, och modellen förstår sammanhanget från tidigare steg A.
API-priset är satt till 0,10 USD per sekund genererad video, vilket motsvarar 1 USD per 10-sekundersklipp AH. Detta matchar Veo 3.1 Fast och positionerar Omni Flash som ett mer kostnadseffektivt alternativ för snabba iterationer i videoproduktion Y. Priset är också 1,50 USD per miljon inputtokens och 17,50 USD per miljon video-outputtokens H.
För konsumenter är Gemini Omni Flash kostnadsfritt på YouTube Shorts för användare som är 18 år eller äldre AWN. Det ingår även i Google AI Plus, Pro och Ultra-prenumerationsnivåerna AG.
10-sekundersbegränsningen är ett medvetet produktbeslut vid lansering, med längre videor planerade för framtida releaser HY. Google har beskrivit detta som en ansvarsfull utrullningsstrategi, som balanserar kapacitet med säkerhet T. Vissa kommentatorer menar att begränsningen kan vara en implementeringsbegränsning snarare än en begränsning i själva modellarkitekturen N.
Varje klipp som genereras eller redigeras med Omni Flash innehåller ett osynligt SynthID-digitalt vattenmärke YNN. Användare kan verifiera AI-genererat innehåll via Gemini-appen, Gemini i Chrome och Google Search genom att fråga "Skapades den här videon med Google AI?" NB. På Googles plattformar bär innehållet även C2PA Content Credentials NC. Det finns ingen möjlighet att stänga av vattenmärkning via API DG.
Den 1 juli 2026 lade Adobe till Gemini Omni Flash som en partnermodell i Adobe Firefly, vilket möjliggör videoredigering på vanlig svenska via Fireflys gränssnitt och creditsystem D. Det kostar 30 credits per sekund video D. Detta följer på ett bredare partnerskap som annonserades på Google I/O för att integrera Adobe-anslutningen i Gemini B. Användare kan nå modellen via rullgardinsmenyn för modeller i modulen Text till Video A.
I samband med Omni Flash lanserades Nano Banana 2 Lite (modell-ID: gemini-3.1-flash-lite-image), den snabbaste och billigaste bildmodellen i Googles Nano Banana-familj AA. Den genererar bilder på under 4 sekunder till en kostnad av under 0,04 USD per 1 000 bilder BHB. Allmän tillgänglighet annonserades 30 juni 2026 på Google Cloud, och modellen finns i Google AI Studio, Gemini API och Gemini Enterprise Agent Platform HCB.
Google visade upp Omni Product Studio på Google I/O 2026, en demo-app som förvandlar statiska produktbilder till filmiska e-handelsvideor med hjälp av Gemini Omni Flash GC.
Redigering av uppladdade videor är blockerad för användare i Europeiska ekonomiska samarbetsområdet (EES), Schweiz och Storbritannien A. Användarrapporter indikerar även blockering i Indien och vissa delstater i USA A. Modellen redigerar tillförlitligt endast sina egna genererade klipp – inte godtyckliga uppladdningar från tredje part – som en säkerhetsåtgärd mot deepfake-missbruk A. Möjligheten att redigera tal och ljud är medvetet undanhållen vid lansering på grund av deepfake-bekymmer TGL.