Google Gemini Omni Flash ist das erste Modell der neuen Omni Familie von Google DeepMind, vorgestellt auf der Google I/O am 19. Das Modell verarbeitet Text, Bilder, Audio und Video als einheitliche Eingabe und erzeugt daraus 3–10 Sekunden lange 720p Videoclips mit synchronisiertem Ton.
Forschungsantwort

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What are the key details about Google's Gemini Omni Flash model — including its release date, cap. Article summary: Here is a fact-checked breakdown of every key detail about **Gemini Omni Flash**.. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
Google DeepMind hat auf der Google I/O 2026 am 19. Mai 2026 die neue Omni-Modellfamilie vorgestellt – mit dem Motto „Erstelle alles aus jeder Eingabe, beginnend mit Video.“ Das erste Mitglied dieser Familie, Gemini Omni Flash, wurde noch am selben Tag für Verbraucher in der Gemini-App, bei Google Flow und in YouTube Shorts eingeführt BW. Für Entwickler folgte der öffentliche Zugang als Public Preview am 30. Juni 2026 unter der Modell-ID gemini-omni-flash-preview über die Gemini-API und Google AI Studio AAB. Das offizielle Modellblatt veröffentlichte Google DeepMind am 5. Juli 2026 D.
Im Gegensatz zu herkömmlichen Pipeline-Modellen, die Eingaben nacheinander umwandeln, verarbeitet Gemini Omni Flash Text, Bilder, Audio und Video als eine einzige, vereinheitlichte Eingabe und erzeugt daraus direkt ein Video – eine Fähigkeit, die als „Any-to-Any“ bezeichnet wird AAB. Das Modell generiert 3 bis 10 Sekunden lange 720p-Clips mit 24 Bildern pro Sekunde in den Seitenverhältnissen 16:9, 9:16 oder 1:1, inklusive synchronisiertem, nativem Ton, der im selben Durchlauf erzeugt wird HG.
Sie können dem Modell in einer einzigen Eingabeaufforderung bis zu sieben Referenzbilder, einen Videoclip und eine Textbeschreibung geben – alles wird zu einem kohärenten Ergebnis zusammengeführt BG. Ein Beispiel: Ein Nutzer könnte Produktfotos, ein Hintergrundvideo und eine Beschreibung liefern, und Omni Flash erstellt daraus einen kurzen Werbeclip.
Die herausragende Funktion ist die konversationelle Videobearbeitung, ermöglicht durch die Interactions API AA. Anstatt Clips in ein separates Bearbeitungstool exportieren zu müssen, können Nutzer die Ergebnisse durch natürliche Sprache schrittweise verfeinern – etwa Charaktere oder Produkte austauschen, den Stil übertragen, Objekte hinzufügen oder die Beleuchtung ändern –, während das Modell die Teile des Videos bewahrt, die der Nutzer behalten möchte AA. Jeder Schritt im Gespräch erzeugt ein neues Video, und das Modell versteht den Kontext aus vorherigen Schritten A.
Der API-Preis liegt bei 0,10 US-Dollar pro Sekunde generiertem Video, was 1 US-Dollar pro 10-Sekunden-Clip entspricht AH. Damit liegt Omni Flash preislich auf dem Niveau von Veo 3.1 Fast und positioniert sich als kostengünstigere, schnellere Alternative für Videoworkflows Y. Die Preise betragen zudem 1,50 US-Dollar pro Million Eingabe-Token und 17,50 US-Dollar pro Million Videoausgabe-Token H.
Für Verbraucher ist Gemini Omni Flash kostenlos auf YouTube Shorts für Nutzer ab 18 Jahren nutzbar AWN. Es ist auch in den Google-AI-Abonnement-Tarifen Plus, Pro und Ultra enthalten AG.
Die Begrenzung auf 10 Sekunden ist eine bewusste Produktentscheidung zum Start, wobei längere Laufzeiten für zukünftige Veröffentlichungen geplant sind HY. Google bezeichnet dies als verantwortungsvolle Ausrollstrategie, die Leistungsfähigkeit und Sicherheit in Einklang bringt T. Einige Beobachter vermuten, dass es sich eher um eine bereitstellungsseitige Einschränkung als um eine architekturbedingte Grenze des Modells handelt N.
Jeder mit Omni Flash erstellte oder bearbeitete Clip enthält ein unsichtbares digitales SynthID-Wasserzeichen YNN. Nutzer können KI-generierte Inhalte über die Gemini-App, Gemini im Chrome-Browser und die Google-Suche überprüfen, indem sie fragen: „Wurde dieses Video mit Google-KI erstellt?“ NB. Auf unterstützten Google-Oberflächen tragen die Inhalte zudem C2PA-Content-Credentials NC. Es gibt keinen API-Schalter, um die Wasserzeichen zu deaktivieren DG.
Am 1. Juli 2026 hat Adobe Gemini Omni Flash als Partnermodell in Adobe Firefly aufgenommen. Damit können Nutzer Videobearbeitung in einfacher Sprache über die gewohnte Firefly-Oberfläche und das dortige Credits-System durchführen D. Die Kosten betragen 30 Credits pro Sekunde Video D. Dies folgt einer umfassenderen Partnerschaft, die auf der Google I/O angekündigt wurde, um den Adobe-Connector zu Gemini zu bringen B. Nutzer finden das Modell im Auswahlmenü unter „Text zu Video“ A.
Parallel zu Omni Flash wurde Nano Banana 2 Lite (Modell-ID: gemini-3.1-flash-lite-image) veröffentlicht. Es ist das schnellste und günstigste Bildmodell der Nano-Banana-Familie von Google AA. Es generiert Bilder in unter 4 Sekunden zu einem Preis von unter 0,04 US-Dollar pro 1.000 Bildern BHB. Die allgemeine Verfügbarkeit wurde am 30. Juni 2026 auf Google Cloud bekannt gegeben; es ist in Google AI Studio, der Gemini-API und der Gemini Enterprise Agent Platform verfügbar HCB.
Auf der Google I/O 2026 präsentierte Google Omni Product Studio, eine Demo-App, die statische Produktbilder in kinoreife E-Commerce-Videos verwandelt – angetrieben von Gemini Omni Flash GC.
Die Bearbeitung hochgeladener Videos ist für Nutzer im Europäischen Wirtschaftsraum (EWR), in der Schweiz und im Vereinigten Königreich gesperrt A. In Community-Berichten wird auch von Sperren in Indien und einigen US-Bundesstaaten gesprochen A. Zudem bearbeitet das Modell zuverlässig nur selbst generierte Clips – und nicht beliebige, von Dritten hochgeladene Videos – als Sicherheitsmaßnahme gegen Deepfake-Missbrauch A. Die Funktionen zur Sprach- und Audio-Bearbeitung wurden zum Start bewusst zurückgehalten, ebenfalls aus Sorge vor Deepfakes TGL.
Studio Global AI
Diese Seite enthält eine quellengestützte Antwort, die Sie in Studio Global fortsetzen können.
Google Gemini Omni Flash ist das erste Modell der neuen Omni Familie von Google DeepMind, vorgestellt auf der Google I/O am 19.
Google Gemini Omni Flash ist das erste Modell der neuen Omni Familie von Google DeepMind, vorgestellt auf der Google I/O am 19. Das Modell verarbeitet Text, Bilder, Audio und Video als einheitliche Eingabe und erzeugt daraus 3–10 Sekunden lange 720p Videoclips mit synchronisiertem Ton.
Kernfunktion ist die konversationelle Videobearbeitung: Nutzer können erstellte Clips per Chat iterativ verfeinern – etwa Objekte tauschen oder den Stil ändern.