Die Funktion soll nicht einfach jedes gesprochene Wort ungefiltert abschreiben. Gemini entfernt Füllwörter wie „ähm“ und „äh“ und berücksichtigt Korrekturen, die während des Sprechens gemacht werden . So soll aus spontaner Sprache direkt ein sauber formulierter Text entstehen.
Darüber hinaus kann Gemini markierte Inhalte umformulieren oder an der Cursorposition Bilder erzeugen . Ist der Denkmodus aktiviert, soll der Assistent auch komplexe Aufgaben mit mehreren Schritten per Sprache ausführen können . Zum Start ist die intelligente Diktierfunktion nur auf Englisch verfügbar; weitere Sprachen sollen folgen .
Die Neuerung baut auf der nativen Gemini-App für macOS auf, die Google erstmals auf der Entwicklerkonferenz I/O 2026 vorgestellt hatte. Zu deren bisherigen Funktionen gehörten unter anderem eine Chatleiste per Option + Leertaste und die Möglichkeit, den Bildschirm zu teilen .
Am 21. Juli 2026 veröffentlichte Google drei neue Modelle: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite und das sicherheitsorientierte Gemini 3.5 Flash Cyber . Auffällig ist, was fehlt: Das lange erwartete Gemini 3.5 Pro wurde weiterhin nicht veröffentlicht .
Gemini 3.6 Flash ist als vielseitiges Arbeitsmodell für Programmierung, multimodale Aufgaben und Wissensarbeit gedacht. Google zufolge benötigt es dabei bis zu 17 Prozent weniger Token als Gemini 3.5 Flash .
Für die API verlangt Google 1,50 US-Dollar pro Million Eingabe-Token und 7,50 US-Dollar pro Million Ausgabe-Token. Der Preis für die Ausgabe liegt damit unter den 9,00 US-Dollar der vorherigen Generation . Das Modell verfügt über ein Kontextfenster von 1 Million Token und einen Wissensstand bis März 2026 .
Verfügbar ist Gemini 3.6 Flash unter anderem über die Gemini API, Google AI Studio, Android Studio, die Gemini-App, Google Antigravity und die Gemini Enterprise-App .
Flash-Lite richtet sich an Aufgaben, bei denen eine kurze Antwortzeit und niedrige Kosten wichtiger sind als maximale Modellleistung. Google nennt etwa agentische Suche und die Verarbeitung großer Dokumentmengen .
Mit bis zu 350 ausgegebenen Token pro Sekunde soll es Googles schnellstes und kostengünstigstes Modell der 3.5-Klasse sein . Der API-Preis beträgt 0,30 US-Dollar pro Million Eingabe-Token und 2,50 US-Dollar pro Million Ausgabe-Token . Auch Flash-Lite bietet ein Kontextfenster von 1 Million Token und wird neben der API und der Gemini-App schrittweise in die Google-Suche integriert .
Beide Modelle sind ab sofort verfügbar und können in der Gemini-App kostenlos genutzt werden .
Gemini Spark ist Googles cloudbasierter, agentischer Assistent. Er wurde erstmals auf der I/O 2026 gezeigt und soll Aufgaben selbstständig im Hintergrund erledigen – auch dann, wenn der Laptop geschlossen oder das Smartphone gesperrt ist . Im Rahmen des Juli-Updates wird Spark für weitere Abonnenten und in mehr Ländern freigeschaltet .
Der weltweite Rollout ist allerdings nicht uneingeschränkt: Spark steht weiterhin nicht für kostenlose Konten bereit. In den USA erhalten Google-AI-Pro-Abonnenten für 20 US-Dollar pro Monat Zugang; Google-AI-Ultra-Abonnenten können Spark in unterstützten Ländern nutzen. Ausgenommen sind unter anderem der Europäische Wirtschaftsraum, die Schweiz, das Vereinigte Königreich und Nigeria .
Die wichtigsten Erweiterungen:
Gerade die Chrome-Integration macht Spark leistungsfähiger, erhöht aber auch die Bedeutung von Berechtigungen. Der Assistent kann nur dann auf angemeldete Dienste oder gespeicherte Zugangsdaten zugreifen, wenn der Nutzer dies erlaubt .
Neben den Workspace-Funktionen von Spark erweitert Google das gesamte Gemini-Ökosystem um zusätzliche App-Verbindungen .
Spark unterstützt nun schrittweise Canva, Instacart und OpenTable als verbundene Drittanbieter-Apps . Außerdem kann der Agent Inhalte aus Google Keep und Google Tasks lesen und bearbeiten . Eigene Verbindungen zu persönlichen oder anderen Drittanbieter-Apps lassen sich über Server des Model Context Protocol (MCP) einrichten .
Damit wird Gemini zunehmend zu einer Schnittstelle zwischen verschiedenen Diensten – und nicht nur zu einem Werkzeug für Fragen und Antworten.
Eine neue Avatar-Funktion soll es ermöglichen, sich selbst in beliebige KI-Bilder einzufügen. Dafür wird einmal ein persönlicher Avatar gespeichert; bei späteren Bildanfragen muss nicht jedes Mal erneut ein Foto hochgeladen werden .
Gemini erzeugt anschließend Inhalte, in denen die Person auf Grundlage dieses gespeicherten Avatars visuell berücksichtigt wird .
Die personalisierte Bildgenerierung mit Googles Bildmodell Nano Banana und den Funktionen von Personal Intelligence ist inzwischen für alle berechtigten Nutzer in den USA kostenlos verfügbar. Voraussetzung sind ein Alter von mindestens 18 Jahren und ein angemeldetes persönliches Google-Konto .
Zuvor war die Funktion den Google-AI-Plus-, -Pro- und -Ultra-Tarifen vorbehalten . Mit aktivierten Verbindungen kann Gemini unter anderem Informationen aus Gmail, Google Fotos, YouTube und der Google-Suche nutzen, um Bilder stärker an den Interessen, dem Alltag und persönlichen Erinnerungen des Nutzers auszurichten .
Statt eine lange Beschreibung zu verfassen, soll beispielsweise eine kurze Anweisung wie „Entwirf mein Traumhaus“ genügen. Auch ein Bild von „mir und meinem Lieblingstier“ kann erstellt werden, ohne jedes Mal manuell passende Fotos hochzuladen . Die kostenlose Freischaltung gilt nach den vorliegenden Angaben zunächst für berechtigte Nutzer in den USA – nicht automatisch für alle Gemini-Nutzer weltweit.
Die sechs Updates verfolgen eine gemeinsame Linie: Gemini soll weniger wie ein einzelner Chatbot und mehr wie eine dauerhaft verfügbare Arbeitsebene funktionieren. Auf dem Mac wird Sprache direkt in andere Apps gebracht, Spark übernimmt Aufgaben im Hintergrund, und die neuen Modelle senken die Kosten für schnelle, umfangreiche KI-Prozesse.
Für Nutzer bedeutet das mehr Komfort, aber auch mehr Aufmerksamkeit bei Zugriffsrechten und persönlichen Daten. Besonders bei Chrome, Gmail, Google Fotos und anderen verbundenen Diensten entscheidet die jeweilige Freigabe darüber, wie weit Gemini tatsächlich in den eigenen digitalen Alltag eingreifen kann.