Mac-användare kan nu aktivera Geminis röstläge från vilket öppet fönster som helst genom att hålla ned Fn-tangenten . Funktionen erbjuder så kallad intelligent diktering: talet omvandlas till renare, färdigformulerad text där utfyllnadsord som ”eh” och ”um” tas bort. Gemini kan också ta hänsyn till rättelser som görs mitt i en mening . Texten skrivs sedan in där markören befinner sig .
Det stannar inte vid vanlig diktering. Markerad text kan omformuleras eller bearbetas, och Gemini kan skapa visuellt material direkt i det aktuella arbetsflödet . Med resonemangsläget aktiverat kan assistenten dessutom utföra mer avancerade uppgifter i flera steg genom röstkommandon .
Funktionen är inledningsvis endast tillgänglig på engelska, medan fler språk utlovas senare . Den bygger vidare på den inbyggda Gemini-appen för macOS som Google presenterade vid Google I/O 2026, med bland annat popupfältet Option + mellanslag och stöd för skärmdelning .
Den 21 juli lanserade Google tre modeller: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite och den mer begränsade säkerhetsmodellen Gemini 3.5 Flash Cyber . Den efterlängtade Gemini 3.5 Pro ingick däremot inte i lanseringen och är fortfarande inte släppt .
Gemini 3.6 Flash är tänkt att fungera som Googles allroundmodell för bland annat programmering, multimodala uppgifter och kunskapsarbete. Google uppger att modellen kan ge bättre resultat samtidigt som den använder upp till 17 procent färre tokens än föregångaren Gemini 3.5 Flash .
API-priset är 1,50 dollar per miljon inmatningstokens och 7,50 dollar per miljon utmatningstokens, vilket är lägre än föregångarens pris på 9 dollar för utmatning . Modellen har ett kontextfönster på en miljon tokens och ett kunskapsstopp i mars 2026 .
Gemini 3.6 Flash finns i Gemini API, Google AI Studio, Android Studio, Gemini-appen, Google Antigravity och Gemini Enterprise-appen .
Flash-Lite är byggd för uppgifter där låg svarstid och hög kapacitet är viktigare än maximal komplexitet – exempelvis agentbaserade sökningar och dokumenthantering . Google beskriver den som sin snabbaste och mest kostnadseffektiva modell i 3.5-familjen, med en angiven hastighet på 350 utmatningstokens per sekund .
Priset är 0,30 dollar per miljon inmatningstokens och 2,50 dollar per miljon utmatningstokens . Även denna modell har ett kontextfönster på en miljon tokens och rullas ut till Google Sök, utöver Gemini API och Gemini-appen .
Båda modellerna är tillgängliga direkt och kan användas kostnadsfritt i Gemini-appen .
Gemini Spark är Googles molnbaserade, agentbaserade assistent som kan fortsätta arbeta även när användaren har stängt datorn eller låst mobilen . Den visades först vid Google I/O 2026 och rullas nu ut till fler betalande användare .
Den nya versionen får bland annat följande funktioner:
Tillgången är fortfarande begränsad. I USA rullas Spark ut till Google AI Pro-prenumeranter för 20 dollar i månaden. Google AI Ultra-prenumeranter, vars abonnemang kostar omkring 100–200 dollar i månaden, får tillgång i fler länder där Gemini stöds . Gratiskonton omfattas inte .
Google anger dessutom Europeiska ekonomiska samarbetsområdet, Schweiz, Storbritannien och Nigeria som undantag . För svenska användare betyder det att Spark enligt den här utrullningen inte är tillgängligt i Sverige, trots beskrivningen av en global lansering.
Utöver Spark-specifika funktioner bygger Google ut Geminis bredare ekosystem av anslutna appar. Tanken är att Gemini ska kunna hämta information och utföra fler uppgifter i både Googles egna tjänster och utvalda tredjepartsappar .
I praktiken innebär det att Gemini stegvis går från att bara svara på frågor till att kunna arbeta med användarens dokument, anteckningar, uppgifter och externa tjänster – där respektive integration och behörighet avgör vad assistenten faktiskt får göra.
En ny avatarfunktion gör det möjligt att spara en personlig avatar och sedan använda den för att skapa bilder där användaren själv ingår . Det ska minska behovet av att ladda upp ett nytt foto varje gång en bild ska skapas.
Systemet genererar innehåll som visuellt utgår från den sparade avataren . Funktionen är ett steg mot mer återanvändbara personliga modeller för kreativt innehåll, snarare än enbart engångsbilder baserade på manuella uppladdningar.
Googles personliga bildskapande kombinerar bildmodellen Nano Banana med funktionerna i Personal Intelligence. Den 29 juni blev tjänsten gratis för alla berättigade användare i USA som är minst 18 år och inloggade med ett Google-konto . Tidigare var funktionen reserverad för abonnenter på Google AI Plus, Pro och Ultra.
Med användarens anslutna Google-tjänster kan Gemini hämta sammanhang från exempelvis Gmail, Google Foto, YouTube och Google Sök för att skapa bilder som bättre matchar personens intressen, livsstil och minnen . I stället för en lång och detaljerad instruktion kan användaren skriva något enkelt, som ”designa mitt drömhus” eller ”skapa en illustration av mig och mitt favoritdjur” .
Det är dock ett USA-erbjudande enligt Googles besked. Källorna anger inte att den kostnadsfria tillgången har utökats till Sverige, och funktionen bör därför inte beskrivas som global.
Gemini Drop i juli handlar mindre om en enda spektakulär modell och mer om att bygga ett sammanhängande ekosystem. Google kombinerar snabbare och billigare Flash-modeller med röstinmatning på Mac, automatisering i Workspace och verktyg som använder personliga bilder och kontakter.
För användaren är den stora förändringen att Gemini i allt högre grad ska kunna arbeta direkt i appar och tjänster – inte bara ge ett svar i en chatt. Samtidigt visar Spark-utrullningen och bildfunktionens USA-begränsning att tillgången fortfarande beror på abonnemang, region och språk.