Det er samtidig viktig å skille mellom bekreftede opplysninger og spekulasjoner. Innlegg i sosiale medier hevder at tidlige testere opplevde at modellen ble «lat på vanskelige oppgaver», og at Google derfor vurderer forbedringer som et kontekstvindu på 2 millioner token og en egen Deep Think-modus . Disse opplysningene er ikke fullt ut bekreftet av Google.
Pichais formulering på I/O skapte dessuten en tydelig forventning. «Jeg vet at dere gleder dere til å få prøve den. Gi oss til neste måned, så får dere den», sa han fra scenen . Da juni-målet senere glapp uten en tydelig offentlig forklaring, ble inntrykket for mange utviklere at Google hadde brutt et løfte
.
Mens Pro-modellen lar vente på seg, ble Gemini 3.5 Flash lansert som planlagt 19. mai 2026. Den ble gjort allment tilgjengelig samme dag gjennom Googles utvikler- og forbrukertjenester .
Det mest oppsiktsvekkende er at Flash-modellen på flere områder allerede presterer bedre enn den eldre Gemini 3.1 Pro. Ifølge Googles publiserte tall fikk modellene følgende resultater:
Google hevder også at Gemini 3.5 Flash produserer svar rundt fire ganger raskere enn andre ledende modeller, målt i antall genererte token per sekund . API-prisen er oppgitt til omtrent 1,50 dollar per million input-token og 9 dollar per million output-token. Det gjør modellen rundt 25–40 prosent billigere per token enn Pro-nivået, avhengig av sammenligningsgrunnlag
.
På 11 av 15 publiserte benchmarker slår Gemini 3.5 Flash Gemini 3.1 Pro . Men Flash er ikke en ubetinget oppgradering. Den ligger fortsatt bak Pro på tester som i større grad måler ren resonnering, blant annet Humanity’s Last Exam, der resultatene er 40,2 mot 44,4 prosent, og ARC-AGI-2, der Flash får 72,1 mot 77,1 prosent
.
For utviklere som bygger kodeverktøy og AI-agenter, er likevel budskapet tydelig: Den rimeligere Flash-modellen kan være et mer praktisk valg enn den eldre Pro-modellen når hastighet, verktøybruk og kostnad er viktigst.
Reaksjonene handler ikke bare om at lanseringen er utsatt. Mange utviklere reagerer vel så sterkt på hvordan Google har kommunisert rundt forsinkelsen.
Kontrasten blir tydeligere fordi OpenAI og Anthropic fortsetter å lansere og oppdatere modeller, blant annet GPT-5.5 og Claude Sonnet 4.6 og Opus 4.7 . Når konkurrentene leverer jevnt, blir en offentlig lovnad om «neste måned» mer krevende å trekke tilbake uten forklaring.
Når Gemini 3.5 Pro lanseres, er forventningen at den skal tette noe av avstanden Flash fortsatt har på krevende resonneringsoppgaver. Google har varslet et kontekstvindu på 2 millioner token, som vil gjøre det mulig å arbeide med svært store mengder tekst eller kode i én og samme samtale, samt en Deep Think-modus for mer omfattende resonnering .
Den forventede prisen ligger rundt 1,50 dollar per million input-token og 9 dollar per million output-token, omtrent på nivå med Flash-prisen som er rapportert . Google har imidlertid ikke offentliggjort en endelig lanseringsdato eller bekreftet alle detaljer.
Forsinkelsen ser ifølge rapportene ut til å skyldes behov for bedre ytelse og mer tilbakemelding fra tidlige testere. Det er ikke dokumentert at sikkerhet eller infrastruktur er årsaken, selv om enkelte kilder og brukere har spekulert i dette .
For Google kan ekstra testing gi en sterkere Pro-modell. Men ved å love lansering «neste måned» og deretter kommunisere lite da tidsplanen sprakk, har selskapet samtidig svekket tilliten hos utviklere.
I mellomtiden er Gemini 3.5 Flash den mest konkrete nyheten. Den er tilgjengelig nå, går betydelig raskere og slår Gemini 3.1 Pro på mange av benchmarkene som er mest relevante for koding, verktøybruk og agentbaserte arbeidsflyter .