Det tilgængelige materiale peger på problemer med modellens kvalitet og ydeevne i tidlige tests – ikke på problemer med sikkerhed eller infrastruktur . Google skal bruge den ekstra måned på at få mere feedback fra testbrugere og tilpasse modellen til konkrete forretningsscenarier
.
Ubekræftede opslag på sociale medier hævder, at nogle tidlige testere oplevede, at modellen blev “doven på svære opgaver”. De samme opslag peger på mulige forbedringer som et kontekstvindue på 2 millioner tokens og en såkaldt Deep Think-funktion til mere avanceret ræsonnering . Disse oplysninger bør dog læses som lækager og ikke som en fuld, officiel specifikation.
Pichais formulering ved I/O gjorde samtidig Googles tidsplan sårbar. Han sagde: “Jeg ved, at I ikke kan vente med at få fingrene i den. Giv os indtil næste måned, så får vi den ud til jer” . Der blev ikke givet nogen konkret forklaring på scenen på, hvorfor modellen ikke var klar
. Da juni-fristen senere gled uden en officiel forklaring, begyndte flere udviklere at omtale det som et brud på Googles løfte
.
Gemini 3.5 Flash blev gjort bredt tilgængelig den 19. maj 2026 – samme dag som den blev præsenteret . Det usædvanlige er, at modellen i Googles benchmark-materiale klarer sig bedre end Gemini 3.1 Pro på mange af de tests, udviklere bruger til at vurdere kodning, værktøjsbrug og AI-agenter.
Resultater, som Google har offentliggjort:
Google oplyser desuden, at Flash genererer output omkring fire gange hurtigere end andre frontlinjemodeller . API-prisen er oplyst til cirka 1,50 dollar for input og 9 dollar for output pr. million tokens, hvilket er omkring 40 procent billigere end Gemini 3.1 Pro på input-siden
.
Flash er dog ikke bedre til alt. På 11 af 15 offentliggjorte benchmarks slår den Gemini 3.1 Pro , men den halter efter på nogle tests af ren ræsonnering. På Humanity’s Last Exam scorer Flash 40,2 procent mod Pro-modellens 44,4 procent, mens den på ARC-AGI-2 får 72,1 procent mod 77,1 procent
.
Det betyder, at Flash især ser stærk ud til praktiske udvikleropgaver, agentforløb og værktøjsbrug – men ikke nødvendigvis er en direkte opgradering på alle former for abstrakt tænkning.
Kritikken af Google handler ikke kun om, at modellen er forsinket. Den handler i høj grad om kommunikationen omkring forsinkelsen.
Når Gemini 3.5 Pro lanceres, forventes den at lukke noget af det hul inden for ræsonnering, som Gemini 3.5 Flash stadig har. Google har knyttet modellen sammen med et kontekstvindue på 2 millioner tokens og en Deep Think-funktion til mere omfattende ræsonnering .
Den forventede pris ligger omkring 1,50 dollar for input og 9 dollar for output pr. million tokens, omtrent på niveau med Flash-prisen . Den endelige tilgængelighed, pris og specifikation kan dog først vurderes, når Google rent faktisk offentliggør modellen.
Forsinkelsen kan ende med at give Google et stærkere produkt. Men ved først at love “næste måned” og derefter være tavs, da tidsplanen skred, har selskabet samtidig forstærket frustrationen blandt udviklere.
Kort fortalt: Gemini 3.5 Pro er udskudt på grund af behov for bedre ydeevne og mere feedback fra tidlige testere. Indtil videre er det Gemini 3.5 Flash, der er Googles tilgængelige model i 3.5-serien – og den tilbyder allerede høj hastighed, lavere pris og bedre resultater end Gemini 3.1 Pro på flere af de benchmarks, der er relevante for praktisk udviklerarbejde .