Gemini 4 Argon får två olika omdömen. Google pekar på starka resultat i flera benchmarktester, medan vissa medarbetare uppges tycka att modellen är mindre pålitlig när de använder den för verkligt kodarbete. Uppgifterna visar på olika erfarenheter – inte på någon intern enighet om att Gemini 4 ligger efter konkurrenterna.
11
Varför testresultaten inte avgör allt
Google uppger att Gemini 4 presterat starkt i flera tester, bland annat ett säkerhetstest där modellen slog OpenAI:s Astra. Samtidigt säger personer med insyn i Googles interna utvärderingar att modellen inte alltid imponerar i praktiska koduppgifter, däribland frontendutveckling.
11
14
Det ena behöver inte kullkasta det andra. Benchmarktester mäter resultat i utvalda uppgifter, men säger inte nödvändigtvis allt om hur användbar eller konsekvent en modell är i det dagliga utvecklingsarbetet. Medarbetarnas uppgifter är inte heller i sig ett slutgiltigt mått på modellens förmåga.
Google invänder – och medarbetarna tycker olika
Google säger att det vore missvisande att beskriva Gemini 4 som svag inom kodning och hänvisar till modellens benchmarkresultat. Men de uppgifter som rapporterats om interna reaktioner visar inte heller någon enhetlig bild: vissa medarbetare uppges anse att Anthropic-modellen Fable och OpenAI:s Astra utvecklas snabbare, medan andra tycker att Gemini 4 har kommit ikapp de ledande modellerna.
11
12
13
Det gör det för tidigt att se vare sig den interna kritiken eller Googles testresultat som hela svaret på hur bra Gemini 4 är.
Den nedlagda Gemini 3.5 Pro-planen ger bakgrund
Google hade planerat att släppa Gemini 3.5 Pro i juni 2026, men övergav den versionen och gick vidare till Gemini 4, enligt rapporteringen. Det ger sammanhang åt frågorna om bolagets utvecklings- och lanseringstakt. Däremot förklarar det inte i sig de rapporterade problemen med kodning eller visar att Gemini 4 är sämre än konkurrenterna.
6
13
Därför följde investerarna nyheten
Efter rapporteringen krympte Alphabet-aktiens tidigare uppgång på mer än 2 procent. Aktien avslutade den rapporterade onsdagshandeln upp omkring 0,5 procent. Kursrörelsen sammanföll med nyheten, men bevisar varken att medarbetarnas invändningar stämmer eller att det var de som orsakade förändringen.
1
14
Den större frågan för investerare är om Google kan konkurrera med OpenAI och Anthropic inom avancerade AI-modeller. Gemini 4 är en del av den kapplöpningen, men rapporteringen pekar inte ut några konkreta effekter på enskilda Google-produkter. Eventuella följder bredare än själva modellsläppet är därför fortfarande en fråga – inte ett fastslaget resultat.
10