Rapporter beskriver hvordan Google-ansatte prøver en intern Gemini 4-versjon med kodenavnet Carbon i selskapets kodeverktøy Jetski. Én tester skal ha sagt at koding med modellen «føles som Opus 5.5», Anthropic-modellen for langvarige, agentbaserte kodeoppgaver. Men dette er en tidlig erfaring, ikke resultatet av en offentlig sammenligning side om side.
29
25 I den tilgjengelige omtalen finnes det ingen bekreftet Carbon-benchmark eller offentlig lanseringsplan.
48
Dette skal ansatte ha sagt om Carbon
Business Insider meldte at ansatte hadde testet Carbon, med henvisning til interne dokumenter og skjermbilder.
29 Tilbakemeldingene skal ha vært positive. Én ansatt sammenlignet forsiktig kodingen med Claude Opus 5.5, men understreket også at modellen måtte testes mer.
29
25
Det er en viktig forskjell: En positiv, subjektiv opplevelse kan tyde på at en modellversjon er lovende. Den viser ikke hvordan modellen presterer på tvers av oppgaver, hvor stabil den er gjennom lange agentbaserte arbeidsløp, eller om den måler seg med en konkurrent under kontrollerte forhold. Den tilgjengelige omtalen inneholder ingen sammenlignende benchmark spesifikt for Carbon.
29
48
Rapporteringen avklarer heller ikke hva Google planlegger å gjøre med Carbon. Eventuelt produktnavn, forholdet til Argon og om modellen i det hele tatt blir lansert, er ikke bekreftet.
25
48
Hvordan Carbon henger sammen med Gemini 4 Argon
Kodenavnene viser til interne modellversjoner, ikke en bekreftet rekke med offentlige produkter. Ifølge Business Insider har Google testet Gemini 4-versjoner knyttet til navnene Argon, Barium og Carbon. En omtale basert på et internt dokument sier at Barium-B-versjonen ble valgt som modellen Google offentliggjorde under navnet Gemini 4 Argon.
25
Det sier ikke nøyaktig hvor Carbon passer inn. Carbon kan være et senere kontrollpunkt i utviklingen, eller en annen versjon i Gemini 4-familien. Rapporteringen bekrefter imidlertid ikke modellens presise slektslinje eller om den eventuelt vil bli lansert under Argon-navnet.
25
48
Google kunngjorde Gemini 4 Argon 30. september 2026. Den første utrullingen gikk til betrodde cybersikkerhetseksperter gjennom Fairwind-programmet.
36
4 Omtale 9. oktober beskrev fortsatt Argon som utilgjengelig for allmennheten. Betalende API-kunder og Google AI Ultra-abonnenter ble nevnt som grupper for en senere utvidelse – ikke som brukere med bekreftet, generell tilgang på det tidspunktet.
48
16
I lanseringsmaterialet oppgir Google en score på 77,9 prosent på DeepSWE v1.1 og at Argons grense for utdata-tokener er økt fra 64 000 til 1 million.
4 Dette gjelder Argon, ikke Carbon. Tredjepartsomtale oppga introduksjonspriser på 2 dollar per million inndata-tokener og 10 dollar per million utdatatokener. Det tilgjengelige materialet her inneholder imidlertid ingen offisiell prisliste.
5
Argons kodekritikk er en egen sak
Separat omtale av Argon beskrev et sprik mellom benchmarkresultater og enkelte ansattes erfaring med praktiske kodeoppgaver, blant annet arbeid med brukergrensesnitt. Google avviste framstillingen av Argon som svak på koding.
2
9 Uenigheten gjelder Argon og bør ikke leses som dokumentasjon på hvordan Carbon presterer.
En annen omtale forteller at tidlige interne Argon-versjoner minnet en ansatt om Anthropics eldre Opus 5 på enkelte kodeoppgaver, mens Carbon senere fikk den mer positive sammenligningen med Opus 5.5.
30 Begge deler er rapporterte inntrykk fra ansatte, ikke kontrollerte evalueringer. I sin offisielle kunngjøring beskriver Google Argon som en avansert modell for komplekse arbeidsløp som strekker seg over lang tid. Det bekrefter ikke i seg selv Carbon-påstanden.
36
Den forsiktige konklusjonen er at minst én rapportert tester synes Carbon virker lovende, mens ytelsen og produktstatusen fortsatt er uavklart. Inntil Carbon får egne testresultater – eller Google bekrefter en lansering – bør påstanden om at den matcher Claude Opus 5.5 forstås som foreløpig intern tilbakemelding, ikke en verifisert modellsammenligning.
25
29
48