Een medewerker van Google zou het programmeren met een interne versie van Gemini 4, met de codenaam Carbon, hebben omschreven als «alsof je met Opus 5.5 werkt». Dat is een opvallend compliment: Claude Opus 5.5 is een model van Anthropic dat wordt ingezet voor langdurige, agentische programmeertaken — werk waarbij een AI-assistent meerdere stappen zelfstandig uitvoert.
29
25
Maar het blijft een eerste indruk van één tester. Die zei ook dat er meer tests nodig waren. Er is geen gepubliceerde, gecontroleerde vergelijking die aantoont dat Carbon op hetzelfde niveau presteert.
29
25
48
Wat is er over Carbon bekend?
Business Insider meldde, op basis van interne documenten en screenshots, dat Google-medewerkers Carbon uitproberen in Jetski, de interne programmeeromgeving van het bedrijf.
29 De feedback die in de berichtgeving naar voren komt, is positief. Toch zegt die weinig over prestaties bij uiteenlopende programmeertaken, de betrouwbaarheid tijdens lange workflows of hoe Carbon het doet onder dezelfde testomstandigheden als een concurrerend model.
Voor Carbon zelf zijn geen vergelijkende benchmarkresultaten bekend. Ook heeft Google geen openbare releasedatum of productnaam bevestigd. Het is dus nog onduidelijk of Carbon überhaupt wordt uitgebracht, en zo ja, onder welke naam.
29
48
Hoe verhoudt Carbon zich tot Gemini 4 Argon?
Argon, Barium en Carbon zijn interne codenamen voor versies van Gemini 4; ze vormen niet automatisch een reeks aangekondigde consumentenproducten. Volgens de berichtgeving testte Google verschillende Gemini 4-versies. Een intern document zou aangeven dat de versie met de codenaam Barium-B werd geselecteerd voor het model dat publiek werd aangekondigd als Gemini 4 Argon.
25
Wat Carbon precies in die reeks betekent, is niet bevestigd. Het kan om een nieuwere versie of een ander controlepunt in de modelontwikkeling gaan, maar uit de berichtgeving blijkt niet of Carbon voortbouwt op Argon, onder die naam wordt uitgebracht of een eigen productnaam krijgt.
25
48
Google kondigde Gemini 4 Argon aan op 30 september 2026. De eerste toegang ging naar een groep vertrouwde cyberbeveiligingsexperts via het Fairwind-programma.
36
4 Volgens berichtgeving was Argon op 9 oktober nog niet algemeen beschikbaar. Betalende API-klanten en abonnees van Google AI Ultra werden genoemd als groepen voor een mogelijke latere uitbreiding, niet als gebruikers met toen al bevestigde brede toegang.
48
16
Google meldde voor Argon een score van 77,9% op DeepSWE v1.1. Ook werd de maximale uitvoerlengte verhoogd van 64.000 naar 1 miljoen tokens.
4 Dat zijn gegevens over Argon, niet over Carbon. Een externe publicatie noemde introductietarieven van $2 per miljoen invoertokens en $10 per miljoen uitvoertokens; het beschikbare materiaal bevat daarvoor geen rechtstreeks bevestigde officiële prijslijst.
5
Argons programmeerdiscussie is geen bewijs over Carbon
Los van de Carbon-test ontstond discussie over Gemini 4 Argon. Sommige medewerkers zouden twijfels hebben geuit over hoe goed Argon presteert bij praktisch programmeerwerk, waaronder het bouwen van interfaces. Google betwistte de voorstelling dat Argon zwak zou zijn in programmeren.
2
9 Die berichten gaan over Argon en zeggen op zichzelf niets over Carbon.
In een afzonderlijk verslag werd een vroege versie van Argon door een medewerker vergeleken met het oudere Claude Opus 5 bij bepaalde programmeertaken. De latere vergelijking van Carbon met Opus 5.5 is eveneens een gemelde indruk van een medewerker, geen gecontroleerde beoordeling.
30 Google omschrijft Argon in de officiële aankondiging als een model voor complexe workflows die lang doorlopen; dat is geen onafhankelijke bevestiging van Carbon-prestaties.
36
De voorzichtige conclusie: Carbon maakt volgens ten minste één tester een veelbelovende indruk, maar er is nog geen bewijs dat het Claude Opus 5.5 evenaart. Zonder benchmarks voor Carbon of een bevestigde release blijft die vergelijking voorlopige interne feedback.
25
29
48