Des employés de Google essaieraient en interne une version de Gemini 4 baptisée Carbon, dans l’environnement de programmation de l’entreprise, Jetski. Selon Business Insider, un testeur a estimé que son codage « fait penser à Opus 5.5 », le modèle d’Anthropic destiné notamment aux tâches de programmation menées sur la durée. Mais cette appréciation reste préliminaire : la personne a précisé qu’il fallait encore effectuer davantage de tests.
29
25
À ce stade, aucun résultat de benchmark comparant Carbon à Opus 5.5 n’a été publié, et aucun projet de sortie publique n’est confirmé.
48
Ce que les retours disent — et ne disent pas
Business Insider rapporte que des employés ont testé Carbon, en s’appuyant sur des documents internes et des captures d’écran.
29 Le commentaire sur Opus 5.5 est encourageant, mais il s’agit du ressenti d’un testeur, pas d’une évaluation contrôlée.
29
25
Une impression positive peut signaler qu’un modèle est prometteur. Elle ne permet pas, à elle seule, de savoir comment il se comporte sur différents types de tâches, s’il reste fiable au fil d’un long travail confié à un agent logiciel, ni s’il égale un modèle concurrent dans des conditions identiques. Les informations disponibles ne fournissent aucun benchmark comparatif propre à Carbon.
29
48
Le nom commercial éventuel de Carbon, son lien précis avec Argon et la possibilité même qu’il soit lancé restent également inconnus.
25
48
Carbon et Argon : des noms internes, pas une feuille de route confirmée
Les noms Argon, Barium et Carbon désignent des versions internes de Gemini 4 ; ils ne correspondent pas nécessairement à une succession de produits publics. Selon les informations rapportées par Business Insider, Google a testé des versions portant ces noms. Un document interne cité dans un compte rendu indique que la version Barium-B a été retenue pour le modèle présenté au public sous le nom de Gemini 4 Argon.
25
Cela ne suffit pas à établir la place exacte de Carbon dans cette famille. Il pourrait s’agir d’une version plus récente ou d’un autre point d’étape, mais les informations publiées ne confirment ni sa filiation précise ni le nom sous lequel il pourrait être proposé.
25
48
Google a annoncé Gemini 4 Argon le 30 septembre 2026, avec un déploiement initial auprès de spécialistes de la cybersécurité jugés fiables, dans le cadre du programme Fairwind.
36
4 Au 9 octobre, un compte rendu indiquait qu’Argon n’était toujours pas accessible au public. Les clients payants de l’API et les abonnés Google AI Ultra étaient présentés comme des groupes visés par une éventuelle extension de l’accès, et non comme bénéficiant déjà d’un accès général confirmé.
48
16
Pour Argon, Google a annoncé un score de 77,9 % à DeepSWE v1.1 et une limite de génération passant de 64 000 à 1 million de jetons.
4 Ces chiffres concernent Argon, pas Carbon. Des articles tiers ont aussi évoqué des tarifs de lancement de 2 dollars par million de jetons en entrée et de 10 dollars par million en sortie ; les informations disponibles ici ne comprennent toutefois pas de grille tarifaire officielle consultable.
5
Les réserves sur Argon ne prouvent rien sur Carbon
Des articles distincts sur Argon ont fait état d’un écart entre ses résultats aux benchmarks et l’expérience de certains employés sur des tâches de programmation concrètes, notamment en développement front-end. Google a contesté l’idée qu’Argon serait faible en programmation.
2
9 Ces réserves portent sur Argon : elles ne permettent pas de conclure quoi que ce soit sur Carbon.
Un autre compte rendu rapporte qu’une première version interne d’Argon avait rappelé à un employé l’ancien Opus 5 sur certaines tâches de codage, tandis que Carbon aurait suscité par la suite une comparaison plus flatteuse avec Opus 5.5.
30 Là encore, il s’agit de retours individuels, et non de résultats issus d’une comparaison contrôlée. Google présente officiellement Argon comme un modèle de pointe pour les tâches complexes et de longue durée, mais cette déclaration ne vérifie pas les performances attribuées à Carbon.
36
En bref : Carbon aurait fait bonne impression auprès d’au moins un testeur, mais ses performances et son avenir commercial ne sont pas établis. En l’absence de résultats portant sur Carbon lui-même ou d’annonce officielle, l’idée qu’il égale Claude Opus 5.5 doit être comprise comme un premier retour interne, pas comme une comparaison vérifiée.
25
29
48