Zaměstnanci Googlu údajně zkoušejí interní verzi Gemini 4 s kódovým označením Carbon v nástroji pro programování Jetski. Jeden z testerů popsal její schopnosti při psaní kódu slovy, že „působí jako Opus 5.5“ od Anthropic. Zároveň ale upozornil, že je potřeba další testování.
29
25
Zatím tedy nejde o potvrzený výsledek přímého srovnání. Ve zveřejněných informacích nejsou benchmarky pro Carbon ani potvrzený plán jeho uvedení.
48
Co se o Carbonu ví
Business Insider uvedl, že zaměstnanci Googlu zkoušeli Carbon na základě interních dokumentů a snímků obrazovky, které redakce viděla.
29 Jeden z nich přirovnal jeho programování k Opus 5.5 — modelu Anthropic určenému mimo jiné pro dlouhé, vícekrokové programátorské úlohy, v nichž AI agent samostatně pracuje na kódu.
29
25
Taková zkušenost může naznačovat, že testovaná verze působí slibně. Sama o sobě ale neříká, jak si vede napříč různými úlohami, jak spolehlivě pracuje delší dobu ani jak by dopadla ve férovém testu proti konkurenčním modelům. Dostupné zprávy žádný srovnávací benchmark Carbonu neuvádějí.
29
48
Nejasné zůstává i to, co s modelem Google zamýšlí. Není potvrzené, zda Carbon vyjde, jak se bude jmenovat ani jak přesně navazuje na Argon.
25
48
Jak Carbon souvisí s Gemini 4 Argon
Argon, Barium a Carbon jsou podle zpráv interní označení různých verzí Gemini 4, nikoli potvrzené názvy produktů, které Google postupně vydá. Podle interního dokumentu citovaného Business Insiderem byla pro veřejně oznámený Gemini 4 Argon vybrána verze označená Barium-B.
25
To však neobjasňuje, jak přesně do řady zapadá Carbon. Může jít o novější verzi či další vývojovou větev, ale dostupné zprávy nepotvrzují jeho přesný původ ani to, zda by případně vyšel pod názvem Argon.
25
48
Google oznámil Gemini 4 Argon 30. září 2026 a začal jej zpřístupňovat důvěryhodným odborníkům na kybernetickou bezpečnost prostřednictvím programu Fairwind.
36
4 Ještě 9. října zprávy uváděly, že Argon není veřejně dostupný. Platící zákazníci API a předplatitelé Google AI Ultra byli zmiňováni jako skupiny, kterým se má přístup rozšířit později, nikoli jako uživatelé s potvrzeným běžným přístupem.
48
16
Google u Argonu uvádí výsledek 77,9 % v testu DeepSWE v1.1 a zvýšení limitu výstupu z 64 000 na jeden milion tokenů.
4 Jde o údaje pro Argon — o výkonu Carbonu nic nevypovídají.
Ohlasy na Argon nejsou důkazem o Carbonu
Samostatné zprávy o Argonu popisovaly rozdíl mezi výsledky v benchmarkových testech a zkušenostmi některých zaměstnanců s praktickým programováním, včetně tvorby uživatelských rozhraní. Google se ohradil proti tvrzení, že Argon v programování zaostává.
2
9 Tato debata se týká Argonu, ne Carbonu.
Jiná zpráva uvádí, že některé rané interní verze Argonu připomínaly jednomu zaměstnanci při určitých programátorských úlohách starší model Opus 5. Carbon později získal příznivější srovnání s Opus 5.5.
30 V obou případech jde o osobní dojmy zaměstnanců, nikoli o kontrolované testy. Google Argon oficiálně popisuje jako model pro složité a dlouhodobé úkoly; toto tvrzení však samo o sobě nepotvrzuje výkon Carbonu.
36
Opatrný závěr je proto jednoduchý: Carbon na jednoho z testerů zapůsobil, jeho skutečný výkon i budoucnost ale zůstávají neznámé. Dokud nebudou k dispozici výsledky testů přímo pro Carbon nebo potvrzené plány na jeho vydání, srovnání s Claude Opus 5.5 je třeba chápat jako předběžnou interní reakci, ne jako ověřený verdikt.
25
29
48