Google çalışanlarının, şirket içinde Carbon kod adıyla anılan Gemini 4 sürümünü Google’ın Jetski kodlama ortamında denediği bildiriliyor. Test yapan çalışanlardan biri, kodlama deneyiminin Anthropic’in uzun süreli, ajan tabanlı kodlama görevleri için geliştirdiği Opus 5.5’e “benziyor” olduğunu söyledi. Ancak aynı çalışan daha fazla test yapılması gerektiğini de belirtti. Bu, yayımlanmış bir model karşılaştırması değil, erken aşamadaki kişisel bir izlenim.
29
25
Carbon’a özel doğrulanmış bir karşılaştırmalı test sonucu ya da kamuya açık bir çıkış planı bulunmuyor.
48
Carbon hakkında çalışanların söylediği
Business Insider, gördüğü şirket içi belgeler ve ekran görüntülerine dayanarak Google çalışanlarının Carbon’u denediğini aktardı.
29 Haberdeki geri bildirimler olumlu; çalışanlardan biri modelin kodlama becerisini Claude Opus 5.5’e benzetti, ancak değerlendirmesini kesinleştirmek için daha fazla test gerektiğini de ekledi.
29
25
Bu ayrım önemli. Bir modelin kod yazarken iyi bir izlenim bırakması, farklı görevlerde ne kadar başarılı olduğunu, uzun ve çok adımlı işlerde tutarlı çalışıp çalışmadığını ya da kontrollü koşullarda başka bir modelle aynı düzeyde olup olmadığını tek başına göstermez. Mevcut haberlerde Carbon’a özgü karşılaştırmalı bir kıyaslama testi yer almıyor.
29
48
Raporlar Carbon’un kamuya açık bir ürün olarak sunulacağını da doğrulamıyor. Modelin ileride hangi adla çıkacağı, Argon’la nasıl bir ilişkisi olduğu ve yayımlanıp yayımlanmayacağı belirsizliğini koruyor.
25
48
Carbon, Gemini 4 Argon’un neresinde?
Argon, Barium ve Carbon adları şirket içindeki model sürümleri için kullanılan kod adları. Bunların kamuya sunulmuş ürünlerin doğrulanmış bir sıralaması olduğu söylenemez. Business Insider’ın haberine göre Google, bu kod adlarıyla anılan Gemini 4 sürümlerini test etti. Dahili bir belgeye dayandırılan haberde, Barium-B adlı yapının kamuya Gemini 4 Argon adıyla duyurulan model için seçildiği belirtiliyor.
25
Bu bilgi, Carbon’un serideki kesin yerini açıklamıyor. Carbon daha sonraki bir model kontrol noktası veya Gemini 4 ailesindeki başka bir sürüm olabilir; ancak haberler modelin tam olarak nasıl geliştirildiğini ya da Argon adıyla yayımlanıp yayımlanmayacağını doğrulamıyor.
25
48
Google, Gemini 4 Argon’u 30 Eylül 2026’da duyurdu ve ilk erişimi Fairwind Programı aracılığıyla güvenilir siber güvenlik uzmanlarıyla sınırlı tuttu.
36
4 9 Ekim tarihli haberlerde Argon’un hâlâ genel kullanıma açılmadığı belirtiliyordu. Ücretli API müşterileri ile Google AI Ultra aboneleri, daha geniş erişim için planlanan gruplar olarak anıldı; ancak bu, o tarihte bu grupların modele genel erişimi olduğu anlamına gelmiyordu.
48
16
Google’ın duyuru materyallerinde Argon için DeepSWE v1.1 testinde yüzde 77,9 sonucu ve çıktı belirteci sınırının 64 binden 1 milyona çıkarıldığı bilgisi yer alıyor.
4 Bunlar Argon’a ait veriler; Carbon’un performansını göstermiyor. Üçüncü taraf haberlerde başlangıç API fiyatı, milyon girdi belirteci başına 2 dolar ve milyon çıktı belirteci başına 10 dolar olarak aktarılmıştı; ancak burada sunulan kaynaklarda resmî bir fiyat tarifesi bulunmuyor.
5
Argon hakkındaki kodlama tartışması Carbon’dan ayrı
Argon’la ilgili başka haberlerde, kıyaslama sonuçlarıyla çalışanların günlük kodlama görevlerindeki deneyimleri arasında fark olduğu öne sürüldü. Bu eleştiriler arasında arayüz geliştirme işleri de vardı. Google ise Argon’un kodlama performansının zayıf olduğu yönündeki nitelemeye itiraz etti.
2
9 Bu tartışma Argon’la ilgili; Carbon’un performansına kanıt olarak kullanılamaz.
Başka bir haberde, Argon’un ilk şirket içi sürümlerini deneyen bir çalışanın bazı kodlama görevlerinde modeli Anthropic’in daha eski Opus 5’iyle karşılaştırdığı aktarılıyor. Carbon içinse daha sonra Opus 5.5 benzetmesi yapıldı.
30 Her iki değerlendirme de kontrollü testlerin sonucu değil, çalışanların aktarılan izlenimleri. Google’ın resmî duyurusu Argon’u karmaşık ve uzun soluklu iş akışları için bir öncü model olarak tanımlıyor; bu iddia da Carbon hakkındaki performans yorumunu bağımsız biçimde doğrulamıyor.
36
En temkinli sonuç şu: Carbon en az bir çalışanda olumlu bir izlenim bırakmış olabilir; ancak performansı ve ürün olarak geleceği hâlâ belirsiz. Carbon’a ait test sonuçları ya da doğrulanmış bir çıkış açıklaması gelene kadar, modelin Claude Opus 5.5 seviyesinde olduğu iddiasını kanıtlanmış bir karşılaştırma değil, ön değerlendirme olarak görmek gerekir.
25
29
48