Buna karşılık Google, 13 Ağustos'ta piyasaya sürdüğü Gemini 3.7 Flash için tanıtım amaçlı bir fiyat belirledi: milyon giriş tokeni için 0.75 dolar, milyon çıkış tokeni için 3.75 dolar. Bu, bir önceki nesil Gemini 3.6 Flash'ın yarısı ve Grok 4.6'nın yaklaşık üçte biriydi . Google'ın bu tanıtım fiyatı 31 Aralık 2026'ya kadar geçerli olacak, sonrasında iki katına çıkacak
.
Fiyatlandırmadaki bu keskin zıtlık ortada: Grok 4.6, zeka seviyesi olarak GPT-5.6 Sol ve Claude Opus 5 gibi öncü modellerle rekabet ederken; Gemini 3.7 Flash, Claude Sonnet 5 ve GPT-5.6 Terra'ya denk bir performansı çok daha düşük bir maliyetle sunarak "iş atı" (workhorse) kategorisinde konumlanıyor .
Grok 4.6, dokuz farklı değerlendirmenin birleşiminden oluşan Artificial Analysis (AA) Intelligence Index'te 61 puan aldı . Bu skor, onu GPT-5.6 Sol Max ile eşitliyor, Claude Fable 5 Max'in bir (62), Claude Opus 5 Max'in ise iki puan (63) gerisine düşürüyordu. Bu, bir xAI modelinin ilk kez bu öncüler kulübüne (frontier cluster) girmesi anlamına geliyordu
.
| Kıyaslama | Grok 4.6 (Yüksek) | Grok 4.5 (Yüksek) | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 (Elo) | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | %69.9 | %66.7 | %67.2 | %70.5 |
| AA-Briefcase | 1577 | — | — | — |
SpaceXAI, Grok 4.6'nın CursorBench, FrontierCode, APEX-Agents ve Terminal-Bench dahil listelenen her değerlendirmede Grok 4.5'e göre iyileşme kaydettiğini bildirdi . Artificial Analysis'ın bağımsız testleri de bu iddiaları 0.08 puanlık ihmal edilebilir bir farkla doğruladı
.
Özellikle dikkat çekici olan, Grok 4.6'nın bilgi işi değerlendirmelerindeki üstünlüğüydü. GDPval-AA v2 (1753 Elo), AA-Briefcase (1577) ve Harvey hukuk kıyaslamasında tüm rakiplerini geride bırakan model, profesyonel bilgi işleri için biçilmiş kaftan gibi görünüyordu . Ancak, bir ajan kodlama modeli olarak pazarlanmasına rağmen, CursorBench v3.2 puanı (%69.9) Fable 5 Max'in (%70.5) gerisinde kaldı; yine de GPT-5.6 Sol Max'i (%67.2) geçmeyi başardı
.
Gemini 3.7 Flash ise kodlama ve ajan kıyaslamalarında güçlü artışlar kaydetti. FrontierCode v1.1'de üretime hazır kod üretiminde %34.4'ten %43.6'ya yükselerek Claude Sonnet 5 (%42.7) ve GPT-5.6 Terra'nın (%41.3) önüne geçti . DeepSWE v1.1 (%49.0'dan %65.3'e) ve AutomationBench (%17.0'dan %30.4'e) gibi testlerde de büyük sıçramalar yaptı
.
Grok 4.6'ya eklenen en büyük mimari özellik, en zorlu ajan ve kodlama görevleri için tasarlanmış yeni bir xhigh akıl yürütme seviyesiydi . Model, uzun süreli ajan dayanıklılığı için optimize edildi. SpaceXAI'nin iddiasına göre Grok 4.6, Claude Opus 5'in ihtiyaç duyduğu adımların yaklaşık yarısında, yani girdi tokenlerinin yaklaşık dörtte biri kadarını kullanarak görevleri tamamlıyor
. Bu verimlilik avantajı, özellikle saatler süren kodlama oturumları düzenleyen geliştiriciler için güçlü bir satış noktası
.
SpaceXAI, Grok 4.6'daki bu kazanımları, parametre sayısını artırmaya değil, daha uzun bir ek eğitim (supplemental training) ve önemli ölçüde iyileştirilmiş denetimli ince ayar (supervised fine-tuning) ile pekiştirmeli öğrenmeye (reinforcement learning) bağlıyor . Model, Grok 4.5 ile aynı 1.5 trilyon parametreli V9 temelini kullanıyor
.
Gemini 3.7 Flash ise kalite, maliyet ve gecikme arasında denge kurmak için "özelleştirilebilir düşünme yapılandırmaları" sunuyor ve ajan tipi video işlemeyi mümkün kılan ilk Google modeli olma özelliğini taşıyor .
Grok 4.6'nın Güçlü Yönleri:
Grok 4.6'nın Zayıf Yönleri:
Lansmandan iki gün sonra, 14 Ağustos 2026'da, Grok 4.6, GitHub Copilot'a entegre edildi ve tüm büyük geliştirme platformlarında kullanıma sunuldu :
GitHub'ın resmi değişiklik günlüğü (changelog), modeli "ajan tipi kodlama ve karmaşık çok adımlı iş akışları için tasarlandı" şeklinde tanımladı . Bu hızlı entegrasyon, geliştirici platformlarının modele olan yoğun talebini gözler önüne serdi .
12-13 Ağustos'taki bu peş peşe lansmanlar, iki farklı rekabet stratejisini net bir şekilde ortaya koyuyor:
Grok 4.6 (SpaceXAI) — MTok başına 2/6 dolar — Öncü bileşik puan (AA Index 61) — 500K bağlam — Ajan kodlama ve bilgi işi için tasarlandı — Opus 5'e karşı görev verimliliği avantajı
Gemini 3.7 Flash (Google) — MTok başına 0.75/3.75 dolar (tanıtım fiyatı) — Claude Sonnet 5 ve GPT-5.6 Terra'ya denk iş atı performansı — 1M bağlam penceresi — Ajan tipi video işleme özelliği bulunan ilk Gemini modeli — Gemini Spark'ı çalıştırıyor
Grok 4.6, öncü seviye zekayı indirimli bir fiyata sunarak rekabet ederken; Gemini 3.7 Flash, iş atı kategorisinde fiyat avantajıyla öne çıkıyor. Google'ın amiral gemisi modeli Pro'nun çıkış tarihini açıklamaması , şirketin kasıtlı olarak iş atı seviyesinde pazar payı kapmaya odaklandığını gösteriyor.
Grok 4.6, SpaceXAI'yi öncü seviyeye başarıyla geri döndürdü. GPT-5.6 Sol'a denk bir bileşik zeka puanı alırken, maliyet avantajı ve ajan görevlerindeki verimliliğiyle dikkat çekti. Tek bir kodlama kıyaslamasında lider olamaması, Claude Opus 5'in gerisinde kalması ve fiyat indirimine gitmemesi gibi zayıf yönleri olsa da, bu başarısını gölgelemiyor.
Google'ın sadece 24 saat sonra gelen cevabı ise tüm fiyatlandırma tartışmasını yeniden şekillendirdi. Yaklaşık Grok 4.6'nın üçte biri fiyatına sunulan Gemini 3.7 Flash, güçlü kodlama ve ajan performansını 1M tokenlik bağlam penceresiyle birleştirdi. Rekabet artık net bir şekilde iki kutuplu hale geldi: bir tarafta indirimli öncü zeka (Grok 4.6), diğer tarafta yok pahasına iş atı performansı (Gemini 3.7 Flash).
Geliştiriciler ve işletmeler artık gerçek bir seçimle karşı karşıya: iyi ile kötü arasında değil, birbirinden çok farklı iki değer teklifi arasında. Grok 4.6'nın GitHub Copilot'a bu kadar hızlı entegre olması, en azından bir tarafın kitlesini şimdiden bulduğunu gösteriyor.