SpaceXAI resmi meluncurkan Grok 4.6 pada 12 Agustus 2026, meraih skor 61 di AA Intelligence Index — menyamai GPT 5.6 Sol Max — dengan harga $2/$6 per juta token, atau sekitar 60% lebih murah dari model premium OpenAI... Pengujian independen oleh Artificial Analysis membuktikan klaim benchmark Grok 4.6 hanya berbeda...
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What did SpaceXAI's August 12, 2026 launch of Grok 4.6 entail in terms of pricing, benchmark performance, architectural approach, early inde. Article summary: ## Grok 4.6 Launch — August 12, 2026. Topic tags: general, news, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
Pada 12 Agustus 2026, SpaceXAI (sebelumnya xAI, bergabung dengan SpaceX pada Februari 2026) merilis Grok 4.6, model penalaran dan coding yang hadir hanya 35 hari setelah Grok 4.5 . Peluncuran ini langsung memicu perbandingan dengan model dari OpenAI dan Anthropic — bukan hanya soal kecerdasan, tapi juga harga. Keesokan harinya, Google merilis Gemini 3.7 Flash, mempercepat apa yang menjadi pertarungan utama lanskap AI 2026: perang harga merebut hati pengembang.
Grok 4.6 mempertahankan harga identik dengan Grok 4.5 — $2,00 per juta token input dan $6,00 per juta token output, dengan jendela konteks 500K token dan input teks-dan-gambar . Tiers dengan kecepatan tinggi tersedia dengan harga dua kali lipat
. Harga ini sekitar 60% lebih murah dari GPT-5.6 Sol atau Claude Opus 5
.
Sebagai perbandingan, Gemini 3.7 Flash dari Google, yang dirilis pada 13 Agustus, hadir dengan harga perkenalan $0,75 per juta token input dan $3,75 per juta token output — setengah dari harga pendahulunya, Gemini 3.6 Flash, dan sekitar sepertiga dari harga Grok 4.6 . Harga perkenalan Google berlaku hingga 31 Desember 2026, setelah itu akan naik dua kali lipat
.
Perbedaan harga ini sangat kontras: Grok 4.6 bersaing langsung dengan model frontier seperti GPT-5.6 Sol dan Claude Opus 5 dalam hal kecerdasan, sementara Gemini 3.7 Flash diposisikan sebagai model "kuda kerja" — menawarkan performa sebanding dengan Claude Sonnet 5 dan GPT-5.6 Terra dengan biaya yang jauh lebih rendah .
Grok 4.6 mencetak skor 61 pada Artificial Analysis (AA) Intelligence Index, gabungan dari sembilan evaluasi . Skor ini menyamai GPT-5.6 Sol Max, tertinggal satu poin dari Claude Fable 5 Max (62), dan dua poin dari Claude Opus 5 Max (63) — menandai pertama kalinya model xAI bergabung dengan kluster frontier
.
| Benchmark | Grok 4.6 (High) | Grok 4.5 (High) | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 (Elo) | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69,9% | 66,7% | 67,2% | 70,5% |
| AA-Briefcase | 1577 | — | — | — |
SpaceXAI melaporkan peningkatan dibandingkan Grok 4.5 di setiap evaluasi yang diumumkan, termasuk CursorBench, FrontierCode, APEX-Agents, dan Terminal-Bench . Pengujian independen oleh Artificial Analysis mengonfirmasi klaim tersebut dengan selisih hanya 0,08 poin
.
Yang menarik, hasil independen terkuat Grok 4.6 justru ada di evaluasi knowledge-work — model ini memimpin di GDPval-AA v2 (1753 Elo), AA-Briefcase (1577), dan benchmark hukum Harvey — menunjukkan model ini sangat cocok untuk tugas pengetahuan profesional . Namun, meskipun dipasarkan sebagai model coding agentic, skor CursorBench v3.2 (69,9%) masih di bawah Fable 5 Max (70,5%), meskipun mengalahkan GPT-5.6 Sol Max (67,2%)
.
Sementara itu, Gemini 3.7 Flash mencatat peningkatan signifikan di benchmark coding dan agen. Di FrontierCode v1.1, skornya mencapai 43,6% untuk kode siap produksi, naik dari 34,4% di 3.6 Flash dan unggul dari Claude Sonnet 5 (42,7%) dan GPT-5.6 Terra (41,3%) . Model ini juga menunjukkan lompatan besar di DeepSWE v1.1 (49,0% ke 65,3%) dan AutomationBench (17,0% ke 30,4%)
.
Penambahan arsitektur utama pada Grok 4.6 adalah level penalaran xhigh yang baru, mode penalaran intensif untuk tugas agentic dan coding paling sulit . Model ini dioptimalkan untuk ketahanan agen jangka panjang — model ini menyelesaikan tugas dalam sekitar setengah jumlah putaran yang dibutuhkan Claude Opus 5, atau sekitar seperempat token input, dengan harga yang tertera
. Keunggulan efisiensi ini bisa dibilang menjadi nilai jual terkuatnya bagi pengembang yang menjalankan sesi coding selama berjam-jam
.
SpaceXAI mengaitkan peningkatan di Grok 4.6 dengan pelatihan tambahan yang lebih lama serta fine-tuning dan reinforcement learning yang lebih baik — bukan karena penambahan jumlah parameter . Model ini masih menggunakan fondasi V9 berkekuatan 1,5 triliun parameter yang sama dengan Grok 4.5
.
Sementara itu, Gemini 3.7 Flash menghadirkan "konfigurasi berpikir yang dapat disesuaikan" untuk mengontrol campuran kualitas, biaya, dan latensi, serta menjadi model Google pertama yang mengaktifkan pemrosesan video agentic .
Kelebihan Grok 4.6:
Kekurangan Grok 4.6:
Dua hari setelah peluncuran, pada 14 Agustus 2026, Grok 4.6 hadir di GitHub Copilot di semua platform pengembangan utama :
Catatan perubahan resmi GitHub menggambarkannya sebagai "dirancang untuk coding agentic dan alur kerja multi-langkah yang kompleks" . Integrasi cepat ini menandakan permintaan kuat dari platform pengembang untuk model ini .
Urutan peluncuran 12–13 Agustus mengungkapkan dua strategi kompetitif yang berbeda:
Grok 4.6 (SpaceXAI) — $2/$6 per MTok — Frontier composite (AA Index 61) — 500K konteks — Dirancang untuk coding agentic dan knowledge-work — Keunggulan efisiensi tugas dibandingkan Opus 5
Gemini 3.7 Flash (Google) — $0,75/$3,75 per MTok (harga perkenalan) — Performa tier kuda kerja sebanding dengan Claude Sonnet 5 dan GPT-5.6 Terra — Jendela konteks 1M — Model Gemini pertama dengan pemrosesan video agentic — Menopang Gemini Spark
Grok 4.6 bersaing dalam kecerdasan dengan diskon dari harga frontier, sementara Gemini 3.7 Flash bersaing dalam harga dengan diskon dari tier kuda kerja. Keputusan Google menawarkan Gemini 3.7 Flash dengan setengah harga perkenalan pendahulunya — dan tidak memberikan tanggal rilis untuk model Pro andalannya — menunjukkan strategi yang disengaja untuk merebut pangsa pasar di level kuda kerja .
Grok 4.6 berhasil mengembalikan SpaceXAI ke papan atas frontier, menyamai GPT-5.6 Sol dalam kecerdasan komposit dengan biaya yang jauh lebih rendah, dengan keunggulan efisiensi nyata untuk tugas agentic. Keterbatasannya — tidak memimpin satu pun benchmark coding, tertinggal dari Claude Opus 5 dalam kecerdasan komposit, dan mempertahankan harga saat pesaing memotong — adalah nyata tetapi tidak mengurangi pencapaiannya.
Tanggapan Google, yang datang hanya 24 jam kemudian, mengubah seluruh percakapan harga. Dengan biaya sekitar sepertiga dari Grok 4.6, Gemini 3.7 Flash menawarkan performa coding dan agen yang kuat dengan harga kuda kerja — dan dengan jendela konteks 1M token. Lanskap kompetitif kini jelas terbelah dua: kecerdasan frontier dengan diskon (Grok 4.6) versus performa kuda kerja dengan harga murah (Gemini 3.7 Flash).
Pengembang dan perusahaan dihadapkan pada pilihan yang nyata — bukan antara yang baik dan buruk, tetapi antara dua proposisi nilai yang sangat berbeda. Integrasi cepat Grok 4.6 ke GitHub Copilot menunjukkan setidaknya salah satunya telah menemukan pasarnya.
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
SpaceXAI resmi meluncurkan Grok 4.6 pada 12 Agustus 2026, meraih skor 61 di AA Intelligence Index — menyamai GPT 5.6 Sol Max — dengan harga $2/$6 per juta token, atau sekitar 60% lebih murah dari model premium OpenAI...
SpaceXAI resmi meluncurkan Grok 4.6 pada 12 Agustus 2026, meraih skor 61 di AA Intelligence Index — menyamai GPT 5.6 Sol Max — dengan harga $2/$6 per juta token, atau sekitar 60% lebih murah dari model premium OpenAI... Pengujian independen oleh Artificial Analysis membuktikan klaim benchmark Grok 4.6 hanya berbeda 0,08 poin.
Google membalas keesokan harinya dengan Gemini 3.7 Flash seharga $0,75/$3,75 per juta token (harga perkenalan), performa setara Claude Sonnet 5 dan GPT 5.6 Terra, jendela konteks 1M token, serta menjadi model default...