Grok 4.5 memasuki beta pribadi di SpaceX dan Tesla pada 28 Juni 2026, didukung oleh model fondasi V9 berkekuatan 1,5 triliun parameter yang menyelesaikan pra-pelatihan pada 26 Mei 2026 . Model ini tersedia melalui API xAI pada 8 Juli dengan harga $2/1M token input dan $6/1M token output . Grok 4.6 mewakili peningkatan parameter sebesar 33% dari pendahulunya, dari 1,5T menjadi 2T parameter .
| Spesifikasi | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Parameter | 1,5 triliun | 2 triliun |
| Model fondasi | V9 (selesai 26 Mei 2026) | Generasi berikutnya (arsitektur tidak diungkap) |
| Status | Beta pribadi di SpaceX & Tesla sejak 28 Juni; API rilis 8 Juli | Pelatihan selesai minggu ini; rilis diperkirakan Agustus |
| Harga (API) | $2/1M input, $6/1M output token | Belum diumumkan |
| Kinerja dilaporkan | Diklaim mendekati/melebihi Claude Opus; belum ada benchmark independen | Diklaim melebihi Grok 4.5; target mengalahkan Kimi K3 |
Catatan penting: Belum ada benchmark pihak ketiga yang diterbitkan untuk Grok 4.5 — semua klaim kinerja hanya berdasarkan pernyataan xAI sendiri . Seorang engineer xAI mencatat bahwa Grok 4.5 menggunakan data "Cursor" (data fokus coding) yang tidak termasuk dalam pelatihan awal, yang "tidak sebaik jika dimasukkan sejak pelatihan awal" .
Waktu pengumuman Musk terkait langsung dengan peluncuran Kimi K3 oleh Moonshot AI pada 16 Juli 2026 . Kimi K3 adalah model 2,8 triliun parameter, open-weight Mixture-of-Experts (MoE) dengan jendela konteks 1 juta token dan kemampuan visi bawaan, menjadikannya model open-weight terbesar yang pernah dirilis dan yang pertama di kelas "3T" . Model ini hanya mengaktifkan 16 dari 896 eksper per token, sebuah desain yang mengurangi biaya komputasi .
Unggahan Musk secara eksplisit membingkai Grok 4.6 sebagai respons, dengan tujuan mengalahkan Kimi K3 dalam kinerja sambil mempertahankan kecepatan dan efisiensi Grok . Grok 4.6 dengan 2T parameter lebih kecil dari Kimi K3 yang 2,8T, jadi xAI bertaruh pada efisiensi arsitektur dan optimasi inferensi, bukan jumlah parameter mentah .
Di sinilah ceritanya menjadi penting: Grok 4.5 tidak memiliki skor benchmark independen. Semua klaim kompetitifnya hanya berdasarkan laporan sendiri oleh xAI. Sebaliknya, Kimi K3 telah dievaluasi secara independen dan menempati posisi #3 global di papan peringkat komprehensif, hanya di belakang Claude Fable 5 milik Anthropic dan GPT-5.6 Sol milik OpenAI . Model ini digambarkan berkinerja "seimbang dengan sistem proprietary paling kuat dari pesaing AS" . K3 mengungguli Claude Fable 5 pada benchmark coding dan pengembangan web tertentu .
Dari segi harga, API Kimi K3 dilaporkan sekitar setengah dari harga model frontier sebanding seperti Claude Fable 5 dan GPT-5.6 Sol . Harga per token yang tepat tidak ditemukan dari sumber dengan otoritas tinggi.
Kesimpulan utama: Belum ada perbandingan benchmark independen langsung antara model Grok mana pun dengan Kimi K3. Semua pernyataan kinerja xAI hanyalah klaim yang belum diverifikasi yang dibuat oleh Musk di media sosial.
Pengumuman Musk pada 18 Juli adalah bagian dari rencana yang jauh lebih besar. Berikut komitmen publik xAI:
Bersamaan dengan perlombaan model, xAI membuka sumber kode Grok Build pada 15–16 Juli 2026 di bawah lisensi Apache 2.0, menerbitkan agen coding CLI berbasis Rust di GitHub di xai-org/grok-build . Grok Build memiliki 8 subagen paralel, alur kerja rencana-pertama, dan Mode Arena. Langkah open-source ini mengikuti kontroversi privasi: peneliti keamanan menemukan bahwa versi sebelumnya mengunggah seluruh direktori kerja pengguna ke server xAI . Dengan membuka kode, xAI bertujuan membangun kepercayaan dan mempercepat adopsi komunitas.
Musk secara terpisah mengonfirmasi pada 8 Juli bahwa xAI melakukan perbaikan harian pada Grok Build yang didorong oleh umpan balik pengguna . Ini memposisikan xAI untuk secara langsung menantang pemain mapan agen coding seperti Cursor dan GitHub Copilot.
Pengumuman Grok 4.6 oleh Musk pada 18 Juli adalah pukulan balik kompetitif yang jelas terhadap peluncuran Kimi K3 oleh Moonshot hanya dua hari sebelumnya. Jadwal rilis bulanan xAI lebih cepat daripada laboratorium frontier lainnya, dan peta jalan Grok 5 menandakan model yang jauh lebih besar di masa depan. Namun kurangnya benchmark independen untuk model xAI mana pun berarti semua klaim kompetitif tetap belum diverifikasi hingga pengujian pihak ketiga muncul. Dalam perlombaan yang diukur oleh transparansi dan skala, celah itu sangat berarti.