Grok 4.5 memasuki fasa beta persendirian di SpaceX dan Tesla pada 28 Jun 2026. Ia menggunakan model asas V9 dengan 1.5 trilion parameter, yang melengkapkan pralatihan pada 26 Mei 2026 . Akses melalui API xAI kemudian dilancarkan pada 8 Julai dengan harga AS$2 bagi setiap sejuta token input dan AS$6 bagi setiap sejuta token output .
Dengan 2 trilion parameter, Grok 4.6 mempunyai kira-kira 33% lebih banyak parameter berbanding pendahulunya .
| Spesifikasi | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Parameter | 1.5 trilion | 2 trilion |
| Model asas | V9, latihan selesai pada 26 Mei 2026 | Generasi baharu; butiran seni bina belum didedahkan |
| Status | Beta persendirian di SpaceX dan Tesla sejak 28 Jun; API dilancarkan pada 8 Julai | Latihan awal dijangka selesai minggu ini; pelancaran dijangka pada Ogos |
| Harga API | AS$2 bagi 1 juta token input; AS$6 bagi 1 juta token output | Belum diumumkan |
| Prestasi dilaporkan | Didakwa hampir menyamai atau mengatasi Claude Opus; belum ada penanda aras bebas | Didakwa mengatasi Grok 4.5 dan menyasarkan prestasi lebih baik daripada Kimi K3 |
Namun, ada perkara penting yang perlu diberi perhatian: belum ada penanda aras bebas pihak ketiga untuk Grok 4.5. Semua dakwaan prestasi setakat ini datang daripada xAI sendiri . Seorang jurutera xAI juga menyatakan Grok 4.5 menggunakan data tambahan daripada Cursor, khususnya untuk pengekodan, selepas latihan awal. Menurutnya, pendekatan itu “tidak sebaik” memasukkan data tersebut sejak peringkat latihan awal .
Pengumuman Musk dibuat hanya beberapa hari selepas Moonshot AI melancarkan Kimi K3 pada 16 Julai 2026 . Model dari China itu mempunyai 2.8 trilion parameter, menggunakan seni bina Mixture-of-Experts (MoE), menyediakan tetingkap konteks sehingga 1 juta token dan menyokong keupayaan penglihatan asli. Ia dipasarkan sebagai model AI open-weight terbesar pernah dikeluarkan serta model pertama dalam kelas “3 trilion” .
Kimi K3 mempunyai 896 pakar, tetapi hanya 16 diaktifkan untuk setiap token. Reka bentuk itu membantu mengurangkan keperluan pengiraan ketika model digunakan .
Musk secara jelas membingkaikan Grok 4.6 sebagai pencabar Kimi K3. Sasaran xAI adalah untuk mengatasi prestasi K3 sambil mengekalkan kelebihan Grok dari segi kelajuan dan kecekapan .
Menariknya, Grok 4.6 mempunyai jumlah parameter lebih kecil berbanding Kimi K3 — 2 trilion berbanding 2.8 trilion. Ini menunjukkan xAI mungkin bergantung pada kecekapan seni bina dan pengoptimuman inferens, bukan semata-mata saiz model .
Di sinilah perbandingan ini perlu dibaca dengan berhati-hati. Grok 4.5 masih belum mempunyai skor penanda aras bebas, manakala dakwaan kompetitif xAI datang daripada kenyataan syarikat dan Musk di media sosial.
Sebaliknya, Kimi K3 dilaporkan telah dinilai secara bebas dan berada di tempat ketiga dalam papan pendahulu global yang komprehensif, di belakang Claude Fable 5 daripada Anthropic dan GPT-5.6 Sol daripada OpenAI . K3 juga dilaporkan setanding dengan sistem proprietari paling berkuasa daripada pesaing Amerika Syarikat , malah mengatasi Claude Fable 5 dalam beberapa ujian pengekodan dan pembangunan web .
Dari segi harga, API Kimi K3 dilaporkan berharga kira-kira separuh daripada model AI termaju yang setara seperti Claude Fable 5 dan GPT-5.6 Sol . Bagaimanapun, harga tepat bagi setiap token tidak ditemui dalam sumber berautoriti tinggi.
Kesimpulan buat masa ini: belum wujud perbandingan penanda aras bebas secara terus antara mana-mana model Grok dan Kimi K3. Oleh itu, dakwaan xAI bahawa Grok 4.6 akan mengatasi K3 masih belum dapat disahkan.
Grok 4.6 hanyalah sebahagian daripada rancangan lebih besar xAI. Syarikat itu dilaporkan telah menetapkan beberapa sasaran berikut:
Persaingan xAI bukan hanya berkisar pada model bahasa. Pada 15–16 Julai 2026, syarikat itu membuka kod sumber Grok Build, ejen pengekodan berasaskan Rust, di bawah lesen Apache 2.0. Kod antara muka baris arahannya diterbitkan di GitHub melalui repositori xai-org/grok-build .
Grok Build menawarkan lapan subejen selari, aliran kerja yang mengutamakan perancangan dan ciri Arena Mode. Langkah membuka kod ini dibuat selepas penyelidik keselamatan mendapati versi terdahulu memuat naik keseluruhan direktori kerja pengguna ke pelayan xAI . Dengan menerbitkan kod tersebut, xAI cuba meningkatkan ketelusan, membina semula kepercayaan dan menggalakkan penggunaan oleh komuniti.
Musk juga mengesahkan pada 8 Julai bahawa penambahbaikan harian untuk Grok Build dibuat berdasarkan maklum balas pengguna . Strategi itu meletakkan xAI berdepan secara langsung dengan alat ejen pengekodan seperti Cursor dan GitHub Copilot.
Pengumuman Grok 4.6 kelihatan seperti serangan balas kompetitif terhadap Kimi K3, yang muncul hanya beberapa hari sebelumnya. Dengan sasaran melancarkan model baharu setiap bulan dan roadmap Grok 5 yang jauh lebih besar, xAI jelas mahu bergerak pantas dalam perlumbaan AI termaju.
Namun, saiz model bukanlah bukti muktamad keupayaan. Selagi tiada penanda aras pihak ketiga yang bebas untuk Grok, dakwaan bahawa Grok 4.6 boleh mengatasi Kimi K3 kekal sebagai sasaran — bukan keputusan yang telah terbukti. Dalam perlumbaan AI hari ini, ketelusan mungkin sama pentingnya dengan jumlah parameter.