Grok 4.5 è entrato in beta privata presso SpaceX e Tesla il 28 giugno 2026, basato sul modello fondamentale V9 da 1,5 trilioni di parametri, il cui pre-addestramento era terminato il 26 maggio 2026 . È diventato disponibile tramite l'API di xAI l'8 luglio al costo di $2 per milione di token in input e $6 per milione di token in output . Grok 4.6 rappresenta un aumento del 33% rispetto al suo predecessore, passando da 1,5T a 2T parametri .
| Specifica | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Parametri | 1,5 trilioni | 2 trilioni |
| Modello fondamentale | V9 (addestramento completato il 26/05/2026) | Nuova generazione (architettura non divulgata) |
| Stato | Beta privata da giugno; API lanciata l'8 luglio | Addestramento in chiusura; lancio previsto ad agosto |
| Prezzi (API) | $2/1M token input, $6/1M token output | Non ancora annunciati |
| Prestazioni dichiarate | Vicine/superiori a Claude Opus (autodichiarato) | Supera Grok 4.5; punta a superare Kimi K3 |
Una precisazione fondamentale: nessun benchmark indipendente di terze parti è stato pubblicato per Grok 4.5 — tutte le affermazioni sulle prestazioni provengono da xAI stessa . Un ingegnere di xAI ha notato che Grok 4.5 ha utilizzato dati supplementari "Cursor" (focalizzati sul coding) non inclusi nell'addestramento iniziale, specificando che ciò "non è efficace quanto averli nell'addestramento iniziale" .
La tempistica dell'annuncio di Musk è direttamente collegata al lancio di Kimi K3 da parte di Moonshot AI il 16 luglio 2026 . Kimi K3 è un modello Mixture-of-Experts (MoE) open-weight da 2,8 trilioni di parametri, con una finestra di contesto di 1 milione di token e capacità visive native. È il più grande modello AI open-weight mai rilasciato e il primo della categoria "3T" . Attiva solo 16 dei suoi 896 esperti per token, una scelta progettuale che riduce i costi computazionali .
I post di Musk inquadrano esplicitamente Grok 4.6 come una risposta, dichiarando l'obiettivo di superare Kimi K3 in termini di prestazioni, mantenendo al contempo i vantaggi di velocità ed efficienza di Grok . Grok 4.6, con i suoi 2T parametri, è più piccolo del rivale (2,8T); xAI punta quindi sull'efficienza architetturale e sull'ottimizzazione dell'inferenza, non sul mero numero di parametri .
Qui la storia si fa interessante: Grok 4.5 non ha punteggi di benchmark indipendenti. Tutte le sue affermazioni sono autodichiarate da xAI. Al contrario, Kimi K3 è stato valutato in modo indipendente e si classifica al 3° posto globale nelle classifiche complete, dietro solo a Claude Fable 5 di Anthropic e GPT-5.6 Sol di OpenAI . Il modello è stato descritto come "testa a testa con i sistemi proprietari più potenti dei rivali statunitensi" . K3 supera Claude Fable 5 in alcuni benchmark di coding e sviluppo web .
Sul fronte dei prezzi, l'API di Kimi K3 sembra costare circa la metà di modelli frontier comparabili come Claude Fable 5 e GPT-5.6 Sol . Non sono state trovate tariffe precise per token da fonti con elevata autorevolezza.
Il punto chiave: Non esistono confronti diretti e indipendenti tra alcun modello Grok e Kimi K3. Tutte le dichiarazioni di xAI sulle prestazioni sono affermazioni non verificate fatte da Musk sui social media.
L'annuncio del 18 luglio si inserisce in un piano molto più ampio. Ecco gli impegni pubblici di xAI:
Parallelamente alla corsa ai modelli, xAI ha reso open source Grok Build il 15-16 luglio 2026 con licenza Apache 2.0, pubblicando il suo agente di coding da riga di comando in Rust su GitHub (xai-org/grok-build) . Grok Build vanta 8 sottoagenti paralleli, un flusso di lavoro "prima il piano" e una "Arena Mode". La scelta di aprire il codice segue una controversia sulla privacy: dei ricercatori di sicurezza avevano scoperto che una versione precedente caricava intere directory di lavoro degli utenti sui server di xAI . Rendendo pubblico il codice, xAI ha mirato a ricostruire la fiducia e accelerare l'adozione da parte della comunità.
Separatamente, l'8 luglio Musk ha confermato che xAI sta apportando miglioramenti quotidiani a Grok Build basati sul feedback degli utenti . Questa mossa posiziona xAI per sfidare direttamente i tool di coding affermati come Cursor e GitHub Copilot.
L'annuncio di Musk del 18 luglio su Grok 4.6 è un chiaro contrattacco competitivo al lancio di Kimi K3 di Moonshot, avvenuto appena due giorni prima. La cadenza di rilascio mensile di xAI è più rapida di qualsiasi altro laboratorio frontier, e la roadmap di Grok 5 fa presagire modelli ben più grandi in arrivo. Tuttavia, la mancanza di benchmark indipendenti per qualsiasi modello xAI significa che tutte le affermazioni rimangono non verificate fino all'arrivo di test di terze parti. In una corsa in cui la trasparenza conta quanto la scala, questo divario è significativo.