Le Grok 4.5 est entré en version bêta privée chez SpaceX et Tesla le 28 juin 2026, propulsé par le modèle fondamental V9 de 1 500 milliards de paramètres, dont le pré-entraînement s'est achevé le 26 mai 2026 . Il est devenu accessible via l'API de xAI le 8 juillet au tarif de 2 $ pour 1 million de jetons d'entrée et 6 $ pour 1 million de jetons de sortie . Le Grok 4.6 représente une augmentation de 33 % du nombre de paramètres par rapport à son prédécesseur, passant de 1 500 à 2 000 milliards .
| Spécification | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Paramètres | 1 500 milliards | 2 000 milliards |
| Modèle fondamental | V9 (entraînement achevé le 26 mai 2026) | Nouvelle génération (architecture non divulguée) |
| Statut | Bêta privée chez SpaceX et Tesla depuis le 28 juin ; API lancée le 8 juillet | Entraînement en cours cette semaine ; lancement prévu en août |
| Tarification (API) | 2 $/1M entrée, 6 $/1M sortie | Pas encore annoncée |
| Performances rapportées | Auto-évaluées comme proches ou supérieures à Claude Opus ; aucun benchmark indépendant publié | Affirme dépasser Grok 4.5 ; vise à surpasser Kimi K3 |
Un avertissement crucial : Aucun benchmark tiers indépendant n'a été publié pour le Grok 4.5 — toutes les affirmations de performance proviennent de xAI lui-même . Un ingénieur de xAI a noté que le Grok 4.5 utilisait des données supplémentaires « Cursor » (axées sur le codage) non incluses dans l'entraînement initial, ce qui « n'est pas aussi bien que de les avoir dans l'entraînement initial » .
Le timing de l'annonce de Musk est directement lié au lancement du Kimi K3 par Moonshot AI le 16 juillet 2026 . Le Kimi K3 est un modèle à 2 800 milliards de paramètres, à poids ouverts et à mélange d'experts (MoE), doté d'une fenêtre de contexte d'1 million de jetons et de capacités visuelles natives. C'est le plus grand modèle d'IA à poids ouverts jamais publié et le premier de la « classe des 3 000 milliards » . Il n'active que 16 de ses 896 experts par jeton, un choix de conception qui réduit les coûts de calcul .
Les messages de Musk présentent explicitement Grok 4.6 comme la réponse, affirmant que l'objectif est de surpasser Kimi K3 en performance tout en maintenant les avantages de rapidité et d'efficacité de Grok . Avec 2 000 milliards de paramètres, Grok 4.6 est plus petit que les 2 800 milliards de Kimi K3. xAI parie donc sur l'efficacité de l'architecture et l'optimisation de l'inférence plutôt que sur le nombre brut de paramètres .
C'est là que l'histoire devient importante : Grok 4.5 n'a aucun score de benchmark indépendant. Toutes ses affirmations concurrentielles sont auto-déclarées par xAI. En revanche, Kimi K3 a été évalué de manière indépendante et se classe n°3 mondial sur les classements complets, derrière le Claude Fable 5 d'Anthropic et le GPT-5.6 Sol d'OpenAI . Il est décrit comme « rivalisant avec les systèmes propriétaires les plus puissants des concurrents américains » . K3 surpasse Claude Fable 5 sur certains benchmarks de codage et de développement web .
En matière de tarification, l'API de Kimi K3 serait environ deux fois moins chère que celle des modèles de pointe comparables comme Claude Fable 5 et GPT-5.6 Sol . Aucun prix exact par jeton n'a été trouvé dans des sources de haute autorité.
Le point clé : Il n'existe aucune comparaison directe de benchmark indépendant entre un modèle Grok et Kimi K3. Toutes les déclarations de performance de xAI sont des affirmations non vérifiées de Musk sur les réseaux sociaux.
L'annonce du 18 juillet de Musk s'inscrit dans un plan beaucoup plus vaste. Voici ce à quoi xAI s'est publiquement engagé :
Parallèlement à la course aux modèles, xAI a ouvert le code source de Grok Build les 15 et 16 juillet 2026 sous licence Apache 2.0, publiant son agent de codage en ligne de commande en Rust sur GitHub à l'adresse xai-org/grok-build . Grok Build propose 8 sous-agents parallèles, un flux de travail « planifier d'abord » et un mode Arène. Ce passage à l'open source fait suite à une controverse sur la vie privée : des chercheurs en sécurité ont découvert qu'une version précédente téléchargeait l'intégralité des répertoires de travail des utilisateurs vers les serveurs de xAI . En ouvrant le code, xAI cherchait à rétablir la confiance et à accélérer l'adoption par la communauté.
Musk a également confirmé le 8 juillet que xAI apporte des améliorations quotidiennes à Grok Build en fonction des retours des utilisateurs . Cela positionne xAI pour concurrencer directement les leaders des agents de codage comme Cursor et GitHub Copilot.
L'annonce du Grok 4.6 par Musk le 18 juillet est une contre-attaque compétitive claire face au lancement du Kimi K3 de Moonshot, intervenu à peine deux jours plus tôt. La cadence de sortie mensuelle de xAI est plus rapide que celle de tout autre laboratoire de pointe, et la feuille de route de Grok 5 laisse présager des modèles bien plus importants à venir. Mais l'absence de benchmarks indépendants pour tous les modèles xAI signifie que toutes les affirmations concurrentielles restent non vérifiées en attendant les tests de tiers. Dans une course où la transparence compte autant que l'échelle, cette lacune est cruciale.