La société xAI de Musk a publiquement lancé Grok 4.5 le 8 juillet 2026. Sa réalisation indépendante la plus marquante est d'avoir dominé le classement de l'Artificial Analysis agent benchmark sur le rapport coût-vitesse, une évaluation des performances et de l'efficacité des agents. Il a également obtenu la 1ère place sur 28 modèles au benchmark τ³-Banking pour l'utilisation d'outils agentiques (33 %, devant GPT-5.5 à 31 %).
Cependant, sur le plan de l'intelligence composite globale, le tableau est plus nuancé. Grok 4.5 obtient un score de 54 sur l'Artificial Analysis Intelligence Index, le plaçant 4e sur 168 modèles — derrière Claude Fable 5 (60), Claude Opus 4.8 (56) et GPT-5.5 (55). Son véritable atout est son efficacité et son prix : à 2 $/6 $ par million de tokens d'entrée/sortie, il coûte environ un cinquième de ses rivaux premium et utilise 3 à 4 fois moins de tokens par tâche de codage.
Là où Grok 4.5 excelle vraiment, c'est dans les benchmarks de codage agentique. Il obtient 83,3 % sur Terminal-Bench 2.1 (battant Claude Opus 4.8 avec 78,9 %) et 64,7 % sur SWE-bench Pro (battant GPT-5.5 avec 58,6 % mais derrière Opus 4.8 avec 69,2 %). Sur DeepSWE 1.0, il obtient 62,0 %, derrière Fable 5 (66,1 %) et GPT-5.5 (64,3 %).
Les analystes indépendants décrivent Grok 4.5 comme un spécialiste solide plutôt qu'un leader généraliste — gagnant sur la valeur et la vitesse, pas sur les scores d'intelligence brute.
Dans ce qui pourrait être le retournement le plus surprenant de 2026, Musk a publiquement fait marche arrière sur son dédain de longue date pour Anthropic. Le 10 juillet 2026, Musk a écrit sur X : « Je me suis clairement trompé sur Anthropic. Ils sont de toute évidence actuellement le leader de l'IA. Aucune entreprise n'a sorti un modèle aussi bon que Mythos/Fable. »
Cela fait suite à des années de critiques publiques. Encore en septembre 2025, Musk avait écrit que « gagner n'a jamais fait partie des issues possibles pour Anthropic. » Il avait qualifié ses modèles de « diaboliques » et de « bien-pensants » dans des messages précédents.
Le revirement s'est étendu à l'engagement de ne pas utiliser l'accès informatique de SpaceXAI contre son rival, déclarant que ce n'était « pas mon style » et citant l'histoire de Tesla en matière de brevets open source.
Le timing est notable : seulement deux jours après la sortie publique de Grok 4.5, Musk a concédé qu'Anthropic avait pris les devants.
Geoffrey Hinton — le « parrain du deep learning » — a considérablement révisé sa propre chronologie de l'AGI. Il estimait auparavant 30 à 50 ans, mais à la mi-2026, sa fourchette est de 2028-2043, avec une estimation centrale plus étroite de 2028-2035 et une « bonne chance dans 10 ans ou moins. » Il accorde également une probabilité de 10 à 20 % à une extinction humaine causée par l'IA dans les décennies à venir. Hinton a déclaré que l'IA pourrait « raisonner mieux que nous » d'ici cinq ans.
Ben Goertzel — souvent appelé le « père de l'AGI » — a toujours défendu une chronologie plus précoce. Il a prédit une AGI de niveau humain dans les 5 à 7 ans en 2019 (visant approximativement 2024-2026). Plus récemment, il s'attend à une AGI de niveau humain d'ici 2027-2029, la super-intelligence suivant « seulement quelques années » après.
Il a déclaré qu'il ne « serait pas surpris » si cela arrivait dès 2027.
Le contraste clé avec Musk : Musk affirme maintenant que l'AGI pourrait surpasser l'intelligence humaine individuelle d'ici fin 2026 — à l'extrémité la plus précoce du spectre. Hinton est plus mesuré mais a considérablement avancé sa chronologie (2028-2035). La chronologie de Goertzel (2027-2029) se situe entre les deux, plus proche de Musk que de Hinton. Tous les trois s'accordent sur le fait que l'AGI est proche, mais l'écart va de quelques mois (Musk) à plus d'une décennie (limite extérieure de Hinton).
Le graphique du « tsunami supersonique » de Musk et les résultats de référence de Grok 4.5 reflètent tous deux un domaine qui s'accélère véritablement. Pourtant, les mêmes données que Musk utilise pour déclarer une AGI imminente montrent également que le modèle de sa propre société se classe quatrième en intelligence composite — et l'ont amené à concéder que son rival le plus féroce est désormais le leader. Le débat sur la chronologie de l'AGI reste non résolu, mais la fourchette des estimations crédibles s'est rétrécie, passant de « dans des décennies » à une fenêtre de quelques mois à quelques années.