Grok 4.5 ging op 28 juni 2026 in private bèta bij SpaceX en Tesla, aangedreven door het V9-basismodel met 1,5 biljoen parameters dat de pre-training op 26 mei 2026 voltooide . Het werd op 8 juli beschikbaar via de xAI API voor $2/1M input tokens en $6/1M output tokens . Grok 4.6 betekent een parameterstijging van 33% ten opzichte van zijn voorganger, van 1,5 biljoen naar 2 biljoen parameters .
| Specificatie | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Parameters | 1,5 biljoen | 2 biljoen |
| Basismodel | V9 (training voltooid 26 mei 2026) | Volgende generatie (architectuurdetails niet bekendgemaakt) |
| Status | Private bèta bij SpaceX & Tesla sinds 28 juni; API gelanceerd op 8 juli | Training wordt deze week afgerond; lancering verwacht in augustus |
| Prijzen (API) | $2/1M input, $6/1M output tokens | Nog niet aangekondigd |
| Gerapporteerde prestaties | Zelfgerapporteerd als nabij/overschrijdend Claude Opus; geen onafhankelijke benchmarks gepubliceerd | Beweert Grok 4.5 te overtreffen; streeft ernaar Kimi K3 te overtreffen |
Een belangrijke kanttekening: Er zijn geen onafhankelijke benchmarks van derden gepubliceerd voor Grok 4.5 — alle prestatieclaims zijn van xAI zelf . Een xAI-ingenieur merkte op dat Grok 4.5 gebruikmaakte van aanvullende "Cursor-data" (coderingsgerichte data) die niet in de initiële training waren opgenomen, wat "niet zo goed was als het in de initiële training hebben" .
De timing van Musk' aankondiging is direct gekoppeld aan Moonshot AI's lancering van Kimi K3 op 16 juli 2026 . Kimi K3 is een opengewicht Mixture-of-Experts (MoE)-model met 2,8 biljoen parameters, met een contextvenster van 1 miljoen tokens en native visuele mogelijkheden. Het is het grootste opengewicht AI-model ooit uitgebracht en het eerste in de "3T-klasse" . Het activeert slechts 16 van de 896 experts per token, een ontwerpkeuze die de rekenkosten verlaagt .
Musk' berichten framen Grok 4.6 expliciet als het antwoord, met als doel Kimi K3 te overtreffen in prestaties, terwijl de snelheids- en efficiëntievoordelen van Grok behouden blijven . Grok 4.6 met 2 biljoen parameters is kleiner dan Kimi K3's 2,8 biljoen, dus xAI wedt op architectuurefficiëntie en inferentie-optimalisatie in plaats van op het ruwe aantal parameters .
Hier wordt het verhaal belangrijk: Grok 4.5 heeft geen onafhankelijke benchmarkscores. Al zijn concurrentieclaims zijn zelfgerapporteerd door xAI. Daarentegen is Kimi K3 onafhankelijk geëvalueerd en staat het #3 wereldwijd op uitgebreide ranglijsten, alleen achter Anthropic's Claude Fable 5 en OpenAI's GPT-5.6 Sol . Het wordt omschreven als "nek-aan-nek met de krachtigste propriëtaire systemen van Amerikaanse rivalen" . K3 presteert beter dan Claude Fable 5 op bepaalde coderings- en webontwikkelingsbenchmarks .
Wat prijzen betreft, de API van Kimi K3 zou ongeveer de helft kosten van vergelijkbare frontier-modellen zoals Claude Fable 5 en GPT-5.6 Sol . Exacte prijzen per token werden niet gevonden in bronnen met hoge autoriteit.
De belangrijkste conclusie: Er bestaan geen directe onafhankelijke benchmarkvergelijkingen tussen enig Grok-model en Kimi K3. Alle prestatiestatements van xAI zijn ongeverifieerde claims van Musk op sociale media.
Musk' aankondiging van 18 juli past in een veel groter plan. Dit is waar xAI zich publiekelijk aan heeft gecommitteerd:
Parallel aan de modelrace heeft xAI Grok Build open-sourced op 15-16 juli 2026 onder de Apache 2.0-licentie. Het bedrijf publiceerde zijn op Rust gebaseerde CLI-coding agent op GitHub op xai-org/grok-build . Grok Build heeft 8 parallelle subagenten, een plan-eerst-workflow en Arena Mode. De open-sourcing volgt op een privacycontroverse: beveiligingsonderzoekers ontdekten dat een eerdere versie de volledige werkdirectory's van gebruikers naar xAI's servers uploadde . Door de code open te stellen, wilde xAI vertrouwen opbouwen en de acceptatie door de community versnellen.
Musk bevestigde apart op 8 juli dat xAI dagelijkse verbeteringen aan Grok Build doorvoert op basis van gebruikersfeedback . Dit positioneert xAI om rechtstreeks te concurreren met gevestigde coderingsagenten zoals Cursor en GitHub Copilot.
Musk' aankondiging van Grok 4.6 op 18 juli is een duidelijke competitieve tegenaanval op Moonshot's Kimi K3-lancering, slechts twee dagen eerder. De maandelijkse release-cadence van xAI is sneller dan die van enig ander frontier-lab, en de Grok 5-roadmap voorspelt veel grotere modellen in de toekomst. Maar het gebrek aan onafhankelijke benchmarks voor enig xAI-model betekent dat alle concurrentieclaims ongeverifieerd blijven totdat tests van derden verschijnen. In een race die net zozeer om transparantie als om schaal draait, is dat een belangrijk gemis.