Musk skrev på X, at Grok 4.6 allerede klarer sig bedre end Grok 4.5 i interne evalueringer. Målet er højere hastighed, lavere tokenforbrug og lavere omkostninger . Annonceringen kommer kun få dage efter, at kinesiske Moonshot AI lancerede Kimi K3 – og ligner derfor et direkte modsvar i den globale AI-kapløb.
Grok 4.5 kom i privat beta hos SpaceX og Tesla 28. juni 2026. Modellen bygger på V9-grundmodellen med 1,5 billioner parametre, som afsluttede sin fortræning 26. maj . Den blev gjort tilgængelig via xAI’s API 8. juli til 2 dollar pr. million inputtokens og 6 dollar pr. million outputtokens .
Grok 4.6 øger dermed det angivne antal parametre med cirka 33 procent – fra 1,5 til 2 billioner .
| Specifikation | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Parametre | 1,5 billioner | 2 billioner |
| Grundmodel | V9, færdigtrænet 26. maj 2026 | Næste generation, tekniske detaljer ikke offentliggjort |
| Status | Privat beta hos SpaceX og Tesla fra 28. juni; API lanceret 8. juli | Træningen afsluttes efter planen i denne uge; lancering forventes i august |
| API-pris | 2 dollar pr. 1 mio. inputtokens og 6 dollar pr. 1 mio. outputtokens | Ikke offentliggjort |
| Rapporteret ydeevne | xAI hævder, at modellen er på niveau med eller bedre end Claude Opus; ingen uafhængige benchmarks er offentliggjort | xAI hævder, at modellen overgår Grok 4.5 og sigter mod at slå Kimi K3 |
Der er dog en væsentlig reservation: Ingen uafhængige tredjepartstests af Grok 4.5 er offentliggjort. De hidtidige præstationspåstande kommer fra xAI selv . En xAI-ingeniør har desuden oplyst, at Grok 4.5 fik supplerende Cursor-data med fokus på programmering efter den oprindelige træning. Ifølge ingeniøren er det ikke helt så effektivt som at have dataene med fra begyndelsen .
Moonshot AI lancerede Kimi K3 16. juli 2026 . Modellen har 2,8 billioner parametre, bygger på en open-weight Mixture-of-Experts-arkitektur og har et kontekstvindue på én million tokens samt indbygget billedforståelse . Det gør den til den største open-weight-model, der hidtil er lanceret, og den første i klassen omkring tre billioner parametre.
Kimi K3 aktiverer kun 16 af sine 896 eksperter for hvert token. Det begrænser den beregningsmæssige belastning og gør det muligt at håndtere en model med et meget stort samlet parameterantal uden at aktivere hele modellen ved hver forespørgsel .
Musk har eksplicit fremstillet Grok 4.6 som en model, der skal overgå Kimi K3, samtidig med at den bevarer Groks fordele inden for hastighed og effektivitet . Grok 4.6 er mindre end Kimi K3 målt på det samlede antal parametre. xAI satser derfor tilsyneladende på arkitektureffektivitet og optimering af kørsel frem for blot at vinde på størrelsen alene .
Det centrale problem er, at der endnu ikke findes en uafhængig direkte sammenligning mellem Grok og Kimi K3.
Kimi K3 er blevet evalueret på uafhængige ranglister og er placeret som nummer tre globalt – efter Anthropics Claude Fable 5 og OpenAI’s GPT-5.6 Sol . Modellen er også blevet beskrevet som værende på niveau med de stærkeste proprietære amerikanske systemer . På enkelte benchmarks inden for programmering og webudvikling klarer K3 sig bedre end Claude Fable 5 .
Kimi K3’s API er samtidig angiveligt omkring halvt så dyr som sammenlignelige frontmodeller som Claude Fable 5 og GPT-5.6 Sol . Der er dog ikke fundet præcise tokenpriser i kilder med høj autoritet.
Konklusionen er derfor foreløbig: xAI’s påstande om Grok 4.6 bygger på Musks egne udmeldinger og interne evalueringer. Før der kommer uafhængige tests, kan ingen med sikkerhed afgøre, om modellen faktisk overgår Kimi K3.
Grok 4.6 er kun ét trin i xAI’s langt større opskaleringsplan.
Ved siden af kapløbet om selve modellerne har xAI også sat ind på værktøjer til udviklere. Virksomheden open-sourcede Grok Build 15.-16. juli 2026 under Apache 2.0-licensen og offentliggjorde sin Rust-baserede kodeagent på GitHub i projektet xai-org/grok-build .
Grok Build har otte parallelle underagenter, en arbejdsgang, hvor der lægges en plan før kodningen, samt en såkaldt Arena Mode. Målet er blandt andet at udfordre etablerede kodeassistenter som Cursor og GitHub Copilot.
Open-sourcingen fulgte efter en privatlivs- og sikkerhedskontrovers. Sikkerhedsforskere fandt, at en tidligere version uploadede brugernes komplette arbejdsmapper til xAI’s servere . Ved at offentliggøre koden forsøger xAI at skabe større tillid og få udviklere til at tage værktøjet i brug. Musk har samtidig sagt, at Grok Build forbedres dagligt på baggrund af brugerfeedback .
Musk’s annoncering 18. juli ligner et veltilrettelagt konkurrencemæssigt modsvar til Moonshot AI’s Kimi K3, der var kommet på markedet blot to dage tidligere. xAI’s lovede månedlige udgivelsestempo er mere aggressivt end det, andre frontlaboratorier offentligt har forpligtet sig til, og Grok 5-planerne peger mod modeller i en helt anden størrelsesorden.
Men parameterantal og interne tests er ikke det samme som dokumenteret ydeevne. Indtil uafhængige benchmarkresultater foreligger, er spørgsmålet om, hvorvidt Grok 4.6 faktisk kan slå Kimi K3, stadig ubesvaret.