Det er en tydelig opptrapping etter at kinesiske Moonshot AI lanserte Kimi K3 16. juli. Musk har selv formulert Grok 4.6 som et forsøk på å overgå den kinesiske modellen .
Grok 4.5 gikk inn i en lukket betatest hos SpaceX og Tesla 28. juni 2026. Modellen bygger på V9-grunnmodellen, som fullførte forhåndstreningen 26. mai, med 1,5 billioner parametere . Et API ble tilgjengelig 8. juli, til 2 dollar per én million input-tokens og 6 dollar per én million output-tokens .
Grok 4.6 representerer dermed en økning på rundt 33 prosent i antall parametere – fra 1,5 til 2 billioner .
| Egenskap | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Parametere | 1,5 billioner | 2 billioner |
| Grunnmodell | V9, ferdig trent 26. mai 2026 | Neste generasjon, tekniske detaljer ikke offentliggjort |
| Status | Lukket betatest hos SpaceX og Tesla fra 28. juni; API lansert 8. juli | Innledende trening ventes ferdig denne uken; lansering planlagt i august |
| API-pris | 2 dollar per 1 million input-tokens og 6 dollar per 1 million output-tokens | Ikke kunngjort |
| Rapportert ytelse | xAI hevder at modellen er på nivå med eller bedre enn Claude Opus; ingen uavhengige tester er publisert | xAI hevder at modellen skal slå Grok 4.5 og har som mål å overgå Kimi K3 |
Det viktigste forbeholdet er at ingen uavhengige tredjepartstester av Grok 4.5 er publisert. Påstandene om ytelse kommer fra xAI selv . En xAI-ingeniør har også sagt at Grok 4.5 fikk tilført «Cursor-data» i en ekstra treningsrunde. Dette skal ikke ha vært like effektivt som å ha dataene med i den opprinnelige treningen .
Kimi K3 er en Mixture-of-Experts-modell (MoE) med 2,8 billioner parametere, et kontekstvindu på én million tokens og innebygd synsstøtte. Moonshot AI beskriver den som den største modellen med åpne vekter som er lansert, og som den første i 3T-klassen .
Selv om modellen totalt har 896 eksperter, aktiveres bare 16 for hvert token. Det kan redusere beregningskostnadene sammenlignet med en modell der alle delene brukes hele tiden .
Grok 4.6 er altså mindre enn Kimi K3 målt i totalt antall parametere. xAI ser derfor ut til å satse på mer effektiv arkitektur og optimalisering under kjøring, heller enn å vinne på størrelse alene .
Her blir forskjellen mellom modellene særlig viktig. Grok 4.5 mangler fortsatt uavhengige benchmarkresultater, og alle konkurransepåstander fra xAI er selskapets egne. Kimi K3 er på sin side blitt vurdert av uavhengige aktører og ligger på tredjeplass globalt på omfattende rangeringer, bak Anthropic-modellen Claude Fable 5 og OpenAIs GPT-5.6 Sol .
Kimi K3 skal også ha prestert bedre enn Claude Fable 5 i enkelte tester av programmering og webutvikling . Moonshot-modellens API er dessuten rapportert å koste omtrent halvparten av tilsvarende frontmodeller som Claude Fable 5 og GPT-5.6 Sol, selv om det ikke foreligger en entydig prisbekreftelse fra de mest autoritative kildene .
Det finnes likevel ingen uavhengig, direkte sammenligning mellom Grok og Kimi K3. Inntil slike tester publiseres, er Musks påstand om at Grok 4.6 vil slå Kimi K3 nettopp det: en påstand.
Grok 4.6 inngår i en større plan for rask skalering:
Kampen handler ikke bare om selve språkmodellene. 15.–16. juli 2026 publiserte xAI også Grok Build som åpen kildekode under Apache 2.0-lisensen. Det Rust-baserte kodeverktøyet ligger på GitHub i prosjektet xai-org/grok-build .
Grok Build har åtte parallelle underagenter, en arbeidsflyt som starter med planlegging, og en såkalt Arena Mode. Lanseringen kom etter en personvernkontrovers der sikkerhetsforskere fant at en tidligere versjon lastet opp brukernes komplette arbeidsmapper til xAIs servere . Ved å åpne kildekoden forsøker xAI å bygge tillit og få raskere støtte fra utviklermiljøet.
Musk har også sagt at xAI gjør daglige forbedringer av Grok Build basert på tilbakemeldinger fra brukerne . Det plasserer verktøyet i direkte konkurranse med etablerte kodeassistenter som Cursor og GitHub Copilot.
Musk kunngjorde Grok 4.6 bare to dager etter Kimi K3s lansering. Tidspunktet og formuleringen gjør modellen til et tydelig konkurranseutspill mot Moonshot AI.
xAIs månedlige lanseringsplan er uvanlig ambisiøs, og Grok 5-planene viser at selskapet sikter mot langt større modeller. Men størrelsen alene avgjør ikke hvem som leder. Så lenge xAI-modellene mangler uavhengige benchmarkresultater, kan ingen utenfor selskapet bekrefte at Grok 4.6 faktisk er raskere, billigere eller bedre enn Kimi K3.
I det nye AI-kappløpet blir derfor åpenhet nesten like viktig som antall parametere.