Grok 4.5 siirtyi SpaceX:n ja Teslan yksityiseen betatestaukseen 28. kesäkuuta 2026. Sen taustalla on 1,5 biljoonan parametrin V9-perustamalli, jonka esikoulutus valmistui 26. toukokuuta . xAI:n API-palveluun Grok 4.5 tuli 8. heinäkuuta hintaan 2 dollaria miljoonaa syötetokenia kohden ja 6 dollaria miljoonaa tulostokenia kohden .
Grok 4.6 kasvattaa parametrimäärää edeltäjäänsä verrattuna noin 33 prosenttia: 1,5 biljoonasta 2 biljoonaan parametriin .
| Ominaisuus | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Parametrit | 1,5 biljoonaa | 2 biljoonaa |
| Perustamalli | V9, koulutus valmistui 26.5.2026 | Seuraavan sukupolven arkkitehtuuri, yksityiskohdat julkistamatta |
| Tila | Yksityinen beta SpaceX:llä ja Teslalla 28.6. alkaen; API julkaistiin 8.7. | Alkuvaiheen koulutus viimeistellään heinäkuun lopulla; julkaisu odotettavissa elokuussa |
| API-hinta | 2 $ / miljoona syötetokenia, 6 $ / miljoona tulostokenia | Ei ilmoitettu |
| Raportoitu suorituskyky | xAI:n mukaan lähellä Claude Opusta tai sen tasoa parempi; riippumattomia vertailuja ei julkaistu | xAI:n mukaan Grok 4.5:tä parempi; tavoitteena Kimi K3:n päihittäminen |
Lupauksiin liittyy kuitenkin olennainen varaus: Grok 4.5:stä ei ole julkaistu riippumattomia kolmannen osapuolen vertailutuloksia. Kaikki suorituskykyä koskevat väitteet ovat xAI:n omia .
Eräs xAI:n insinööri kertoi lisäksi, että Grok 4.5:n koulutuksessa käytettiin täydentävää niin sanottua Cursor-dataa eli erityisesti koodaukseen painottuvaa aineistoa. Hänen mukaansa sen lisääminen jälkikäteen ei ollut yhtä tehokasta kuin datan sisällyttäminen alkuperäiseen koulutukseen .
Muskin ilmoitus tuli vain hieman sen jälkeen, kun kiinalainen Moonshot AI julkaisi Kimi K3:n 16. heinäkuuta 2026 . Kyseessä on 2,8 biljoonan parametrin avoimien painojen Mixture-of-Experts-malli, jonka konteksti-ikkuna yltää miljoonaan tokeniin ja joka tukee kuvan käsittelyä. Mallia on kuvattu suurimmaksi koskaan julkaistuksi avoimien painojen tekoälymalliksi ja ensimmäiseksi niin sanotun kolmen biljoonan parametrin luokan malliksi .
Kimi K3:ssa on yhteensä 896 asiantuntijamallia, mutta kustakin tokenista aktivoituu vain 16. Tämän Mixture-of-Experts-ratkaisun tarkoitus on vähentää laskentakustannuksia .
Musk on itse kehystänyt Grok 4.6:n vastaukseksi Kimi K3:n julkaisuun. xAI:n tavoitteena on päihittää Kimi K3 suorituskyvyssä ja säilyttää samalla Grokin nopeus- ja tehokkuusedut .
Parametrimäärältään Grok 4.6 olisi Kimi K3:a pienempi. xAI näyttääkin lyövän vetoa ennen kaikkea arkkitehtuurin tehokkuuden ja päättelyn optimoinnin, ei pelkän parametrimäärän, varaan .
Tässä piilee koko kilpailuasetelman kiinnostavin kohta. Grok 4.5:stä ei ole riippumattomia benchmark-tuloksia, joten sen asemaa suhteessa muihin huippumalleihin ei voida vahvistaa avoimesti. xAI:n kilpailukykyä koskevat väitteet ovat yhtiön omia arvioita.
Kimi K3:n kohdalla riippumattomia arvioita on sen sijaan raportoitu, ja se on sijoittunut kattavilla vertailulistoilla maailman kolmanneksi Anthropic-yhtiön Claude Fable 5:n ja OpenAI:n GPT-5.6 Solin jälkeen . K3:n on myös kerrottu olevan koodauksessa ja verkkokehityksessä Claude Fable 5:tä parempi tietyissä testeissä .
Kimi K3:n API-hinnan on raportoitu olevan noin puolet vastaavien huippumallien, kuten Claude Fable 5:n ja GPT-5.6 Solin, hinnasta . Tarkkaa tokenikohtaista hintaa ei kuitenkaan löytynyt korkean auktoriteetin lähteistä.
Keskeinen johtopäätös: Grokin ja Kimi K3:n välisestä suorasta, riippumattomasta vertailusta ei ole julkaistu tuloksia. Muskin ja xAI:n väitteet Grokin paremmuudesta ovat toistaiseksi vahvistamattomia sosiaalisen median lausuntoja.
Grok 4.6 ei ole irrallinen julkaisu, vaan osa xAI:n laajempaa skaalaussuunnitelmaa.
Mallien koon lisäksi xAI hakee asemaa ohjelmistokehittäjien työkaluissa. Yhtiö julkaisi Grok Build -koodausagentin avoimena 15.–16. heinäkuuta 2026 Apache 2.0 -lisenssillä. Rustilla kirjoitettu komentorivityökalu julkaistiin GitHubissa repositoriossa xai-org/grok-build .
Grok Build sisältää kahdeksan rinnakkaista aliagenttia, suunnitelma ensin -työnkulun ja Arena Mode -tilan. Julkaisu seurasi yksityisyyteen liittynyttä kohua: tietoturvatutkijat havaitsivat aiemmassa versiossa toiminnan, joka lähetti käyttäjän koko työhakemiston xAI:n palvelimille . Avoimeksi julkaisemalla xAI pyrki lisäämään luottamusta ja vauhdittamaan yhteisön osallistumista.
Musk vahvisti 8. heinäkuuta, että Grok Buildia kehitetään päivittäin käyttäjäpalautteen perusteella . Tämä asettaa työkalun suoraan kilpailemaan Cursorin ja GitHub Copilotin kaltaisten koodausagenttien kanssa.
Muskin 18. heinäkuuta tekemä Grok 4.6 -ilmoitus näyttää selvältä vastaiskulta Moonshot AI:n kaksi päivää aiemmin julkaisemalle Kimi K3:lle. xAI tavoittelee poikkeuksellisen nopeaa, kuukausittaista mallijulkaisujen rytmiä, ja Grok 5:n tiekartta kertoo vielä huomattavasti suuremmista malleista.
Kokoluokka ei kuitenkaan yksin ratkaise kilpailua. Ilman riippumattomia benchmark-tuloksia xAI:n väitteitä ei voida vielä verrata luotettavasti Kimi K3:n raportoituun suorituskykyyn. Tekoälymallien kilpailussa avoimuus onkin yhtä tärkeää kuin biljoonien parametrien lisääminen.