Grok 4.5 wszedł w fazę prywatnej bety w SpaceX i Tesli 28 czerwca 2026 roku, oparty na modelu fundamentowym V9 o 1,5 biliona parametrów, który zakończył wstępne szkolenie 26 maja 2026 . Model udostępniono przez API xAI 8 lipca w cenie $2/1 mln tokenów wejściowych i $6/1 mln tokenów wyjściowych . Grok 4.6 to wzrost o 33% w porównaniu do poprzednika – z 1,5T do 2T parametrów .
| Specyfikacja | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Parametry | 1,5 biliona | 2 biliony |
| Model fundamentowy | V9 (szkolenie ukończone 26 maja 2026) | Następna generacja (szczegóły architektury nieujawnione) |
| Status | Prywatna beta w SpaceX i Tesli od 28 czerwca; API uruchomione 8 lipca | Szkolenie kończy się w tym tygodniu; premiera spodziewana w sierpniu |
| Cennik (API) | $2/1 mln tokenów wejściowych, $6/1 mln tokenów wyjściowych | Jeszcze nieogłoszony |
| Raportowana wydajność | Według xAI bliska/przekraczająca Claude Opus; brak niezależnych benchmarków | Twierdzi, że przewyższa Grok 4.5; ma na celu pokonanie Kimi K3 |
Zasadnicze zastrzeżenie: Nie opublikowano żadnych niezależnych testów porównawczych (benchmarków) dla Grok 4.5 – wszystkie twierdzenia o wydajności pochodzą wyłącznie od xAI . Jeden z inżynierów xAI zauważył, że Grok 4.5 korzystał z dodatkowych danych „Cursor” (skupionych na programowaniu), które nie były uwzględnione w początkowym szkoleniu, co „nie jest tak dobre, jak posiadanie ich w szkoleniu podstawowym” .
Ogłoszenie Muska jest bezpośrednio związane z premierą Kimi K3 od Moonshot AI 16 lipca 2026 . Kimi K3 to model o 2,8 biliona parametrów, z otwartymi wagami (open-weight), wykorzystujący architekturę Mixture-of-Experts (MoE) . Oferuje kontekst o wielkości 1 miliona tokenów oraz natywne możliwości wizyjne. Jest to największy model AI z otwartymi wagami, jaki kiedykolwiek wydano, i pierwszy w klasie „3T” . Aktywuje on tylko 16 z 896 ekspertów na token, co obniża koszty obliczeniowe .
Wpisy Muska wprost przedstawiają Grok 4.6 jako odpowiedź, stwierdzając, że celem jest przewyższenie Kimi K3 przy jednoczesnym zachowaniu przewagi w szybkości i efektywności . Grok 4.6 z 2T parametrów jest mniejszy od Kimi K3 (2,8T), więc xAI stawia na wydajność architektury i optymalizację wnioskowania, a nie surową liczbę parametrów .
To kluczowy punkt: Grok 4.5 nie ma żadnych niezależnych wyników benchmarków. Wszystkie twierdzenia o konkurencyjności pochodzą od samego xAI. Dla porównania, Kimi K3 został niezależnie oceniony i zajmuje 3. miejsce na świecie w kompleksowych rankingach, za Anthropic Claude Fable 5 i OpenAI GPT-5.6 Sol . Opisywany jest jako „dorównujący najpotężniejszym zastrzeżonym systemom amerykańskich rywali” . K3 przewyższa Claude Fable 5 w niektórych testach programowania i tworzenia stron internetowych .
Jeśli chodzi o ceny, API Kimi K3 jest podobno mniej więcej o połowę tańsze niż porównywalne czołowe modele, takie jak Claude Fable 5 i GPT-5.6 Sol .
Kluczowy wniosek: Nie istnieją bezpośrednie, niezależne porównania benchmarków między żadnym modelem Grok a Kimi K3. Wszystkie oświadczenia xAI o wydajności to niezweryfikowane twierdzenia Muska w mediach społecznościowych.
Ogłoszenie z 18 lipca wpisuje się w znacznie większy plan. Oto, co xAI publicznie zadeklarował:
Równolegle do wyścigu modeli, xAI opublikował narzędzie Grok Build jako open source 15-16 lipca 2026 roku na licencji Apache 2.0, udostępniając na GitHub (xai-org/grok-build) swojego agenta programistycznego CLI napisanego w Rust . Grok Build oferuje 8 równoległych podagentów, przepływ pracy „najpierw plan” i tryb Arena. Ruch ten nastąpił po kontrowersjach dotyczących prywatności: badacze bezpieczeństwa odkryli, że wcześniejsza wersja przesyłała całe katalogi robocze użytkowników na serwery xAI . Udostępnienie kodu miało na celu odbudowę zaufania i przyspieszenie adaptacji w społeczności.
Musk osobno potwierdził 8 lipca, że xAI wprowadza codzienne ulepszenia do Grok Build na podstawie opinii użytkowników . To pozycjonuje xAI jako bezpośredniego konkurenta dla istniejących narzędzi programistycznych, takich jak Cursor i GitHub Copilot.
Ogłoszenie Grok 4.6 przez Muska 18 lipca to wyraźny cios odpowiedzi na premierę Kimi K3 od Moonshot AI zaledwie dwa dni wcześniej. Miesięczne tempo wydań xAI jest szybsze niż u jakiegokolwiek innego czołowego laboratorium, a mapa drogowa Grok 5 zapowiada jeszcze większe modele. Jednak brak niezależnych benchmarków dla któregokolwiek modelu xAI oznacza, że wszystkie twierdzenia o konkurencyjności pozostają niezweryfikowane do czasu pojawienia się testów stron trzecich. W wyścigu, w którym przejrzystość jest równie ważna jak skala, ta różnica ma znaczenie.