Muskova vyjádření z 14. září popisují ambiciózní, ale dosud neověřenou cestu k dalším modelům Grok. Grok 4.8 má podle něj během týdne dokončit předtrénování a poté přejít do fáze posilovaného učení (reinforcement learning, RL). Grok 5 pak Musk spojil s možností dosažení umělé obecné inteligence neboli AGI. xAI ale nezveřejnila benchmarky, model card, provozní definici AGI ani harmonogram dodání. Nejde tedy o prokázaný průlom, nýbrž o prognózu zakladatele společnosti.
1
2
4
Co Musk řekl o Groku 4.8, 4.9 a 5
Grok 4.8 Musk popsal jako model s 2,5 bilionu parametrů, trénovaný na novém softwarovém stacku xAI v C++. Předtrénování mělo skončit v daném týdnu a hned poté měla začít fáze RL.
1
2
Pro modely po Groku 4.7 načrtl tuto hierarchii:
- Grok 4.8: „znatelné zlepšení“ oproti verzi 4.7;
- Grok 4.9: pravděpodobně třída Astra nebo Fable;
- Grok 5: „možná lepší než cokoli jiného“; na otázku o AGI přitom Musk odkázal až na Grok 5, nikoli na 4.8.
2
14
Právě formulace je podstatná. „Možná lepší než cokoli jiného“ není měřitelné srovnání. A tvrzení o AGI neupřesňuje, jaké schopnosti, míru spolehlivosti, samostatnosti, bezpečnostní standard či sadu testů by model musel splnit. Média Grok 5 popsala jako deklarovaný průlom xAI směrem k AGI, samotný plán ale postrádá ověřitelné technické detaily.
2
10
Grok 4.7: střízlivější srovnání s konkurencí
U bližšího Groku 4.7 byl Musk opatrnější. Podle něj by měl být „zhruba na úrovni Opus 5.0, ne 5.1“ od Anthropicu: v některých oblastech lepší, v jiných horší. Zároveň připustil, že xAI musí zlepšit multimodální výkon, tedy práci s více typy vstupů, například textem a obrazem.
3
8
To je výrazně užší tvrzení než nárok na celkové prvenství. Zároveň to připomíná, že o modelech 4.8, 4.9 a 5 se mluvilo dříve, než mohli nezávislí vývojáři veřejně otestovat Grok 4.7.
Proč záleží na zpoždění Groku 4.7
Dne 2. září Musk uvedl, že Grok 4.7 bude hotový přibližně za deset dní, což ukazovalo na vydání kolem 12. září. Dne 11. září však napsal, že model potřebuje ještě „několik dní“.
7
20
Jako možné vysvětlení uvedl problém s laděním RL: xAI možná příliš silně penalizovala délku odpovědí. Model pak u obtížných úloh končil předčasně, i když je dokázal vyřešit, a nedostatečně kontroloval vlastní výsledky. Musk to podal jako pravděpodobnou diagnózu, ne jako uzavřené technické zjištění.
20
21
Není to jen otázka kalendáře. Dokončené předtrénování velkého modelu není totéž co spolehlivě vydaný produkt. Termín i samotné vydání mohou ovlivnit chování po RL, vyhodnocení kvality, multimodální schopnosti, spolehlivost, bezpečnostní práce, připravenost nasazení nebo cenový model.
Co bylo v té době skutečně dostupné
K 14. září nebyl Grok 4.7 veřejně vydán. Posledním zdokumentovaným vlajkovým modelem xAI zůstával Grok 4.6, uvedený 12. srpna. U API byla uvedena cena 2 USD za milion vstupních tokenů a 6 USD za milion výstupních tokenů.
3
11
Ve stejném období byly jako zářijové novinky či oznámené nabídky uváděny Claude Fable 5.1, Gemini 3.8 Flash a GPT-6 Astra.
34
45 Konkurenční prostředí sice zvyšuje význam plánu xAI, nepotvrzuje však výkonnostní srovnání u dosud nevydaných verzí Groku.
Praktický závěr: plán je potřeba ověřovat, ne brát jako hotový výsledek
Uváděný rozsah 2,5 bilionu parametrů a nový trénovací stack mohou naznačovat značné infrastrukturní investice. Samy o sobě ale nedokazují schopnosti, spolehlivost ani AGI. Zpoždění Groku 4.7 naopak prakticky ukazuje, že rozhodující může být chování modelu po tréninku.
1
20
Pro vývojáře, zákazníky i investory jsou důležitější konkrétní milníky než obecné formulace z roadmapy:
- Oficiální vydání s dostupným produktem nebo volatelným modelem v API.
- Zveřejněná cena, dokumentace a model card popisující vlastnosti a omezení modelu.
- Reprodukovatelné výsledky benchmarků, včetně multimodálních a dlouhodobých úloh, kde jsou relevantní.
- Jasná definice AGI a hodnoticí standard, než bude možné tvrzení o AGI považovat za něco víc než ambici.
Muskova slova z 14. září tak vymezují zamýšlený směr xAI: Grok 4.8 po předtrénování a RL, silnější 4.9 a mimořádně ambiciózní Grok 5. Nedokazují ale, že by kterýkoli z těchto modelů už dosáhl deklarované úrovně schopností.
2
4