Am 14. September sagte Musk, Grok 4.8 mit 2,5 Billionen Parametern werde in derselben Woche das Vortraining abschließen und anschließend in die RL Phase gehen; Grok 5 positionierte er als xAIs möglichen AGI Kandidaten.
Veröffentlicht vonBearbeitet mit GPT-5.6 TerraBilder erstellt mit GPT Image 2
Forschungsantwort

Create a landscape editorial hero image for this Studio Global article: What did Elon Musk claim on September 14 about xAI’s roadmap toward artificial general intelligence—specifically, that the 2.5-trillion-para. Article summary: Musk’s September 14 roadmap was an aspirational sequence, not a substantiated AGI forecast: Grok 4.8, a claimed 2.5-trillion-parameter model using a new C++ training stack, would finish pretraining that week and then ent. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Elon Musk hat am 14. September einen weitreichenden Fahrplan für xAIs kommende Grok-Modelle skizziert. Demnach sollte Grok 4.8 noch in derselben Woche sein Vortraining abschließen und danach in das Reinforcement Learning (RL) gehen. Grok 5 stellte Musk als Modell in Aussicht, das künstliche allgemeine Intelligenz – kurz AGI – erreichen könnte.
Das ist allerdings eine Ankündigung des Gründers, kein nachgewiesenes AGI-Ergebnis: Öffentliche Benchmarkwerte, eine Modellkarte, eine konkrete AGI-Definition und ein Veröffentlichungstermin fehlten. 1
2
4
Musk bezeichnete Grok 4.8 als Modell mit 2,5 Billionen Parametern, das auf einem neuen C++-Software-Stack von xAI trainiert werde. Nach Abschluss des Vortrainings sollte die RL-Phase folgen. Beim Reinforcement Learning wird ein bereits vortrainiertes Modell mithilfe von Rückmeldungen und Optimierungszielen auf gewünschte Antworten und Verhaltensweisen ausgerichtet. 1
2
Für die Modelle nach Grok 4.7 zeichnete Musk diese grobe Abstufung:
Gerade diese Wortwahl setzt Grenzen für die Aussagekraft. „Möglicherweise besser als alles andere“ ist keine messbare Leistungszusage. Ebenso offen bleibt, welche Fähigkeiten, Fehlerraten, Autonomie, Sicherheitsanforderungen oder Tests ein Modell für xAI überhaupt zur AGI machen würden. Berichte werteten Grok 5 als xAIs beanspruchten AGI-Durchbruch – der zugrunde liegende Fahrplan liefert dafür aber keine überprüfbaren Kriterien. 2
10
Beim näher bevorstehenden Grok 4.7 fiel Musks Einordnung deutlich vorsichtiger aus. Das Modell solle „ungefähr auf dem Niveau von Opus 5.0, nicht 5.1“ liegen – in einigen Bereichen besser, in anderen schlechter. Außerdem müsse xAI die multimodalen Fähigkeiten noch verbessern, also etwa die Verarbeitung und Verbindung von Text, Bildern oder anderen Eingabeformen. 3
8
Das ist etwas anderes als ein Anspruch auf die allgemeine Spitzenposition. Zugleich macht es den weiteren Fahrplan vorläufig: Grok 4.8, 4.9 und 5 wurden diskutiert, obwohl Entwicklerinnen und Entwickler Grok 4.7 noch nicht selbst öffentlich testen konnten.
Am 2. September hatte Musk Grok 4.7 in etwa zehn Tagen angekündigt – das deutete auf einen Start um den 12. September hin. Am 11. September hieß es dann, das Modell brauche noch „ein paar Tage“. 7
20
Als mögliche Erklärung nannte Musk ein Problem beim RL-Feintuning: xAI könnte längere Antworten zu stark bestraft haben. Dadurch breche das Modell anspruchsvolle Aufgaben möglicherweise zu früh ab, obwohl es sie eigentlich lösen könnte, und überprüfe seine Resultate nicht gründlich genug. Musk formulierte das ausdrücklich als mögliche Diagnose, nicht als abschließende technische Erklärung. 20
21
Das ist mehr als eine Terminverschiebung. Es verdeutlicht den Unterschied zwischen einem abgeschlossenen großen Trainingslauf und einem verlässlich einsetzbaren Produkt. Nachtraining, Evaluation, multimodale Qualität, Robustheit, Sicherheit, Einsatzbereitschaft und Preisgestaltung können darüber entscheiden, wann – oder ob – ein Modell tatsächlich veröffentlicht wird.
Stand 14. September war Grok 4.7 nicht öffentlich veröffentlicht. Als jüngstes dokumentiertes Flaggschiff von xAI galt weiterhin Grok 4.6, das am 12. August erschien. Für die API wurden 2 US-Dollar je Million Eingabetokens und 6 US-Dollar je Million Ausgabetokens genannt. 3
11
Parallel waren Claude Fable 5.1, Gemini 3.8 Flash und GPT-6 Astra laut Berichten bereits im September veröffentlicht worden oder offiziell angekündigt. 34
45 Dieser Wettbewerbsrahmen erhöht den Druck auf xAI, belegt aber keine Vergleichsleistung von noch nicht verfügbaren Grok-Modellen.
Die gemeldete Größe von 2,5 Billionen Parametern und der neue Trainings-Stack deuten auf erhebliche Infrastrukturinvestitionen hin. Weder die Parameterzahl noch Rechenkapazität allein beweisen jedoch Leistungsfähigkeit, Verlässlichkeit oder AGI. Die Verzögerung von Grok 4.7 zeigt ganz praktisch, wie entscheidend das Verhalten eines Modells nach dem Training sein kann. 1
20
Für Entwickler, Kunden und Investoren sind daher konkretere Wegmarken wichtiger als ein ambitionierter Fahrplan:
Musks Aussagen vom 14. September zeigen damit vor allem die Richtung, die xAI einschlagen will: erst Grok 4.8 nach Vortraining und RL, dann ein stärkeres Grok 4.9 und schließlich das sehr ambitionierte Grok 5. Sie belegen nicht, dass eines dieser Modelle das angekündigte Leistungsniveau oder AGI bereits erreicht hat. 2
4
Studio Global AI
Diese Seite enthält eine quellengestützte Antwort, die Sie in Studio Global fortsetzen können.
Am 14. September sagte Musk, Grok 4.8 mit 2,5 Billionen Parametern werde in derselben Woche das Vortraining abschließen und anschließend in die RL Phase gehen; Grok 5 positionierte er als xAIs möglichen AGI Kandidaten.
Am 14. September sagte Musk, Grok 4.8 mit 2,5 Billionen Parametern werde in derselben Woche das Vortraining abschließen und anschließend in die RL Phase gehen; Grok 5 positionierte er als xAIs möglichen AGI Kandidaten. Den verspäteten Vorgänger Grok 4.7 ordnete Musk ungefähr auf dem Niveau von Anthropics Opus 5.0 ein – nicht Opus 5.1.
Die verfehlte Zielmarke um den 12. September für Grok 4.7 zeigt: Modellgröße und abgeschlossenes Training reichen nicht aus, um Termin, Zuverlässigkeit oder Leistungsniveau eines veröffentlichten Produkts zu belegen.