Grok 4.5 startete am 28. Juni 2026 in die private Beta bei SpaceX und Tesla, basierend auf dem V9-Foundation-Modell mit 1,5 Billionen Parametern, das sein Vortraining am 26. Mai 2026 abschloss . Es war ab dem 8. Juli über die xAI-API verfügbar, zu Preisen von 2 $ pro 1 Million Input-Token und 6 $ pro 1 Million Output-Token . Grok 4.6 bedeutet einen Anstieg der Parameterzahl um 33 % gegenüber dem Vorgänger – von 1,5 auf 2 Billionen .
| Spezifikation | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Parameter | 1,5 Billionen | 2 Billionen |
| Foundation-Modell | V9 (Training abgeschlossen am 26. Mai 2026) | Nächste Generation (Architekturdetails nicht bekannt) |
| Status | Private Beta bei SpaceX & Tesla seit 28. Juni; API seit 8. Juli | Training schließt diese Woche ab; Einführung im August erwartet |
| Preise (API) | 2 $/1M Input, 6 $/1M Output-Token | Noch nicht angekündigt |
| Berichtete Leistung | Laut Eigenaussage nahe/exceeding Claude Opus; keine unabhängigen Benchmarks veröffentlicht | Behauptet, Grok 4.5 zu übertreffen; Ziel: Kimi K3 überflügeln |
Ein wichtiger Vorbehalt: Es wurden keine unabhängigen Benchmarks von Drittanbietern für Grok 4.5 veröffentlicht – sämtliche Leistungsbehauptungen stammen von xAI selbst . Ein xAI-Ingenieur merkte an, dass Grok 4.5 ergänzende „Cursor-Daten“ (Coding-fokussierte Daten) verwendete, die nicht im initialen Training enthalten waren – „nicht ganz so gut, als ob sie von Anfang an dabei gewesen wären“ .
Der Zeitpunkt von Musks Ankündigung steht in direktem Zusammenhang mit der Veröffentlichung von Kimi K3 durch Moonshot AI am 16. Juli 2026 . Kimi K3 ist ein Modell mit 2,8 Billionen Parametern, offenen Gewichten und Mixture-of-Experts (MoE)-Architektur. Es bietet ein 1-Millionen-Token-Kontextfenster und native Bildverarbeitungsfähigkeiten. Damit ist es das größte jemals veröffentlichte Open-Weight-KI-Modell und das erste in der „3T-Klasse“ . Es aktiviert pro Token nur 16 seiner 896 Experten – eine Designentscheidung, die die Rechenkosten senkt .
Musks Beiträge bezeichnen Grok 4.6 explizit als Antwort auf Kimi K3: Das Ziel sei es, Kimi K3 in der Leistung zu übertreffen, während Groks Vorteile bei Geschwindigkeit und Effizienz erhalten bleiben . Mit 2 Billionen Parametern ist Grok 4.6 kleiner als Kimi K3 mit 2,8 Billionen. xAI setzt also auf Architektureffizienz und Inferenzoptimierung, nicht auf rohe Parameteranzahl .
Hier wird es spannend: Für Grok 4.5 gibt es keine unabhängigen Benchmark-Ergebnisse. Alle Wettbewerbsbehauptungen sind Eigenaussagen von xAI. Im Gegensatz dazu wurde Kimi K3 unabhängig evaluiert und belegt Platz 3 weltweit in umfassenden Ranglisten – hinter Anthropics Claude Fable 5 und OpenAIs GPT-5.6 Sol . Es wird als „auf Augenhöhe mit den leistungsstärksten proprietären Systemen der US-Konkurrenz“ beschrieben . K3 übertrifft Claude Fable 5 in bestimmten Coding- und Webentwicklungs-Benchmarks .
Preislich soll Kimi K3s API etwa halb so teuer sein wie vergleichbare Frontier-Modelle wie Claude Fable 5 und GPT-5.6 Sol . Genaue Preise pro Token wurden in seriösen Quellen nicht gefunden.
Das Fazit: Es gibt keine direkten, unabhängigen Benchmark-Vergleiche zwischen einem Grok-Modell und Kimi K3. Sämtliche Leistungsaussagen von xAI sind unbelegte Behauptungen von Musk in sozialen Medien.
Musks Ankündigung vom 18. Juli ist Teil eines größeren Plans. Hier sind xAIs öffentliche Zusagen:
Parallel zum Modellwettbewerb hat xAI Grok Build am 15./16. Juli 2026 unter der Apache-2.0-Lizenz als Open Source veröffentlicht. Der in Rust geschriebene CLI-Coding-Agent ist auf GitHub unter xai-org/grok-build verfügbar . Grok Build verfügt über 8 parallele Sub-Agents, einen Plan-First-Workflow und einen Arena-Modus. Die Open-Source-Veröffentlichung folgt einer Datenschutzkontroverse: Sicherheitsforscher hatten entdeckt, dass eine frühere Version das gesamte Arbeitsverzeichnis der Nutzer an xAIs Server hochlud . Durch die Offenlegung des Codes will xAI Vertrauen aufbauen und die Community-Adaption beschleunigen.
Musk bestätigte separat am 8. Juli, dass xAI tägliche Verbesserungen an Grok Build vornimmt, basierend auf Nutzerfeedback . Damit positioniert sich xAI direkt gegen etablierte Coding-Agenten wie Cursor und GitHub Copilot.
Musks Ankündigung von Grok 4.6 am 18. Juli ist ein klarer konkurrierender Konter auf Moonshots Kimi-K3-Veröffentlichung nur zwei Tage zuvor. xAIs monatlicher Veröffentlichungsrhythmus ist schneller als der jedes anderen Frontier-Labors, und der Grok-5-Fahrplan deutet auf noch viel größere Modelle hin. Doch das Fehlen unabhängiger Benchmarks für jedes xAI-Modell bedeutet, dass alle Wettbewerbsbehauptungen unbelegt bleiben, bis Tests von Drittanbietern vorliegen. In einem Rennen, das ebenso von Transparenz wie von Größe bestimmt wird, ist diese Lücke bedeutsam.