SpaceXAI veröffentlichte Grok 4.6 am 12. August 2026. Unabhängige Tests von Artificial Analysis bestätigen die Benchmark Angaben von SpaceXAI innerhalb von 0,08 Punkten.
Forschungsantwort

Create a landscape editorial hero image for this Studio Global article: What did SpaceXAI's August 12, 2026 launch of Grok 4.6 entail in terms of pricing, benchmark performance, architectural approach, early inde. Article summary: ## Grok 4.6 Launch — August 12, 2026. Topic tags: general, news, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
Am 12. August 2026 veröffentlichte SpaceXAI (ehemals xAI, seit Februar 2026 mit SpaceX fusioniert) Grok 4.6 – nur 35 Tage nach Grok 4.5 . Der Launch katapultierte SpaceXAI zurück in die Spitzengruppe der KI-Modelle. Doch schon am nächsten Tag konterte Google mit Gemini 3.7 Flash und heizte damit den Preiskampf um die Gunst der Entwickler weiter an.
Grok 4.6 kostet unverändert 2,00 Dollar pro Million Input-Tokens und 6,00 Dollar pro Million Output-Tokens bei einem Kontextfenster von 500.000 Tokens . Schnellere Varianten sind zum doppelten Preis erhältlich
. Damit liegt das Modell rund 60 % unter den Listenpreisen von GPT-5.6 Sol oder Claude Opus 5
.
Google setzt mit Gemini 3.7 Flash, veröffentlicht am 13. August, noch einen drauf: Zum Einführungspreis von 0,75 Dollar pro Million Input-Tokens und 3,75 Dollar pro Million Output-Tokens kostet das Modell nur halb so viel wie sein Vorgänger Gemini 3.6 Flash und etwa ein Drittel von Grok 4.6 . Der Einführungspreis gilt bis zum 31. Dezember 2026, danach verdoppelt er sich
.
Die Preisstrategie zeigt zwei unterschiedliche Ansätze: Grok 4.6 tritt auf Augenhöhe mit Spitzenmodellen wie GPT-5.6 Sol und Claude Opus 5 an, während Gemini 3.7 Flash als preiswerter "Workhorse" positioniert ist – mit Leistung vergleichbar mit Claude Sonnet 5 und GPT-5.6 Terra, aber zu einem Bruchteil der Kosten .
Grok 4.6 erzielte 61 Punkte im Artificial Analysis (AA) Intelligence Index, einem zusammengesetzten Maß aus neun Einzelbewertungen . Damit ist es gleichauf mit GPT-5.6 Sol Max, liegt einen Punkt hinter Claude Fable 5 Max (62) und zwei Punkte hinter Claude Opus 5 Max (63) – das erste Mal, dass ein xAI-Modell die Spitzengruppe erreicht hat
.
| Benchmark | Grok 4.6 (High) | Grok 4.5 (High) | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 (Elo) | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69,9 % | 66,7 % | 67,2 % | 70,5 % |
| AA-Briefcase | 1577 | – | – | – |
SpaceXAI meldet Verbesserungen gegenüber Grok 4.5 in jeder aufgeführten Evaluierung, darunter CursorBench, FrontierCode, APEX-Agents und Terminal-Bench . Unabhängige Tests von Artificial Analysis bestätigen die Angaben mit einer vernachlässigbaren Abweichung von 0,08 Punkten
.
Besonders stark schnitt Grok 4.6 bei Wissensarbeits-Benchmarks ab – es führt das Feld bei GDPval-AA v2 (1753 Elo), AA-Briefcase (1577) und dem Harvey-Rechtsbenchmark an. Das deutet darauf hin, dass das Modell besonders für professionelle Wissensarbeit geeignet ist . Trotz der Vermarktung als agentisches Codier-Modell liegt sein CursorBench v3.2-Ergebnis (69,9 %) hinter Fable 5 Max (70,5 %), schlägt aber GPT-5.6 Sol Max (67,2 %)
.
Gemini 3.7 Flash verzeichnete ebenfalls deutliche Zuwächse bei Codier- und Agenten-Benchmarks. Im FrontierCode v1.1 erzielte es 43,6 % bei der produktionsreifen Codegenerierung, gegenüber 34,4 % bei 3.6 Flash und vor Claude Sonnet 5 (42,7 %) und GPT-5.6 Terra (41,3 %) . Auch bei DeepSWE v1.1 (von 49,0 % auf 65,3 %) und AutomationBench (von 17,0 % auf 30,4 %) gab es große Sprünge
.
Die wichtigste Neuerung bei Grok 4.6 ist die xhigh-Argumentationsstufe, ein intensiver Reasoning-Modus für die anspruchsvollsten Agenten- und Codieraufgaben . Das Modell wurde für langlebige Agenten-Durabilität optimiert – es erledigt Aufgaben in etwa halb so vielen Iterationen wie Claude Opus 5 und benötigt nur etwa ein Viertel der Input-Tokens zum gelisteten Preis
. Dieser Effizienzvorteil ist sein stärkstes Verkaufsargument für Entwickler, die mehrstündige Codier-Sessions durchführen
.
SpaceXAI führt die Verbesserungen auf ein längeres ergänzendes Training sowie deutlich verbessertes überwachtes Feintuning und Reinforcement Learning zurück – nicht auf eine Erhöhung der Parameteranzahl . Das Modell behält die gleiche 1,5-Billionen-Parameter-V9-Grundlage wie Grok 4.5
.
Gemini 3.7 Flash führt derweil konfigurierbare Thinking-Konfigurationen ein, um das Verhältnis von Qualität, Kosten und Latenz zu steuern, und ist das erste Google-Modell mit agentischer Videoverarbeitung .
Stärken von Grok 4.6:
Grenzen von Grok 4.6:
Bereits zwei Tage nach dem Launch, am 14. August 2026, wurde Grok 4.6 in GitHub Copilot integriert – auf allen wichtigen Entwicklungsoberflächen :
GitHub beschrieb das Modell im offiziellen Changelog als "für agentisches Codieren und komplexe, mehrstufige Workflows entwickelt" . Die schnelle Integration zeigt die starke Nachfrage der Entwicklerplattform .
Die Launch-Sequenz vom 12.–13. August zeigt zwei unterschiedliche Wettbewerbsstrategien:
Grok 4.6 (SpaceXAI) – 2/6 Dollar pro MTok – AA Index 61 – 500K Kontext – Für agentisches Codieren und Wissensarbeit – Effizienzvorteil gegenüber Opus 5
Gemini 3.7 Flash (Google) – 0,75/3,75 Dollar pro MTok (Einführungspreis) – Workhorse-Leistung vergleichbar mit Claude Sonnet 5 und GPT-5.6 Terra – 1M Kontext – Erstes Gemini-Modell mit agentischer Videoverarbeitung – Antrieb für Gemini Spark
Grok 4.6 konkurriert mit Intelligenz zum Discountpreis im Frontier-Segment, während Gemini 3.7 Flash mit einem aggressiven Preis im Workhorse-Segment punktet. Googles Entscheidung, Gemini 3.7 Flash zum halben Preis seines Vorgängers anzubieten und keinen Termin für das Flaggschiff Pro zu nennen, deutet auf eine bewusste Strategie zur Marktanteilsgewinnung hin .
Grok 4.6 hat SpaceXAI erfolgreich zurück an die KI-Spitze geführt. Es erreicht die zusammengesetzte Intelligenz von GPT-5.6 Sol zu deutlich geringeren Kosten und mit einem echten Effizienzvorteil bei Agentenaufgaben. Die Grenzen – keine Spitzenposition bei einzelnen Codier-Benchmarks, Rückstand auf Claude Opus 5 und keine Preissenkung – schmälern den Erfolg nicht grundlegend.
Googles Antwort kam nur 24 Stunden später und stellte die gesamte Preisfrage neu. Mit etwa einem Drittel der Kosten von Grok 4.6 bietet Gemini 3.7 Flash starke Codier- und Agentenleistung zu einem Workhorse-Preis – und obendrein ein 1M-Token-Kontextfenster. Die Wettbewerbslandschaft ist nun klar zweigeteilt: Frontier-Intelligenz zum Discount (Grok 4.6) versus Workhorse-Leistung zum Schnäppchenpreis (Gemini 3.7 Flash).
Entwickler und Unternehmen stehen vor einer echten Wahl – nicht zwischen gut und schlecht, sondern zwischen zwei sehr unterschiedlichen Wertversprechen. Die schnelle GitHub Copilot-Integration von Grok 4.6 deutet darauf hin, dass zumindest eines davon bereits sein Publikum gefunden hat.
Studio Global AI
Diese Seite enthält eine quellengestützte Antwort, die Sie in Studio Global fortsetzen können.
SpaceXAI veröffentlichte Grok 4.6 am 12. August 2026.
SpaceXAI veröffentlichte Grok 4.6 am 12. August 2026. Unabhängige Tests von Artificial Analysis bestätigen die Benchmark Angaben von SpaceXAI innerhalb von 0,08 Punkten.
Bereits zwei Tage nach dem Launch integriert GitHub Copilot Grok 4.6 auf acht Entwicklungsoberflächen.