Google naproti tomu uvedl Gemini 3.7 Flash 13. srpna s úvodní cenou 0,75 dolaru za milion vstupních tokenů a 3,75 dolaru za výstupní – polovina ceny předchůdce Gemini 3.6 Flash a zhruba třetina ceny Groku 4.6 . Tato úvodní cena platí do 31. prosince 2026, poté se zdvojnásobí
.
Rozdíl je markantní: Grok 4.6 konkuruje špičkovým modelům jako GPT-5.6 Sol a Claude Opus 5 svou inteligencí, zatímco Gemini 3.7 Flash je „tahoun střední třídy“ – nabízí výkon srovnatelný s Claude Sonnet 5 a GPT-5.6 Terra za výrazně nižší cenu .
Grok 4.6 dosáhl 61 bodů v Artificial Analysis (AA) Intelligence Indexu, souhrnném hodnocení devíti testů . To je stejně jako GPT-5.6 Sol Max, o bod méně než Claude Fable 5 Max (62) a o dva méně než Claude Opus 5 Max (63) – SpaceXAI se tak poprvé dostala mezi absolutní špičku
.
| Test | Grok 4.6 (High) | Grok 4.5 (High) | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 (Elo) | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69,9 % | 66,7 % | 67,2 % | 70,5 % |
| AA-Briefcase | 1577 | – | – | – |
SpaceXAI hlásí zlepšení oproti Groku 4.5 ve všech testech, včetně CursorBench, FrontierCode, APEX-Agents a Terminal-Bench . Nezávislé testování Artificial Analysis potvrdilo tato tvrzení s odchylkou pouhých 0,08 bodu
.
Nejzajímavější však je, že Grok 4.6 vyniká hlavně v testech znalostní práce – vede v GDPval-AA v2 (1753 Elo), AA-Briefcase (1577) a právním testu Harvey. To naznačuje, že model je obzvlášť vhodný pro profesionální kancelářské úlohy . I když je propagován jako model pro programování, v CursorBench v3.2 (69,9 %) zaostává za Fable 5 Max (70,5 %), i když poráží GPT-5.6 Sol Max (67,2 %)
.
Gemini 3.7 Flash se naopak blýskl v programovacích a agentních testech. Ve FrontierCode v1.1 dosáhl 43,6 % pro produkční kód, oproti 34,4 % u 3.6 Flash a předstihl Claude Sonnet 5 (42,7 %) i GPT-5.6 Terra (41,3 %) . Výrazně si polepšil i v DeepSWE v1.1 (z 49,0 % na 65,3 %) a AutomationBench (ze 17,0 % na 30,4 %)
.
Hlavní novinkou v Groku 4.6 je úroveň uvažování xhigh, což je intenzivní režim určený pro nejnáročnější agentní a programátorské úlohy . Model je optimalizován pro dlouhodobou výdrž agentů – řeší úlohy zhruba v polovině kroků, které potřebuje Claude Opus 5, nebo asi s čtvrtinou vstupních tokenů, a to za uvedenou cenu
. Tato efektivita je pro vývojáře, kteří provozují hodiny trvající programovací session, pravděpodobně nejsilnějším prodejním argumentem
.
SpaceXAI připisuje zlepšení Groku 4.6 delšímu dodatečnému tréninku a výrazně vylepšenému supervised fine-tuningu a posilovanému učení – nikoli zvýšení počtu parametrů . Model si ponechává stejný základ V9 s 1,5 bilionu parametrů jako Grok 4.5
.
Gemini 3.7 Flash mezitím přinesl „přizpůsobitelné konfigurace myšlení“ pro kontrolu poměru kvality, nákladů a latence a je prvním modelem Google s podporou agentního zpracování videa .
Silné stránky Groku 4.6:
Slabé stránky Groku 4.6:
Už dva dny po vydání, 14. srpna 2026, se Grok 4.6 objevil v GitHub Copilot napříč všemi hlavními vývojovými platformami :
GitHub v oficiálním changelogu popsal model jako „navržený pro agentní programování a složité vícestupňové pracovní postupy“ . Rychlá integrace signalizuje silnou poptávku vývojářské platformy po tomto modelu .
Srovnání obou modelů ukazuje dvě odlišné cesty:
Grok 4.6 (SpaceXAI) – 2/6 dolarů za milion tokenů – Špičkový výkon (AA Index 61) – 500 tisíc tokenů – Agentní programování a znalostní práce – Efektivnější než Opus 5
Gemini 3.7 Flash (Google) – 0,75/3,75 dolaru za milion tokenů (úvodní cena) – Výkon srovnatelný s Claude Sonnet 5 a GPT-5.6 Terra – 1 milion tokenů kontextu – První Gemini s agentním zpracováním videa – Pohání Gemini Spark
Grok 4.6 soupeří inteligencí za zvýhodněnou cenu oproti špičce, zatímco Gemini 3.7 Flash soupeří cenou v nižší třídě. Rozhodnutí Google nabídnout Gemini 3.7 Flash za polovinu ceny předchůdce a zároveň neuvést datum vydání vlajkového modelu Pro naznačuje záměrnou strategii získat podíl na trhu ve střední třídě .
Grok 4.6 úspěšně vrátil SpaceXAI mezi elitu, když v celkovém hodnocení inteligence dorovnal GPT-5.6 Sol za výrazně nižší cenu a s reálnou výhodou v efektivitě agentních úloh. Jeho omezení – že nevede v žádném programovacím testu, zaostává za Claude Opus 5 a drží cenu, zatímco konkurenti zlevňují – jsou reálná, ale nesnižují význam úspěchu.
Odpověď Googlu, která přišla už o 24 hodin později, změnila celou cenovou diskuzi. Za zhruba třetinu ceny Groku 4.6 nabídl Gemini 3.7 Flash solidní programovací a agentní výkon za cenu střední třídy – a k tomu kontextové okno 1 milionu tokenů. Konkurenční prostředí je nyní jasně rozdvojené: špičková inteligence za zvýhodněnou cenu (Grok 4.6) versus solidní výkon za babku (Gemini 3.7 Flash).
Vývojáři a firmy stojí před skutečnou volbou – ne mezi dobrým a špatným, ale mezi dvěma velmi odlišnými hodnotovými nabídkami. Rychlá integrace Groku 4.6 do GitHub Copilot napovídá, že alespoň jedna z nich si už našla své publikum.