Для сравнения: Gemini 3.7 Flash, выпущенная 13 августа, стартовала по вводной цене $0,75 за миллион входных токенов и $3,75 за миллион выходных — вдвое дешевле предшественницы Gemini 3.6 Flash и примерно втрое дешевле Grok 4.6 . Вводные цены Google действуют до 31 декабря 2026 года, после чего они удвоятся
.
Контраст разительный: Grok 4.6 конкурирует напрямую с фронтирными моделями вроде GPT-5.6 Sol и Claude Opus 5 по интеллекту, тогда как Gemini 3.7 Flash позиционируется как модель «рабочей лошадки» — с производительностью, сравнимой с Claude Sonnet 5 и GPT-5.6 Terra, но по значительно более низкой цене .
Grok 4.6 набрал 61 балл в Индексе интеллекта Artificial Analysis (AA) — составном показателе из девяти тестов . Это сравняло его с GPT-5.6 Sol Max, поставило на один балл позади Claude Fable 5 Max (62) и на два — позади Claude Opus 5 Max (63). Впервые модель xAI вошла в группу лидеров
.
| Бенчмарк | Grok 4.6 (High) | Grok 4.5 (High) | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| Индекс интеллекта AA | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 (Elo) | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69,9% | 66,7% | 67,2% | 70,5% |
| AA-Briefcase | 1577 | — | — | — |
SpaceXAI сообщила о приросте по каждому из опубликованных тестов по сравнению с Grok 4.5, включая CursorBench, FrontierCode, APEX-Agents и Terminal-Bench . Независимое тестирование от Artificial Analysis подтвердило эти данные с погрешностью всего в 0,08 балла
.
Примечательно, что самые сильные независимые результаты Grok 4.6 показал в задачах, связанных с профессиональными знаниями: он лидировал по GDPval-AA v2 (1753 Elo), AA-Briefcase (1577) и юридическому бенчмарку Harvey. Это говорит о том, что модель особенно хороша для профессиональной интеллектуальной работы . Однако, несмотря на позиционирование как модель для агентов-программистов, её результат в CursorBench v3.2 (69,9%) уступил Fable 5 Max (70,5%), хотя и превзошёл GPT-5.6 Sol Max (67,2%)
.
Gemini 3.7 Flash, в свою очередь, показала значительный рост в тестах на программирование и работу агентов. В FrontierCode v1.1 она набрала 43,6% за генерацию готового к продакшену кода — рост с 34,4% у 3.6 Flash и опережение Claude Sonnet 5 (42,7%) и GPT-5.6 Terra (41,3%) . Также зафиксированы большие скачки в DeepSWE v1.1 (с 49,0% до 65,3%) и AutomationBench (с 17,0% до 30,4%)
.
Главным архитектурным нововведением Grok 4.6 стал новый уровень рассуждений xhigh — интенсивный режим для самых сложных агентских и программных задач . Модель оптимизирована для длительной работы агентов: она решает задачи примерно за половину числа шагов, которые требуются Claude Opus 5, и использует около четверти входных токенов при той же цене
. Это преимущество в эффективности — пожалуй, её главный козырь для разработчиков, работающих над многочасовыми сессиями кодинга
.
В SpaceXAI объяснили улучшения более длительным дополнительным обучением, улучшенным контролируемым fine-tuning и обучением с подкреплением — а не увеличением числа параметров . Модель сохраняет ту же основу V9 с 1,5 триллиона параметров, что и Grok 4.5
.
Gemini 3.7 Flash, тем временем, представила «настраиваемые конфигурации рассуждений» для контроля баланса качества, стоимости и задержки, а также стала первой моделью Google с поддержкой агентской обработки видео .
Сильные стороны Grok 4.6:
Ограничения Grok 4.6:
Через два дня после запуска, 14 августа 2026 года, Grok 4.6 появилась в GitHub Copilot на всех основных платформах разработки :
В официальном журнале изменений GitHub модель описали как «предназначенную для агентского программирования и сложных многошаговых рабочих процессов» . Столь быстрая интеграция говорит о высоком спросе на модель со стороны разработчиков .
Запуски 12–13 августа выявили две разные конкурентные стратегии:
Grok 4.6 (SpaceXAI) — $2/$6 за MTok — Фронтирный составной показатель (AA Index 61) — Контекст 500K — Предназначена для агентского программирования и интеллектуальной работы — Преимущество в эффективности перед Opus 5
Gemini 3.7 Flash (Google) — $0,75/$3,75 за MTok (вводная цена) — Производительность уровня рабочей лошадки, сравнимая с Claude Sonnet 5 и GPT-5.6 Terra — Контекст 1M — Первая модель Gemini с агентской обработкой видео — Питает Gemini Spark
Grok 4.6 конкурирует за интеллект со скидкой к фронтиру, тогда как Gemini 3.7 Flash конкурирует за цену со скидкой к уровню рабочих лошадок. Решение Google предложить Gemini 3.7 Flash вдвое дешевле предшественницы и не называть дату выпуска флагманской Pro-модели указывает на осознанную стратегию захвата доли рынка в среднем сегменте .
Grok 4.6 успешно вернула SpaceXAI в число лидеров, сравнявшись с GPT-5.6 Sol по составному интеллекту при значительно более низкой стоимости и с реальным преимуществом в эффективности для агентских задач. Её ограничения — отсутствие первого места в отдельных бенчмарках по программированию, отставание от Claude Opus 5 по общему интеллекту и сохранение цен на фоне агрессивных снижений у конкурентов — реальны, но не умаляют достижения.
Ответ Google, поступивший всего через 24 часа, полностью переформатировал разговор о ценах. При стоимости примерно втрое ниже, чем у Grok 4.6, Gemini 3.7 Flash предложила сильную производительность в программировании и агентских задачах по цене рабочей лошадки — и с контекстным окном в 1 миллион токенов вдобавок. Конкурентный ландшафт теперь чётко разделился: фронтирный интеллект со скидкой (Grok 4.6) против производительности рабочей лошадки по бросовой цене (Gemini 3.7 Flash).
Разработчики и компании стоят перед реальным выбором — не между плохим и хорошим, а между двумя совершенно разными ценностными предложениями. Быстрая интеграция Grok 4.6 в GitHub Copilot говорит о том, что как минимум одно из них уже нашло свою аудиторию.