O Grok 4.5 entrou em beta privado na SpaceX e na Tesla em 28 de junho de 2026, alimentado pelo modelo fundacional V9 de 1,5 trilhão de parâmetros, que concluiu o pré-treinamento em 26 de maio de 2026 . Ele ficou disponível via API da xAI em 8 de julho, a US$ 2 por 1 milhão de tokens de entrada e US$ 6 por 1 milhão de tokens de saída . O Grok 4.6 representa um aumento de 33% no número de parâmetros em relação ao antecessor, saltando de 1,5T para 2T .
| Especificação | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Parâmetros | 1,5 trilhão | 2 trilhões |
| Modelo fundacional | V9 (treinamento concluído em 26/05/2026) | Próxima geração (detalhes da arquitetura não divulgados) |
| Status | Beta privado na SpaceX e Tesla desde 28/06; API lançada em 08/07 | Treinamento sendo finalizado esta semana; lançamento previsto para agosto |
| Preço (API) | US$ 2/1M tokens entrada, US$ 6/1M tokens saída | Ainda não anunciado |
| Desempenho relatado | Auto-relatado como próximo ou superior ao Claude Opus; sem benchmarks independentes | Alega superar o Grok 4.5; objetivo de ultrapassar o Kimi K3 |
Uma ressalva crítica: nenhum benchmark independente de terceiros foi publicado para o Grok 4.5 — todas as alegações de desempenho são da própria xAI . Um engenheiro da xAI observou que o Grok 4.5 usou dados suplementares de "Cursor" (dados focados em programação) que não estavam incluídos no treinamento inicial, o que "não é tão bom quanto tê-los desde o início" .
O timing do anúncio de Musk está diretamente ligado ao lançamento do Kimi K3 pela Moonshot AI em 16 de julho de 2026 . O Kimi K3 é um modelo Mixture-of-Experts (MoE) de 2,8 trilhões de parâmetros e pesos abertos, com uma janela de contexto de 1 milhão de tokens e capacidade nativa de visão, sendo o maior modelo de pesos abertos já lançado e o primeiro da "classe dos 3T" . Ele ativa apenas 16 de seus 896 especialistas por token, uma escolha de design que reduz os custos computacionais .
As postagens de Musk enquadram explicitamente o Grok 4.6 como a resposta, afirmando que o objetivo é superar o Kimi K3 em desempenho, mantendo as vantagens de velocidade e eficiência do Grok . Com 2 trilhões de parâmetros, o Grok 4.6 é menor que os 2,8T do Kimi K3; portanto, a xAI aposta na eficiência da arquitetura e na otimização da inferência, e não no número bruto de parâmetros .
Aqui a história ganha um ponto importante: o Grok 4.5 não tem pontuações independentes em benchmarks. Todas as suas alegações competitivas são auto-relatadas pela xAI. Em contraste, o Kimi K3 foi avaliado de forma independente e ocupa o 3º lugar global em rankings abrangentes, atrás apenas do Claude Fable 5, da Anthropic, e do GPT-5.6 Sol, da OpenAI . Ele é descrito como tendo um desempenho "página a página com os sistemas proprietários mais poderosos dos rivais dos EUA" . O K3 supera o Claude Fable 5 em certos benchmarks de programação e desenvolvimento web .
Em termos de preço, a API do Kimi K3 custa aproximadamente metade do preço de modelos de fronteira comparáveis, como o Claude Fable 5 e o GPT-5.6 Sol . Não foram encontrados valores exatos por token em fontes de alta autoridade.
A conclusão principal: não existem comparações diretas e independentes de benchmarks entre qualquer modelo Grok e o Kimi K3. Todas as declarações de desempenho da xAI são alegações não verificadas feitas por Musk nas redes sociais.
O anúncio de Musk em 18 de julho se encaixa num plano muito maior. Veja o que a xAI se comprometeu publicamente:
Paralelamente à corrida de modelos, a xAI disponibilizou o código do Grok Build em 15 e 16 de julho de 2026 sob a licença Apache 2.0, publicando seu agente de programação CLI (interface de linha de comando) escrito em Rust no GitHub, em xai-org/grok-build . O Grok Build conta com 8 subagentes paralelos, um fluxo de trabalho que prioriza o planejamento e o Arena Mode. A abertura do código ocorre após uma controvérsia de privacidade: pesquisadores de segurança descobriram que uma versão anterior enviava diretórios de trabalho inteiros dos usuários para os servidores da xAI . Ao abrir o código, a xAI buscou construir confiança e acelerar a adoção pela comunidade.
Musk confirmou separadamente, em 8 de julho, que a xAI está fazendo melhorias diárias no Grok Build com base no feedback dos usuários . Isso posiciona a xAI para desafiar diretamente os incumbentes de agentes de programação, como Cursor e GitHub Copilot.
O anúncio do Grok 4.6 por Musk em 18 de julho é um claro contra-ataque competitivo ao lançamento do Kimi K3 pela Moonshot, apenas dois dias antes. A cadência mensal de lançamentos da xAI é mais rápida do que a de qualquer outro laboratório de fronteira, e o roteiro do Grok 5 sinaliza modelos muito maiores no horizonte. Mas a falta de benchmarks independentes para qualquer modelo da xAI significa que todas as alegações competitivas permanecem não verificadas até que surjam testes de terceiros. Numa corrida definida tanto pela transparência quanto pela escala, essa lacuna importa.