Grok 4.5 entró en beta privada en SpaceX y Tesla el 28 de junio de 2026, impulsado por el modelo fundacional V9 de 1,5 billones de parámetros, que completó su preentrenamiento el 26 de mayo de 2026 . Estuvo disponible a través de la API de xAI el 8 de julio a $2 por 1M de tokens de entrada y $6 por 1M de tokens de salida . Grok 4.6 representa un aumento del 33 % en parámetros con respecto a su predecesor, pasando de 1,5T a 2T parámetros .
| Especificación | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Parámetros | 1,5 billones | 2 billones |
| Modelo fundacional | V9 (entrenamiento completado el 26 de mayo de 2026) | Próxima generación (detalles de arquitectura no revelados) |
| Estado | Beta privada en SpaceX y Tesla desde el 28 de junio; API lanzada el 8 de julio | Entrenamiento finalizando esta semana; lanzamiento previsto en agosto |
| Precio (API) | $2/1M tokens de entrada, $6/1M tokens de salida | Aún no anunciado |
| Rendimiento reportado | Autoinformado como cercano o superior a Claude Opus; sin benchmarks independientes publicados | Afirma superar a Grok 4.5; busca superar a Kimi K3 |
Una advertencia crítica: No se han publicado benchmarks independientes de terceros para Grok 4.5 — todas las afirmaciones de rendimiento son propias de xAI . Un ingeniero de xAI señaló que Grok 4.5 usó datos suplementarios de "Cursor" (datos centrados en codificación) que no se incluyeron en el entrenamiento inicial, lo que "no es tan bueno como tenerlos en el entrenamiento inicial" .
El momento del anuncio de Musk está directamente relacionado con el lanzamiento de Kimi K3 por parte de Moonshot AI el 16 de julio de 2026 . Kimi K3 es un modelo MoE (Mixture-of-Experts) de pesos abiertos con 2,8 billones de parámetros, una ventana de contexto de 1 millón de tokens y capacidades de visión nativas, lo que lo convierte en el modelo de IA de pesos abiertos más grande jamás lanzado y el primero en la "clase de 3T" . Activa solo 16 de sus 896 expertos por token, un diseño que reduce los costos computacionales .
Las publicaciones de Musk enmarcan explícitamente a Grok 4.6 como la respuesta, declarando que el objetivo es superar a Kimi K3 en rendimiento mientras se mantienen las ventajas de velocidad y eficiencia de Grok . Grok 4.6, con 2T parámetros, es más pequeño que los 2,8T de Kimi K3, por lo que xAI apuesta por la eficiencia de la arquitectura y la optimización de la inferencia en lugar de por el número bruto de parámetros .
Aquí es donde la historia se vuelve importante: Grok 4.5 no tiene puntuaciones de benchmarks independientes. Todas sus afirmaciones competitivas son autoinformadas por xAI. En contraste, Kimi K3 ha sido evaluado de forma independiente y ocupa el puesto #3 a nivel mundial en los rankings integrales, solo detrás de Claude Fable 5 de Anthropic y GPT-5.6 Sol de OpenAI . Se ha descrito que rinde "codo a codo con los sistemas propietarios más potentes de los rivales estadounidenses" . K3 supera a Claude Fable 5 en ciertos benchmarks de codificación y desarrollo web .
En cuanto a precios, se informa que la API de Kimi K3 cuesta aproximadamente la mitad que la de modelos frontera comparables como Claude Fable 5 y GPT-5.6 Sol . No se encontraron precios exactos por token de fuentes de alta autoridad.
La conclusión clave: No existen comparaciones directas de benchmarks independientes entre ningún modelo de Grok y Kimi K3. Todas las declaraciones de rendimiento de xAI son afirmaciones no verificadas hechas por Musk en las redes sociales.
El anuncio del 18 de julio de Musk encaja en un plan mucho más amplio. Esto es lo que xAI ha comprometido públicamente:
Junto a la carrera de modelos, xAI liberó como código abierto Grok Build el 15 y 16 de julio de 2026 bajo la licencia Apache 2.0, publicando su agente de codificación CLI basado en Rust en GitHub en xai-org/grok-build . Grok Build cuenta con 8 subagentes paralelos, un flujo de trabajo de planificación primero y un Modo Arena. La liberación del código fuente sigue a una controversia de privacidad: investigadores de seguridad encontraron que una versión anterior cargaba los directorios de trabajo completos de los usuarios a los servidores de xAI . Al abrir el código, xAI buscó generar confianza y acelerar la adopción por parte de la comunidad.
Musk confirmó por separado el 8 de julio que xAI está realizando mejoras diarias a Grok Build impulsadas por los comentarios de los usuarios . Esto posiciona a xAI para desafiar directamente a los titanes de agentes de codificación como Cursor y GitHub Copilot.
El anuncio de Musk del 18 de julio sobre Grok 4.6 es un contragolpe competitivo directo al lanzamiento de Kimi K3 de Moonshot, ocurrido solo dos días antes. La cadencia de lanzamiento mensual de xAI es más rápida que la de cualquier otro laboratorio fronterizo, y la hoja de ruta de Grok 5 indica modelos mucho más grandes en el horizonte. Pero la falta de benchmarks independientes para cualquier modelo de xAI significa que todas las afirmaciones competitivas no están verificadas hasta que surjan pruebas de terceros. En una carrera definida tanto por la transparencia como por la escala, esa brecha importa.