Los precios son de 0,435 USD por millón de tokens de entrada, 0,87 USD por millón de tokens de salida a tarifas estándar, con descuentos por caché de hasta el 97 % . En el modo de razonamiento de máximo esfuerzo, el precio es de 1,32/3,96 USD por millón de tokens
.
Moonshot AI lanzó lo que llama el "primer modelo abierto del mundo en la clase de 3 billones de parámetros" — un modelo Mixture-of-Experts de 2,8 billones de parámetros que activa 16 de 896 expertos por token, con una ventana de contexto de 1 millón de tokens y capacidades multimodales nativas (visión + texto) . Los pesos completos se publicaron en Hugging Face el 27 de julio bajo una licencia MIT modificada
. Está activo en Kimi.com, Kimi Work, Kimi Code y la API de Kimi
.
El modelo que inició la oleada. GLM-5.2 es un MoE de 744 mil millones de parámetros con unos 40 mil millones activos por token, una ventana de contexto de 1 millón de tokens y una licencia MIT . La evaluación CAISI del NIST califica sus capacidades generales como similares a las de GPT-5.2 (diciembre de 2025) y sus capacidades cibernéticas como similares a las de Claude Opus
. Obtiene una puntuación de 81,0 en Terminal-Bench 2.1 y 62,1 en SWE-bench Pro, la puntuación más alta de peso abierto en el Artificial Analysis Intelligence Index
. El precio de la API es aproximadamente 10 veces más barato que el de Claude o GPT-5
.
Un MoE de 1,6 billones de parámetros (48 mil millones activos por token) con una ventana de contexto de 1 millón de tokens, lanzado bajo una licencia MIT . Su distinción crítica: el primer modelo de un billón de parámetros entrenado y ejecutado completamente con chips chinos domésticos — un clúster de 50.000 chips Huawei Ascend 910B/C
. Según las pruebas de Meituan, supera a GPT-5.5 en los puntos de referencia de ingeniería de software
. Antes del lanzamiento oficial, había estado encabezando silenciosamente la clasificación de OpenLLM como "Owl Alpha"
. El precio de la API es de 0,75/2,95 USD por millón de tokens de entrada/salida, con una promoción de lanzamiento de 0,30/1,20 USD
.
Las empresas fuera de China ahora tienen alternativas creíbles, de bajo costo y peso abierto a los modelos de API estadounidenses. La licencia MIT de GLM-5.2 sin restricciones regionales significa que cualquier empresa puede alojarlo por sí misma con fines comerciales sin restricciones . Esto está cambiando las decisiones de adquisición en el Sudeste Asiático, Oriente Medio, África y partes de Europa.
La evidencia respalda firmemente la tesis de que los controles de exportación de chips de EE. UU. han resultado contraproducentes en al menos dos aspectos:
No se encontraron fuentes que corroboren los precios específicos por tarea de 0,06 USD para DeepSeek V4 Pro o de 2,34 USD para Claude Opus 5. Tencent Hy3 y Alibaba Qwen3.8-Max carecen de especificaciones verificadas o fechas de lanzamiento en la evidencia disponible. Tampoco se pudieron confirmar las afirmaciones sobre el reciente manifiesto de código abierto de Mark Zuckerberg.
Este artículo se basa en la evidencia disponible a mediados de agosto de 2026. Todas las afirmaciones sobre las capacidades de los modelos provienen de puntos de referencia informados por los desarrolladores y evaluaciones de terceros (incluido el CAISI del NIST). La verificación independiente de todas las puntuaciones de los puntos de referencia está en curso en toda la industria. Las comparaciones de costos se basan en los precios de los tokens de API publicados; los costos reales por tarea varían significativamente según la complejidad de la tarea, la longitud del contexto y las tasas de acierto de caché.