El 30 de julio de 2026, OpenAI recortó los precios de su modelo GPT 5.6 Luna en un 80%, pasando a costar 0,20 dólares por millón de tokens de entrada. El modelo GPT 5.6 Sol mantuvo su precio de 5/30 dólares por millón de tokens, pero ganó un modo rápido premium.

Create a landscape editorial hero image for this Studio Global article: What are the details of OpenAI's 80% price cut on GPT-5.6 Luna just three weeks after launch, including the new pricing for Luna, Terra, and. Article summary: On July 30, 2026 — roughly three weeks after launch — OpenAI slashed API prices on two GPT-5.6 models while introducing a faster, premium option for its flagship tier. The cuts were enabled by novel infrastructure optimi. Topic tags: general, general web, user generated, documentation, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
El 30 de julio de 2026 —apenas tres semanas después de su lanzamiento— OpenAI recortó los precios de dos de sus tres modelos GPT-5.6 y añadió una opción rápida premium para su nivel insignia. La rebaja fue posible gracias a que el propio modelo reescribió de forma autónoma los kernels de GPU de producción de OpenAI, y ocurre cuando un competidor chino de código abierto, otros laboratorios estadounidenses y la disciplina de costes empresarial confluyen para redefinir las expectativas de precios en toda la industria de la IA.
Las reducciones entraron en vigor el 30 de julio . Esta es la nueva tarifa completa:
El precio combinado de entrada y salida de Luna bajó a 1,40 dólares por millón de tokens, lo que lo convierte en uno de los modelos de frontera más baratos del mercado . El precio combinado de Terra cayó a 14 dólares por millón de tokens. El modo rápido de Sol ofrece hasta 2,5 veces la velocidad del procesamiento estándar al doble del precio estándar, sin pérdida de inteligencia
.
El aspecto más notable del recorte es la historia de ingeniería que lo sustenta. El 29 de julio, OpenAI reveló que GPT-5.6 Sol había reescrito y optimizado de forma autónoma sus propios kernels de GPU de producción —el código de bajo nivel que realmente ejecuta los modelos en el hardware— .
Usando el entorno de desarrollo Codex, GPT-5.6 Sol se conectó a la infraestructura interna de OpenAI, diseñó y ejecutó cientos de experimentos de arquitectura, lanzó y monitorizó despliegues, e iteró sobre los resultados . El modelo aprendió sintaxis en Triton y Gluon, los lenguajes de programación utilizados en la pila de kernels de OpenAI
.
Los resultados medibles, anunciados por OpenAI, fueron :
Estos avances fueron parte de una optimización más amplia de la pila. También se mencionan revisiones del balanceo de carga que distribuyen las solicitudes dinámicamente según la geografía, el tipo de acelerador y la disponibilidad de caché, así como el almacenamiento en caché de indicaciones con un TTL de aproximadamente 30 minutos que hace que la entrada en caché sea un 90% más barata que la entrada nueva .
La decisión de OpenAI de recortar los precios de forma tan agresiva —y tan pronto después del lanzamiento— refleja un panorama competitivo que ha cambiado drásticamente en apenas unas semanas.
El Kimi K3 de Moonshot AI (lanzado el 17 de julio) es un modelo de pesos abiertos de 2,8 billones de parámetros de una startup con sede en Pekín que igualó o superó a GPT-5.6 Sol y a Fable 5 de Anthropic en pruebas de codificación de front-end . En el ranking de código front-end de Arena, Kimi K3 obtuvo 1.679 puntos, superando tanto a GPT-5.6 Sol como a Fable 5
. Un análisis independiente publicado el 30 de julio por Startrise AI Labs encontró a Kimi K3 empatado con Claude Opus 5 de Anthropic en una prueba de ingeniería front-end, pero a una fracción del costo: 7,17 dólares para ejecutar la suite completa frente a los 21,17 dólares de Opus 5
.
Kimi K3 se convirtió en el modelo de IA de pesos abiertos más grande del mundo, y Microsoft consideró reemplazar ChatGPT y Claude con él en Copilot, un movimiento que podría ahorrarle a Microsoft hasta 600 millones de dólares (un 60% por token) .
Anthropic lanzó Claude Opus 5 el 24 de julio a 5 dólares por millón de tokens de entrada —la mitad del precio de Fable 5— y supera a Fable 5 en varios parámetros de referencia . Esto añadió presión precisamente en el nivel de precios donde compite GPT-5.6 Sol.
Google y Microsoft también lanzaron múltiples modelos rentables en julio, apretando aún más el segmento medio y económico .
El campo competitivo llevó a OpenAI a posicionar a Luna como un "señuelo" para cargas de trabajo de alto volumen y sensibles al precio, mientras mantiene a Sol como el diferenciador premium .
Los recortes de precios no ocurren en el vacío. Las empresas exigen cada vez más controles presupuestarios estrictos para el gasto en IA, reflejando la forma en que gestionan los costes de la nube.
El 22 de julio de 2026, OpenAI añadió límites de gasto mensuales duros y exigibles a su plataforma API . A diferencia de los topes suaves de junio para ChatGPT Enterprise (que eran funciones de panel de control meramente informativas), la función del 22 de julio hace que las solicitudes activas a la API fallen con un error HTTP 429 una vez que se agota el presupuesto mensual configurado
. Los administradores pueden establecer límites a nivel de organización o de proyecto, y el tope se restablece al inicio de cada ciclo de facturación
.
Esta fue una respuesta directa a un punto de dolor generalizado. Varias fuentes informan que Amazon y otras grandes empresas están imponiendo topes internos y externos al gasto en IA a medida que las empresas examinan el retorno de la inversión . La contratación ha cambiado: Reuters informa que las empresas preocupadas por los costes ahora tratan la IA "como lo hacen con la nube" —con presupuestos dedicados, asignaciones limitadas y compuertas de aprobación a nivel de CIO para despliegues a gran escala
.
Los límites de gasto estrictos de OpenAI ofrecen a las empresas una válvula de seguridad contra los costes descontrolados de los agentes de IA, incluso mientras la empresa ofrece precios por token más bajos. El mensaje es claro: la era de "gastar lo que sea en IA" ha terminado.
Para los desarrolladores y empresas que utilizan la API de OpenAI, las implicaciones a corto plazo son positivas:
La lección más amplia: la guerra de precios de la IA es real, se está acelerando y está impulsada tanto por la eficiencia de la ingeniería —incluyendo el escenario sin precedentes de un modelo que optimiza su propio código de producción— como por la presión competitiva. Las empresas deberían esperar más caídas de precios en toda la industria a medida que estas técnicas de autooptimización maduren y los modelos de pesos abiertos sigan cerrando la brecha de capacidades.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
El 30 de julio de 2026, OpenAI recortó los precios de su modelo GPT 5.6 Luna en un 80%, pasando a costar 0,20 dólares por millón de tokens de entrada.
El 30 de julio de 2026, OpenAI recortó los precios de su modelo GPT 5.6 Luna en un 80%, pasando a costar 0,20 dólares por millón de tokens de entrada. El modelo GPT 5.6 Sol mantuvo su precio de 5/30 dólares por millón de tokens, pero ganó un modo rápido premium.