El incremento depende del modelo, del tipo de token y del momento en que se realiza la consulta. Reuters situó la subida entre el 50% y el 1.100% respecto a los precios anteriores.
El porcentaje más llamativo corresponde a los tokens de entrada reutilizados mediante caché, cuyo precio de partida era muy bajo. Para una aplicación real, sin embargo, el impacto dependerá de la combinación de entradas con y sin caché, volumen de salida y concentración del tráfico en las horas punta.
En el caso de V4-Pro, generar tokens de salida cuesta aproximadamente un 128% más en horario valle que con la tarifa promocional anterior de 0,87 dólares, y alrededor de un 355% más durante las horas punta.
Aun con la subida, DeepSeek conserva precios bajos frente a muchos modelos estadounidenses cerrados. La tarifa promocional anterior de V4-Pro rondaba los 0,87 dólares por millón de tokens de salida, muy por debajo de los precios históricos de varios sistemas punteros de Estados Unidos. La ventaja de costes se reduce, pero no desaparece.
Para un desarrollador que genere 10 millones de tokens de salida de V4-Pro al mes, la cuenta sería la siguiente:
Por tanto, el coste mensual de salida aumenta entre 11,10 y 30,90 dólares, según el horario. El cálculo no incluye tokens de entrada, cargos por uso de caché, impuestos ni otras posibles comisiones.
En una aplicación en producción, la factura final puede verse más afectada por la composición del tráfico que por la salida por sí sola. Los sistemas con instrucciones largas, poca reutilización de caché o una elevada concentración de consultas en horas punta podrían experimentar un incremento mayor. Programar tareas por lotes en horario valle y vigilar la tasa de aciertos de caché pasan a ser medidas más importantes.
OpenAI ha elegido una estrategia diferente para ChatGPT. GPT-5.6 Luna se convirtió en el modelo predeterminado para los usuarios de los planes Free y Go, mientras que la empresa anunció chats de texto ilimitados y un nuevo botón Think para preguntas más complejas.
Hay una precisión importante: “ilimitado” se refiere a los chats de texto, no a todas las funciones de ChatGPT. Siguen existiendo límites para subir archivos, generar imágenes, usar la voz, crear imágenes y utilizar otras herramientas, además de controles contra el abuso.
Se trata de una estrategia de distribución al consumidor, no de una rebaja de precios para desarrolladores. OpenAI reduce la fricción del uso cotidiano y coloca un modelo capaz dentro de la experiencia predeterminada de ChatGPT. Según TechCrunch, el servicio había superado recientemente los 1.000 millones de usuarios semanales.
Las tarifas reducidas ayudaron a que los modelos chinos ganaran presencia entre los desarrolladores. Una medición de Vercel AI Gateway indicó que los modelos de código abierto desarrollados en China procesaron el 29% de los tokens de producción en junio de 2026, frente a aproximadamente una novena parte en abril, y representaron menos del 4% del gasto total. La cifra corresponde a ese gateway, no al conjunto del mercado mundial de IA.
La diferencia es relevante: la cuota de tokens mide cuánto trabajo pasa por un sistema, pero no demuestra por sí sola ingresos, beneficios, fidelidad de los clientes ni poder de mercado duradero. Los desarrolladores pueden distribuir sus cargas entre distintos proveedores, y el tráfico más sensible al precio puede cambiar rápidamente cuando las tarifas se modifican.
El nuevo sistema de DeepSeek sugiere que captar usuarios ya no es el único objetivo. Cobrar más en las horas de mayor demanda permite asignar capacidad y mejorar el rendimiento económico de la infraestructura. La documentación oficial presenta el cambio como una medida para distribuir mejor los recursos y anima a los usuarios a programar sus tareas según sus necesidades reales.
La decisión llega en un momento en que otras empresas chinas de IA también exploran modelos de pago o precios más altos. Informaciones sobre el mercado chino describieron planes de pago de Moonshot AI y ByteDance, mientras que Alibaba se preparaba para seguir una dirección similar. El movimiento apunta a un cambio más amplio: de una carrera basada en subsidios agresivos a otra centrada en la monetización.
Eso no demuestra que DeepSeek o sus rivales sean rentables. Sí indica que la cuota de mercado obtenida mediante precios muy bajos debe transformarse, tarde o temprano, en ingresos por token, contratos recurrentes u otra fuente de financiación sostenible.
La ampliación gratuita de Luna prioriza la distribución frente a la tarifa de API más baja posible. Al hacer que el chat de texto sea ampliamente accesible y añadir un control visible de razonamiento, OpenAI intenta convertir ChatGPT en un hábito cotidiano, mientras mantiene límites más estrictos para las funciones de mayor coste.
El contraste estratégico puede resumirse así:
Ambas estrategias pueden coexistir. Un desarrollador puede escoger DeepSeek para cargas de gran volumen, mientras una persona utiliza ChatGPT para asistencia general. Pero las dos compañías buscan que sus ecosistemas sean difíciles de sustituir: DeepSeek mediante el rendimiento por coste y el enrutamiento de cargas; OpenAI mediante la familiaridad del producto y su alcance entre consumidores.
DeepSeek sigue siendo una opción económica, pero describirla simplemente como “el modelo más barato” ya no basta. La comparación debe incluir las entradas con caché, las entradas sin caché, el volumen de salida y la proporción del tráfico que cae en horas punta.
Las preguntas prácticas son:
La carrera tecnológica entre China y Estados Unidos se está desplazando, por tanto, de “quién ofrece el precio más bajo” a “quién puede sostener el uso a gran escala”. DeepSeek está probando si el liderazgo en coste y rendimiento puede convertirse en una economía unitaria viable. OpenAI está probando si el acceso gratuito y el uso habitual entre consumidores pueden traducirse en control duradero del ecosistema.
En ambos casos, el reto de fondo es el mismo: convertir cantidades enormes de uso en un negocio capaz de seguir financiando el elevado coste recurrente de entrenar y ejecutar modelos avanzados.