DeepSeek reemplazó las tarifas planas por token por un sistema de precios pico/valle el 16 de agosto de 2026. El modelo V4 Flash de DeepSeek, el mejor puntuado en los rankings, solo completó el 53,8% de las tareas con agentes en el mundo real en pruebas independientes de Composio, exponiendo una gran brecha entre lo...
Respuesta de investigación

Create a landscape editorial hero image for this Studio Global article: What pricing changes did DeepSeek implement for its V4 API models on August 16, 2026, how does the new peak and off-peak tiered structure co. Article summary: **Pi Agent** led in both success rate (20/30) and cost efficiency ($0.028/task).. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence
El 16 de agosto de 2026, DeepSeek implementó uno de los cambios de precios más significativos en el mercado de API de IA, reemplazando las tarifas planas por token con una estructura de precios pico/valle que disparó los costos hasta un 1.555% para ciertos tipos de token . Esa misma semana, la firma de pruebas independiente Composio reveló que el modelo V4 Flash, el mejor clasificado de DeepSeek, solo completó el 53,8% de las tareas del mundo real con agentes en ocho plataformas de orquestación diferentes, exponiendo una gran brecha entre las puntuaciones de los rankings y la fiabilidad en producción
. En conjunto, estos acontecimientos obligan a las empresas a reconsiderar el costo total y la madurez de la orquestación necesaria para implementar DeepSeek V4 a escala.
A partir de las 16:00 UTC del 16 de agosto de 2026, DeepSeek pasó de una tarifa plana única a un modelo de precios de dos niveles tanto para V4-Flash como para V4-Pro . Las horas pico son de 01:00 a 04:00 UTC y de 06:00 a 10:00 UTC (7 horas en total al día); todas las demás horas son valle
. Las tarifas en hora valle son exactamente la mitad de las tarifas pico, pero cada categoría de token sigue siendo más cara que con los precios planos anteriores
.
| Modelo | Tipo de token | Tarifa plana anterior | Valle (nueva) | Pico (nueva) | Cambio efectivo |
|---|---|---|---|---|---|
| V4-Flash | Entrada (cache miss) | $0,14 | $0,21 | $0,42 | +50% valle, +200% pico |
| V4-Flash | Entrada (cache hit) | $0,0028 | $0,007 | $0,014 | +150% valle, +400% pico |
| V4-Flash | Salida | $0,28 | $0,42 | $0,84 | +50% valle, +200% pico |
| V4-Pro | Entrada (cache miss) | $0,435 | $0,99 | $1,98 | +128% valle, +355% pico |
| V4-Pro | Entrada (cache hit) | $0,003625 | $0,03 | $0,06 | +728% valle, +1.555% pico |
| V4-Pro | Salida | $0,87 | $1,98 | $3,96 | +128% valle, +355% pico |
Datos de precios de la tarifa publicada por DeepSeek y rastreadores independientes .
El aumento más extremo es la entrada de V4-Pro con acierto de caché, que pasó de $0,003625 a $0,06 en hora pico, un incremento de aproximadamente el 1.555% . DeepSeek dijo que el cambio se hizo para asignar los recursos de manera más eficiente y alentar a los usuarios a programar cargas de trabajo no urgentes durante las horas valle
.
En agosto de 2026, la firma de pruebas independiente Composio evaluó DeepSeek V4 Flash en ocho plataformas de orquestación de agentes diferentes en 30 flujos de trabajo deliberadamente difíciles y de múltiples pasos que abarcaban herramientas en vivo como Gmail, GitHub, Slack y Google Sheets . Cada tarea tenía un tiempo de espera de 900 segundos, y todas las plataformas usaron las mismas herramientas MCP alojadas de Composio
.
El resultado general: de 240 ejecuciones totales, solo 129 tuvieron éxito, una tasa de aprobación general del 53,8%. Solo 6 de los 30 flujos de trabajo se completaron con éxito en todas las plataformas .
| Plataforma | Tasa de aprobación (de 30 tareas) | Costo por tarea exitosa |
|---|---|---|
| Pi Agent | 20/30 (66,7%) | $0,028 |
| Prime Agent | ~15/24 (62,5% ejecuciones válidas) | $0,131 |
| OMP (Oh My Pi) | 17/30 (56,7%) | $0,103 |
| Claude Code | 16/30 (53,3%) | $0,195 |
| Codex | 16/30 (53,3%) | $0,081 |
| Deep Agents (LangChain) | 16/30 (53,3%) | $0,045 |
| Hermes Agent | 15/30 (50,0%) | $0,056 |
| OpenCode | 14/30 (46,7%) | $0,067 |
Datos de los resultados publicados por Composio .
Pi Agent lideró tanto en tasa de éxito (20/30) como en eficiencia de costos ($0,028/tarea) . Una plataforma diferente ganó en cada métrica (tasa de éxito, costo y velocidad), lo que significa que la elección de la orquestación importa tanto como la capacidad del modelo
. La brecha de 20 puntos entre la mejor y la peor plataforma demuestra una sensibilidad extrema al framework del agente, la configuración de las herramientas, el almacenamiento en caché, los reintentos y la pila del proveedor
.
La combinación de precios más altos y resultados desiguales en el mundo real ha remodelado las opiniones de los analistas sobre la idoneidad de DeepSeek V4 para las empresas.
VentureBeat señaló que el mismo modelo V4 Flash produjo resultados sustancialmente diferentes dependiendo de la plataforma, las herramientas y la pila de caché, lo que sugiere que las empresas deben invertir en la madurez de la orquestación junto con la selección del modelo . El propio comentario de Composio señaló que la elección de la plataforma por sí sola cambió el éxito en tres tareas, el costo en casi 3 veces y la velocidad en 2,2 veces
.
Incluso en horas valle, cada tipo de token es más caro que antes. Los analistas dicen que esto cambia el cálculo del ROI para cargas de trabajo de agentes de alto volumen, particularmente para agentes de atención al cliente y canales de generación de código que antes dependían de los precios agresivamente bajos de DeepSeek .
Los benchmarks oficiales de agentes de DeepSeek (82,7 en Terminal-Bench 2.1, 70,3 en Toolathlon-Verified) se ven sólidos, pero la tasa de aprobación del 53,8% en el mundo real es un recordatorio de que las puntuaciones de los rankings no garantizan la fiabilidad en entornos de producción con API en vivo, límites de velocidad y flujos de trabajo con estado .
El tráfico de la API se enruta a través de servidores en China, lo que crea desafíos de cumplimiento para las empresas reguladas. Los analistas aconsejan una planificación arquitectónica cuidadosa para la gobernanza de datos, las pistas de auditoría y los controles de permisos de herramientas . Para las industrias reguladas, el autoalojamiento de los pesos abiertos sigue siendo el único camino viable hacia la producción
.
El marco empresarial de BayTech Consulting recomienda DeepSeek V4 para el resumen de documentos no confidenciales, la generación de código en repositorios abiertos y la redacción de contenido de alto volumen, pero exige una evaluación rigurosa carga de trabajo por carga de trabajo antes de comprometerse con la producción .
Studio Global AI
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
DeepSeek reemplazó las tarifas planas por token por un sistema de precios pico/valle el 16 de agosto de 2026.
DeepSeek reemplazó las tarifas planas por token por un sistema de precios pico/valle el 16 de agosto de 2026. El modelo V4 Flash de DeepSeek, el mejor puntuado en los rankings, solo completó el 53,8% de las tareas con agentes en el mundo real en pruebas independientes de Composio, exponiendo una gran brecha entre los benchmar...
La elección del 'harness' o plataforma de orquestación es clave: el rendimiento del mismo modelo varió hasta 20 puntos porcentuales (del 66,7% al 46,7%) según el framework utilizado.