Em 16 de agosto de 2026, a DeepSeek substituiu a tarifa fixa por precificação por pico e fora de pico, elevando o custo do V4 Pro de saída de US$ 0,87 para US$ 3,96 por milhão de tokens no horário de pico — alta de 355%. O modelo V4 Flash, topo de linha em rankings, completou apenas 53,8% das tarefas em testes com 8...
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What pricing changes did DeepSeek implement for its V4 API models on August 16, 2026, how does the new peak and off-peak tiered structure co. Article summary: **Pi Agent** led in both success rate (20/30) and cost efficiency ($0.028/task).. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence
Em 16 de agosto de 2026, a DeepSeek implementou uma das maiores mudanças de preço no mercado de APIs de IA, substituindo as taxas fixas por token por uma estrutura de pico e fora de pico que elevou os custos em até 1.555% para certos tipos de token . Na mesma semana, a empresa de testes independentes Composio revelou que o modelo V4 Flash, o mais bem classificado da DeepSeek, completou apenas 53,8% das tarefas reais com agentes em oito diferentes frameworks de orquestração, expondo uma lacuna enorme entre as pontuações em rankings e a confiabilidade em produção
. Juntos, esses desenvolvimentos forçam as empresas a reconsiderar o custo total e a maturidade de orquestração necessários para implantar o DeepSeek V4 em escala.
A partir das 16:00 UTC de 16 de agosto de 2026, a DeepSeek mudou de uma taxa fixa única para um modelo de dois níveis, tanto para o V4-Flash quanto para o V4-Pro . Os horários de pico são 01:00–04:00 UTC e 06:00–10:00 UTC (7 horas no total por dia); todos os outros horários são considerados fora de pico
. As taxas fora de pico são exatamente metade das taxas de pico, mas cada categoria de token ainda sofreu um aumento líquido em relação ao preço fixo anterior
.
| Modelo | Tipo de token | Taxa fixa anterior | Fora de pico (nova) | Pico (nova) | Variação efetiva |
|---|---|---|---|---|---|
| V4-Flash | Entrada (cache miss) | $0,14 | $0,21 | $0,42 | +50% fora de pico, +200% pico |
| V4-Flash | Entrada (cache hit) | $0,0028 | $0,007 | $0,014 | +150% fora de pico, +400% pico |
| V4-Flash | Saída | $0,28 | $0,42 | $0,84 | +50% fora de pico, +200% pico |
| V4-Pro | Entrada (cache miss) | $0,435 | $0,99 | $1,98 | +128% fora de pico, +355% pico |
| V4-Pro | Entrada (cache hit) | $0,003625 | $0,03 | $0,06 | +728% fora de pico, +1.555% pico |
| V4-Pro | Saída | $0,87 | $1,98 | $3,96 | +128% fora de pico, +355% pico |
Dados de preço da tabela de preços publicada pela DeepSeek e rastreadores independentes .
O aumento mais extremo é no V4-Pro para entrada com cache hit, que foi de $0,003625 para $0,06 no pico — um aumento de aproximadamente 1.555% . A DeepSeek afirmou que a mudança foi feita para alocar recursos de forma mais eficiente e incentivar os usuários a agendar tarefas não urgentes durante as janelas fora de pico
.
Em agosto de 2026, a empresa de testes independentes Composio avaliou o DeepSeek V4 Flash em oito diferentes frameworks de orquestração de agentes (harnesses) em 30 fluxos de trabalho deliberadamente difíceis e com várias etapas, abrangendo ferramentas reais como Gmail, GitHub, Slack e Google Sheets . Cada tarefa tinha um tempo limite de 900 segundos, e todos os frameworks usaram as mesmas ferramentas MCP hospedadas pela Composio
.
O resultado geral: em 240 execuções totais, apenas 129 foram bem-sucedidas — uma taxa de aprovação geral de 53,8%. Apenas 6 dos 30 fluxos de trabalho foram concluídos com sucesso por todos os frameworks .
| Framework | Taxa de aprovação (de 30 tarefas) | Custo por tarefa bem-sucedida |
|---|---|---|
| Pi Agent | 20/30 (66,7%) | $0,028 |
| Prime Agent | ~15/24 (62,5% execuções válidas) | $0,131 |
| OMP (Oh My Pi) | 17/30 (56,7%) | $0,103 |
| Claude Code | 16/30 (53,3%) | $0,195 |
| Codex | 16/30 (53,3%) | $0,081 |
| Deep Agents (LangChain) | 16/30 (53,3%) | $0,045 |
| Hermes Agent | 15/30 (50,0%) | $0,056 |
| OpenCode | 14/30 (46,7%) | $0,067 |
Dados dos resultados publicados pela Composio .
O Pi Agent liderou tanto em taxa de sucesso (20/30) quanto em eficiência de custo ($0,028/tarefa) . Um framework diferente venceu em cada métrica — taxa de sucesso, custo e velocidade —, o que significa que a escolha da orquestração é tão importante quanto a capacidade do modelo
. A diferença de 20 pontos percentuais entre o melhor e o pior framework demonstra uma sensibilidade extrema ao arcabouço do agente, configuração de ferramentas, cache, novas tentativas e stack do provedor
.
A combinação de preços mais altos e resultados reais irregulares reformulou a visão dos analistas sobre a adequação do DeepSeek V4 para empresas.
O VentureBeat observou que o mesmo modelo V4 Flash produziu resultados substancialmente diferentes dependendo do framework, das ferramentas e da stack de cache — sugerindo que as empresas devem investir em maturidade de orquestração juntamente com a seleção do modelo . O próprio comentário da Composio apontou que a escolha do framework sozinha mudou o sucesso em três tarefas, o custo em quase 3x e a velocidade em 2,2x
.
Mesmo fora do pico, cada tipo de token está mais caro do que antes. Analistas afirmam que isso altera o cálculo de ROI para cargas de trabalho de agentes de alto volume, particularmente para agentes de suporte ao cliente e pipelines de geração de código que antes dependiam dos preços agressivamente baixos da DeepSeek .
Os rankings oficiais de agentes da DeepSeek (82,7 no Terminal-Bench 2.1, 70,3 no Toolathlon-Verified) parecem fortes, mas a taxa de aprovação de 53,8% no mundo real é um lembrete de que as pontuações em leaderboards não garantem confiabilidade em ambientes de produção com APIs ao vivo, limites de taxa e fluxos de trabalho com estado .
O tráfego da API passa por servidores na China, criando desafios de conformidade para empresas regulamentadas. Analistas aconselham um planejamento arquitetônico cuidadoso para governança de dados, trilhas de auditoria e controles de permissão de ferramentas . Para indústrias regulamentadas, o auto-hospedagem dos pesos abertos (open weights) continua sendo o único caminho viável para a produção
.
O framework empresarial da BayTech Consulting recomenda o DeepSeek V4 para sumarização de documentos não sensíveis, geração de código em repositórios abertos e rascunho de conteúdo em alto volume — mas pede uma avaliação rigorosa carga de trabalho por carga de trabalho antes de se comprometer com a produção .
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
Em 16 de agosto de 2026, a DeepSeek substituiu a tarifa fixa por precificação por pico e fora de pico, elevando o custo do V4 Pro de saída de US$ 0,87 para US$ 3,96 por milhão de tokens no horário de pico — alta de 355%.
Em 16 de agosto de 2026, a DeepSeek substituiu a tarifa fixa por precificação por pico e fora de pico, elevando o custo do V4 Pro de saída de US$ 0,87 para US$ 3,96 por milhão de tokens no horário de pico — alta de 355%. O modelo V4 Flash, topo de linha em rankings, completou apenas 53,8% das tarefas em testes com 8 frameworks de orquestração diferentes, segundo a empresa independente Composio.
A escolha do framework de orquestração (harness) gerou diferença de até 20 pontos percentuais na taxa de sucesso, mostrando que a infraestrutura de execução é tão crítica quanto o modelo em si.