Na prática, o nome permanece estável enquanto o serviço passa a entregar o lançamento 0813. Isso reduz o trabalho necessário para atualizar integrações já em funcionamento.
A API agora oferece suporte ao formato da OpenAI Responses API e foi otimizada para fluxos com o Codex, incluindo configuração do Codex com um clique. A documentação também lista compatibilidade com as interfaces OpenAI Chat Completions e Anthropic.
O impacto mais importante está na integração com aplicações orientadas a agentes, e não apenas em respostas de texto. Esse tipo de arquitetura permite combinar a saída do modelo com ferramentas, execução de código e ciclos repetidos de planejamento e ação.
Nos resultados divulgados pela própria DeepSeek, o V4 Pro 0813 supera com folga a versão de prévia em algumas avaliações. No Terminal-Bench 2.1, teste que mede a capacidade de agentes realizarem tarefas em ambientes de terminal, o modelo marcou 87,9, contra 72,1 da prévia. O resultado ficou pouco abaixo dos 88,0 atribuídos ao Fable 5.
Outros números reportados incluem:
A cobertura do anúncio afirma que o V4 Pro superou o Fable 5 no CyberGym e no AutomationBench, embora tenha ficado ligeiramente atrás no Terminal-Bench. É importante interpretar essa comparação com cautela: os números vêm principalmente da tabela de avaliação divulgada pela própria DeepSeek e de reportagens sobre o lançamento, não de um único estudo independente administrado sob metodologia comum.
Ainda assim, os resultados deixam claro o foco do modelo: agentes de engenharia de software, tarefas em linha de comando, atividades relacionadas à cibersegurança e fluxos que exigem várias ações sucessivas — em vez de apenas uma resposta isolada.
A mesma referência informa que os valores fora do pico correspondem à metade do preço de pico. As janelas de pico são das 1h às 4h UTC e das 6h às 10h UTC.
As fontes fornecidas, porém, não são totalmente consistentes entre si em relação à moeda e à documentação. Outro relatório que cita a documentação da DeepSeek menciona preços de 3 yuans por milhão de tokens de entrada, 6 yuans por milhão de tokens de saída e 0,025 yuan por milhão de tokens de entrada armazenados em cache. Antes de calcular o custo de uma operação em produção, é recomendável conferir os valores atuais e a moeda aplicável diretamente na documentação da API da DeepSeek.
A atualização interessa principalmente a equipes que desenvolvem agentes de programação e sistemas capazes de usar ferramentas. Quem já utiliza a API pode manter o identificador deepseek-v4-pro, enquanto a compatibilidade com Responses API e Codex pode simplificar a conexão com ferramentas de agentes já conhecidas.
Os benchmarks também indicam uma evolução expressiva nas tarefas associadas a fluxos autônomos de software. Mas um resultado próximo ao de um concorrente em uma avaliação não significa desempenho idêntico em todos os projetos de programação, raciocínio ou produção. Por enquanto, os números devem ser tratados como resultados divulgados pela DeepSeek, até que sejam reproduzidos de forma independente.
Em resumo, o V4 Pro é tanto uma atualização da plataforma de agentes quanto um novo lançamento de modelo: o nome da API não muda, a superfície de integração fica mais ampla e os resultados reportados para agentes avançam significativamente em relação à versão de prévia.