| Tipo de Token | Preço Atual | Novo Preço (Vale) | Novo Preço (Pico) |
|---|---|---|---|
| Entrada (cache miss) | $0,435 | ~$0,44–$0,49 (est.) | ~$0,87–$0,98 (est.) |
| Saída | $0,87 | $1,98 | $3,96 |
| Tipo de Token | Preço Atual | Novo Preço (Vale) | Novo Preço (Pico) |
|---|---|---|---|
| Entrada (cache miss) | $0,14 | ~$0,21 (est.) | ~$0,42 (est.) |
| Saída | $0,28 | $0,63 | $1,26 |
(Os preços de entrada com cache miss para as novas faixas são estimados com base nos multiplicadores de saída confirmados. Os saltos na saída são confirmados por várias fontes .)
Tokens de entrada com cache continuam drasticamente mais baratos. Para o V4-Pro, a entrada com cache hit permanece em aproximadamente $0,004 por 1M de tokens, um desconto de 100x que incentiva os desenvolvedores a otimizarem suas estratégias de cache .
Ambos os modelos V4 são apenas de texto, com arquitetura Mixture-of-Experts (MoE) lançada sob licença MIT, o que os torna totalmente de código aberto e passíveis de serem hospedados por conta própria .
| Especificação | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| Parâmetros totais | 1,6 trilhão | 284 bilhões |
| Parâmetros ativos por token | ~49 bilhões | ~13 bilhões |
| Janela de contexto | 1.000.000 tokens | 1.000.000 tokens |
| Saída máxima | 384.000 tokens | 384.000 tokens |
| Licença | MIT | MIT |
Ambos os modelos suportam três modos de raciocínio: Non-think (rápido e intuitivo), Think High (análise lógica com cadeia de pensamento) e Think Max (raciocínio profundo) .
Os novos preços reformulam o posicionamento competitivo da DeepSeek. A comparação abaixo usa as taxas padrão de API para contexto curto por 1M de tokens.
| Modelo | Entrada (por 1M) | Saída (por 1M) |
|---|---|---|
| DeepSeek V4-Pro (pico) | ~$0,87–$0,98 | $3,96 |
| DeepSeek V4-Flash (pico) | ~$0,42 | $1,26 |
| OpenAI GPT-5.6 Luna | $0,20 | $1,20 |
| Anthropic Claude Fable 5 | $10,00 | $50,00 |
A OpenAI reduziu os preços do GPT-5.6 Luna em 80% no dia 30 de julho de 2026, para $0,20 de entrada e $1,20 de saída por 1M de tokens . O cenário competitivo mudou drasticamente:
Onde a DeepSeek era a opção mais barata, agora enfrenta um líder de preços na faixa mais acessível da OpenAI .
O modelo principal de raciocínio da Anthropic custa $10 de entrada e $50 de saída por 1M de tokens . Nesses níveis, a DeepSeek continua sendo a opção de melhor custo-benefício:
Mesmo com os novos preços mais altos, ambos os modelos da DeepSeek continuam dramaticamente mais acessíveis que a oferta principal da Anthropic .
O preço do Grok 4.6 da xAI não estava disponível nas fontes fornecidas, portanto, uma comparação direta não pode ser feita.
A DeepSeek citou a demanda crescente sobrecarregando a capacidade de inferência como a principal razão para o aumento . Os modelos V4 ganharam enorme adoção após seu lançamento em prévia em abril de 2026, criando gargalos de capacidade de GPU que a empresa não conseguia mais absorver com suas taxas ultrabaixas
.
Diversas forças de mercado convergiram:
Os aumentos de preço da DeepSeek marcam o fim de sua era como o provedor de API mais barato. A empresa agora está mais próxima da paridade com o modelo mais acessível da OpenAI em algumas dimensões, enquanto ainda supera o nível premium da Anthropic por uma ordem de grandeza. Para os desenvolvedores, a combinação de preços de pico/vale, grandes descontos de cache e pesos abertos com licença MIT significa que a arquitetura da carga de trabalho — e não apenas a escolha do modelo — determinará cada vez mais a conta final da API.