| Type de token | Prix actuel | Nouveau tarif heures creuses | Nouveau tarif heures pleines |
|---|---|---|---|
| Entrée (cache manqué) | 0,435 $ | ~0,44 $–0,49 $ (est.) | ~0,87 $–0,98 $ (est.) |
| Sortie | 0,87 $ | 1,98 $ | 3,96 $ |
| Type de token | Prix actuel | Nouveau tarif heures creuses | Nouveau tarif heures pleines |
|---|---|---|---|
| Entrée (cache manqué) | 0,14 $ | ~0,21 $ (est.) | ~0,42 $ (est.) |
| Sortie | 0,28 $ | 0,63 $ | 1,26 $ |
(Les prix des entrées avec échec de cache pour les nouveaux paliers sont estimés à partir des multiplicateurs de sortie confirmés. Les hausses de sortie sont confirmées par plusieurs sources .)
Les tokens d'entrée mis en cache restent considérablement moins chers. Pour V4-Pro, l'entrée avec succès de cache reste à environ 0,004 $ pour 1 million de tokens, soit une remise de 100x qui incite les développeurs à optimiser leurs stratégies de mise en cache .
Les deux modèles V4 sont des architectures textuelles uniquement, de type Mixture-of-Experts (MoE), publiées sous licence MIT, ce qui les rend entièrement open-weight et auto-hébergeables .
| Spécification | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| Paramètres totaux | 1,6 billion | 284 milliards |
| Paramètres actifs par token | ~49 milliards | ~13 milliards |
| Fenêtre de contexte | 1 000 000 tokens | 1 000 000 tokens |
| Longueur de sortie max | 384 000 tokens | 384 000 tokens |
| Licence | MIT | MIT |
Les deux modèles prennent en charge trois modes de raisonnement : Non-think (rapide, intuitif), Think High (analyse logique avec chaîne de pensée) et Think Max (raisonnement profond) .
Les nouveaux prix redéfinissent le positionnement concurrentiel de DeepSeek. La comparaison ci-dessous utilise les tarifs API standard pour contexte court par million de tokens pour tous les fournisseurs.
| Modèle | Entrée (pour 1M) | Sortie (pour 1M) |
|---|---|---|
| DeepSeek V4-Pro (heures pleines) | ~0,87 $–0,98 $ | 3,96 $ |
| DeepSeek V4-Flash (heures pleines) | ~0,42 $ | 1,26 $ |
| OpenAI GPT-5.6 Luna | 0,20 $ | 1,20 $ |
| Anthropic Claude Fable 5 | 10,00 $ | 50,00 $ |
OpenAI a réduit les prix de GPT-5.6 Luna de 80 % le 30 juillet 2026, à 0,20 $ pour l'entrée et 1,20 $ pour la sortie par million de tokens . Le paysage concurrentiel a changé du tout au tout :
Là où DeepSeek était autrefois l'option économique évidente, il est désormais confronté à un leader des prix dans le segment le plus abordable d'OpenAI .
Le modèle de raisonnement phare d'Anthropic est proposé à 10 $ pour l'entrée et 50 $ pour la sortie par million de tokens . À ces niveaux, DeepSeek reste un bon rapport qualité-prix :
Même à leurs nouveaux tarifs plus élevés, les deux modèles DeepSeek restent considérablement plus abordables que l'offre haut de gamme d'Anthropic .
Les prix de xAI Grok 4.6 n'étaient pas disponibles dans les sources fournies, donc une comparaison directe ne peut pas être établie.
DeepSeek a invoqué une demande croissante qui met à rude épreuve la capacité d'inférence comme raison principale de cette hausse . Les modèles V4 ont connu une adoption massive après leur lancement en avant-première en avril 2026, créant des goulots d'étranglement de capacité GPU que l'entreprise ne pouvait plus absorber à ses tarifs ultra-bas précédents
.
Plusieurs forces du marché ont convergé :
Les augmentations de prix de DeepSeek marquent la fin de son ère en tant que fournisseur d'API frontière de loin le moins cher. L'entreprise se rapproche désormais de la parité avec le modèle le plus abordable d'OpenAI sur certains aspects tout en sous-cotant le palier supérieur d'Anthropic d'un ordre de grandeur. Pour les développeurs, la combinaison d'une tarification heures pleines/creuses, de remises importantes sur le cache et de poids ouverts sous licence MIT signifie que l'architecture de la charge de travail — plutôt que le choix brut du modèle — déterminera de plus en plus la facture finale de l'API.