DeepSeek a remplacé les tarifs fixes par une structure heures pleines/creuses le 16 août 2026, augmentant le coût de sortie du V4 Pro de 0,87 $ à 3,96 $ par million de tokens en heures pleines, soit une hausse de 355 %. Le modèle V4 Flash n'a atteint qu'un taux de réussite de 53,8 % sur des tâches agents complexes l...
Réponse de recherche

Create a landscape editorial hero image for this Studio Global article: What pricing changes did DeepSeek implement for its V4 API models on August 16, 2026, how does the new peak and off-peak tiered structure co. Article summary: **Pi Agent** led in both success rate (20/30) and cost efficiency ($0.028/task).. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence
Le 16 août 2026, DeepSeek a introduit l'un des changements de tarification les plus significatifs du marché des API d'IA, remplaçant les tarifs fixes par token par une structure heures pleines/heures creuses, entraînant des hausses de coûts allant jusqu'à 1 555 % pour certains types de tokens . La même semaine, la société de tests indépendants Composio a révélé que le modèle phare V4 Flash de DeepSeek n'avait accompli que 53,8 % des tâches agents réelles sur huit frameworks d'orchestration différents, mettant en lumière un fossé important entre les scores des classements et la fiabilité en production
. Ensemble, ces développements forcent les entreprises à reconsidérer le coût total et la maturité d'orchestration nécessaires pour déployer DeepSeek V4 à grande échelle.
À partir de 16h00 UTC le 16 août 2026, DeepSeek est passé d'un tarif fixe unique à un modèle à deux niveaux pour V4-Flash et V4-Pro . Les heures pleines sont de 01h00 à 04h00 UTC et de 06h00 à 10h00 UTC (7 heures par jour) ; toutes les autres heures sont creuses
. Les tarifs en heures creuses sont exactement la moitié des tarifs en heures pleines, mais chaque catégorie de token a tout de même subi une augmentation nette par rapport à l'ancien tarif fixe
.
| Modèle | Type de token | Ancien tarif fixe | Heures creuses (nouveau) | Heures pleines (nouveau) | Variation effective |
|---|---|---|---|---|---|
| V4-Flash | Entrée (cache miss) | 0,14 $ | 0,21 $ | 0,42 $ | +50 % creuses, +200 % pleines |
| V4-Flash | Entrée (cache hit) | 0,0028 $ | 0,007 $ | 0,014 $ | +150 % creuses, +400 % pleines |
| V4-Flash | Sortie | 0,28 $ | 0,42 $ | 0,84 $ | +50 % creuses, +200 % pleines |
| V4-Pro | Entrée (cache miss) | 0,435 $ | 0,99 $ | 1,98 $ | +128 % creuses, +355 % pleines |
| V4-Pro | Entrée (cache hit) | 0,003625 $ | 0,03 $ | 0,06 $ | +728 % creuses, +1 555 % pleines |
| V4-Pro | Sortie | 0,87 $ | 1,98 $ | 3,96 $ | +128 % creuses, +355 % pleines |
Sources : données de la grille tarifaire publiée par DeepSeek et trackers indépendants .
L'augmentation la plus extrême concerne l'entrée cache-hit de V4-Pro, passant de 0,003625 $ à 0,06 $ en heures pleines, soit une hausse d'environ 1 555 % . DeepSeek a déclaré que ce changement visait à allouer les ressources plus efficacement et à encourager les utilisateurs à planifier les charges de travail non urgentes pendant les heures creuses
.
En août 2026, la société de tests indépendants Composio a évalué le DeepSeek V4 Flash sur huit frameworks d'orchestration d'agents différents, en utilisant 30 flux de travail volontairement difficiles et multi-étapes, couvrant des outils en direct comme Gmail, GitHub, Slack et Google Sheets . Chaque tâche avait un délai d'expiration de 900 secondes, et tous les frameworks utilisaient les mêmes outils MCP Composio hébergés
.
Le résultat global : sur 240 exécutions totales, seulement 129 ont réussi, soit un taux de réussite global de 53,8 %. Seulement 6 des 30 flux de travail ont été menés à bien par tous les frameworks .
| Framework | Taux de réussite (sur 30 tâches) | Coût par tâche réussie |
|---|---|---|
| Pi Agent | 20/30 (66,7 %) | 0,028 $ |
| Prime Agent | ~15/24 (62,5 % d'exécutions valides) | 0,131 $ |
| OMP (Oh My Pi) | 17/30 (56,7 %) | 0,103 $ |
| Claude Code | 16/30 (53,3 %) | 0,195 $ |
| Codex | 16/30 (53,3 %) | 0,081 $ |
| Deep Agents (LangChain) | 16/30 (53,3 %) | 0,045 $ |
| Hermes Agent | 15/30 (50,0 %) | 0,056 $ |
| OpenCode | 14/30 (46,7 %) | 0,067 $ |
Données issues des résultats publiés par Composio .
Pi Agent a obtenu les meilleurs résultats, tant en taux de réussite (20/30) qu'en efficacité-coût (0,028 $/tâche) . Un framework différent a remporté la première place pour chaque métrique (taux de réussite, coût et vitesse), ce qui signifie que le choix de l'orchestration est aussi important que la capacité du modèle
. L'écart de 20 points entre le meilleur et le moins bon framework démontre une sensibilité extrême au cadre de l'agent, à la configuration des outils, à la mise en cache, aux tentatives et à la pile du fournisseur
.
La combinaison de prix plus élevés et de résultats réels inégaux a remodelé le point de vue des analystes sur l'adéquation de DeepSeek V4 pour les entreprises.
VentureBeat a noté que le même modèle V4 Flash produisait des résultats sensiblement différents selon le framework, l'outillage et la pile de mise en cache, ce qui suggère que les entreprises doivent investir dans la maturité de l'orchestration en même temps que dans la sélection du modèle . Composio a souligné que le seul choix du framework modifiait le succès de trois tâches, le coût de près de 3 fois et la vitesse de 2,2 fois
.
Même en heures creuses, chaque type de token est plus cher qu'avant. Les analystes affirment que cela modifie le calcul du retour sur investissement pour les charges de travail agent à volume élevé, en particulier pour les agents de support client et les pipelines de génération de code qui comptaient auparavant sur les prix agressivement bas de DeepSeek .
Les classements agents officiels de DeepSeek (82,7 sur Terminal-Bench 2.1, 70,3 sur Toolathlon-Verified) semblent solides, mais le taux de réussite réel de 53,8 % rappelle que les scores dans les classements ne garantissent pas la fiabilité dans les environnements de production avec des API en direct, des limites de débit et des flux de travail avec état .
Le trafic API transite par des serveurs en Chine, ce qui crée des problèmes de conformité pour les entreprises réglementées. Les analystes conseillent une planification architecturale minutieuse pour la gouvernance des données, les pistes d'audit et les contrôles d'autorisation des outils . Pour les secteurs réglementés, l'auto-hébergement des poids ouverts reste la seule voie viable vers la production
.
Le cadre d'entreprise de BayTech Consulting recommande DeepSeek V4 pour le résumé de documents non sensibles, la génération de code sur des dépôts ouverts et la rédaction de contenu à volume élevé, mais appelle à une évaluation rigoureuse charge de travail par charge de travail avant de s'engager dans la production .
Studio Global AI
Cette page comprend une réponse basée sur la source que vous pouvez continuer dans Studio Global.
DeepSeek a remplacé les tarifs fixes par une structure heures pleines/creuses le 16 août 2026, augmentant le coût de sortie du V4 Pro de 0,87 $ à 3,96 $ par million de tokens en heures pleines, soit une hausse de 355 %.
DeepSeek a remplacé les tarifs fixes par une structure heures pleines/creuses le 16 août 2026, augmentant le coût de sortie du V4 Pro de 0,87 $ à 3,96 $ par million de tokens en heures pleines, soit une hausse de 355 %. Le modèle V4 Flash n'a atteint qu'un taux de réussite de 53,8 % sur des tâches agents complexes lors de tests indépendants de Composio, avec un écart de 20 points entre les meilleurs et les moins bons frameworks d'orc...
Les analystes recommandent une adoption sélective par charge de travail et soulignent que l'orchestration, plus que la puissance brute du modèle, est le facteur clé pour les déploiements en entreprise.