La facturation heures pleines/heures creuses de l’API DeepSeek V4 a commencé le 17 août 2026 à 00 h 00, heure de Pékin, soit le 16 août à 16 h 00 UTC. En heures creuses, le tarif V4 Pro passe de 0,025 à 0,15 yuan pour un million de tokens d’entrée mis en cache, de 3 à 4,5 yuans pour l’entrée non mise en cache et de...
Réponse de recherche

Create a landscape editorial hero image for this Studio Global article: What did DeepSeek announce about its V4 API pricing and V4 Pro launch on August 13, 2026—effective at midnight Beijing time on August 17—inc. Article summary: DeepSeek’s August 13 announcement paired a production V4 Pro release with materially higher, time-variable API prices. It is strong evidence that DeepSeek is no longer competing principally on the lowest possible token r. Topic tags: general, news, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
L’annonce de DeepSeek du 13 août 2026 associait trois décisions : la sortie générale de DeepSeek-V4-Pro-0813, une refonte importante de la tarification de l’API V4 et la publication en open source de DeepSeek Harness (dsh) v0.1.
Le message est double. D’un côté, DeepSeek revendique une nette progression sur les tâches de programmation et d’utilisation d’outils. De l’autre, l’entreprise montre que ses modèles de pointe ne seront plus proposés selon une logique de tarif fixe ultra-bas, quelle que soit l’heure ou la charge du réseau.
DeepSeek a remplacé les tarifs fixes de V4 Pro et V4 Flash par une facturation en heures pleines et heures creuses. Le changement est entré en vigueur le 17 août 2026 à 00 h 00, heure de Pékin, soit le 16 août à 16 h 00 UTC. Les tarifs en heures creuses correspondent à la moitié de ceux appliqués en heures pleines. Les créneaux de pointe sont fixés, en semaine, de 9 h à 12 h et de 14 h à 18 h, heure de Pékin ; les autres horaires relèvent des heures creuses. 9
14
Pour V4 Pro, les montants par million de tokens sont les suivants :
| Catégorie facturée | Tarif précédent | Nouveau tarif en heures creuses | Évolution |
|---|---|---|---|
| Entrée mise en cache | 0,025 ¥ | 0,15 ¥ | +500 % |
| Entrée non mise en cache | 3 ¥ | 4,50 ¥ | +50 % |
| Sortie | 6 ¥ | 13,50 ¥ | +125 % |
Ces montants proviennent de la couverture de l’annonce et des synthèses de la grille tarifaire de DeepSeek. 11
16
En heures pleines, les tarifs sont multipliés par deux : 0,30 yuan par million de tokens d’entrée mis en cache, 9 yuans pour l’entrée non mise en cache et 27 yuans pour la sortie. 11
13
La hausse n’est pas uniforme. L’entrée mise en cache — par exemple des fichiers de projet, des consignes ou un historique de conversation renvoyés à plusieurs reprises par un agent — connaît la plus forte progression en pourcentage. La sortie devient elle aussi sensiblement plus coûteuse : son prix passe de 0,87 dollar par million de tokens avant la réforme à 1,98 dollar en heures creuses et 3,96 dollars en heures pleines. 6
9
Sur l’ensemble de la famille V4, DeepSeek évoque des hausses comprises entre 50 % et 1 100 %, selon le modèle, le type de token et l’horaire d’utilisation. 2 Pour les développeurs, le calcul de coût ne dépend donc plus uniquement du modèle choisi : il faut aussi tenir compte du moment où les requêtes sont exécutées.
V4-Pro-0813 est la version disponible en production du modèle phare V4 Pro. Dans son tableau comparatif, DeepSeek annonce des progrès marqués par rapport à la version Preview sur plusieurs évaluations de programmation et d’agents.
Sur Terminal-Bench 2.1, le score passe ainsi de 72,1 à 87,9. Sur DeepSWE, il progresse de 12,8 à 62,7. 4
40
Une confusion circule parfois autour du score de 7,3. Cette valeur correspond à V4 Flash Preview, et non à V4 Pro Preview, dont le score indiqué sur DeepSWE est bien de 12,8. 40 Séparer ces deux références est essentiel : sinon, l’ampleur du progrès attribué à V4 Pro est artificiellement gonflée.
La fiche de modèle de DeepSeek présente V4-Pro-0813 comme compétitif face à Claude Opus 4.8, Claude Fable 5, Kimi K3 et GLM-5.2 sur une sélection de tests. Le tableau ne montre toutefois pas une victoire générale : le modèle domine certaines comparaisons, mais reste derrière ses concurrents sur plusieurs évaluations de connaissances, de génération de dépôts et d’agents. 35
36
40
Ces résultats doivent être lus pour ce qu’ils sont : des résultats revendiqués par le fournisseur. Ils ne constituent pas, à eux seuls, une preuve indépendante que V4 Pro surpasse systématiquement les systèmes concurrents. Les analyses disponibles soulignent que la validation par des tiers reste limitée et que les scores peuvent varier selon le framework d’évaluation, les prompts, les outils et la configuration retenue. 41
En parallèle de V4-Pro-0813, DeepSeek a publié DeepSeek Harness v0.1, un framework open source pour agents distribué sous licence MIT. L’outil est présenté comme une alternative à des produits tels que Claude Code. 18
22
Le framework lui-même est gratuit. Cela ne signifie pas que l’exécution d’un agent ne coûte rien : l’utilisateur paie les modèles ou les API auxquels il le connecte. La facture dépend donc de la quantité d’inférence utilisée, et non d’un abonnement distinct à DeepSeek Harness. 17
23
Cette association entre un modèle plus performant et une couche logicielle ouverte est stratégique. DeepSeek fournit aux développeurs l’environnement nécessaire pour construire des agents de programmation et d’automatisation, puis facture les appels aux modèles qui font fonctionner ces agents.
En pratique, la question n’est plus seulement de savoir combien coûte une requête isolée. Il faut mesurer le prix d’une tâche complète : nombre d’étapes, reprises après erreur, appels aux outils, longueur du contexte et éventuelle intervention humaine.
La décision de DeepSeek ne prouve pas que les tokens bon marché ont disparu de l’ensemble du secteur. Elle montre en revanche que les tarifs fixes particulièrement bas de V4 Pro n’étaient pas un engagement permanent pour son service de production le plus puissant.
La facturation selon l’horaire joue aussi un rôle opérationnel. DeepSeek explique qu’elle doit permettre une allocation plus rationnelle des ressources et encourager les utilisateurs à planifier leurs tâches en fonction de leurs usages. 14 Les traitements différables — travaux par lots, évaluations, indexation ou génération en arrière-plan — ont donc intérêt à être déplacés vers les heures creuses. Les usages interactifs exécutés aux heures de pointe seront les plus chers.
Le déplacement de fond va de l’économie du token vers l’économie de la tâche. Un modèle plus coûteux à l’unité peut rester rentable s’il termine une tâche de programmation ou de recherche avec moins d’échecs, moins d’orchestration et moins de contrôle humain. À l’inverse, un tarif très bas ne garantit pas un faible coût total si l’agent multiplie les tentatives ou produit des résultats peu fiables.
L’annonce du 13 août ressemble donc moins à un abandon de la compétition par les prix qu’à un repositionnement. V4-Pro-0813 apporte un modèle premium, DeepSeek Harness une couche agentique ouverte et la tarification variable permet de mieux monétiser les capacités d’inférence rares ou demandées aux heures de pointe.
Les éléments disponibles étayent une évolution vers des workflows agentiques plus complets. Ils ne permettent pas encore d’affirmer que DeepSeek a remplacé le simple endpoint de modèle par une activité intégrée de livraison de tâches de bout en bout.
Studio Global AI
Cette page comprend une réponse basée sur la source que vous pouvez continuer dans Studio Global.
La facturation heures pleines/heures creuses de l’API DeepSeek V4 a commencé le 17 août 2026 à 00 h 00, heure de Pékin, soit le 16 août à 16 h 00 UTC.
La facturation heures pleines/heures creuses de l’API DeepSeek V4 a commencé le 17 août 2026 à 00 h 00, heure de Pékin, soit le 16 août à 16 h 00 UTC. En heures creuses, le tarif V4 Pro passe de 0,025 à 0,15 yuan pour un million de tokens d’entrée mis en cache, de 3 à 4,5 yuans pour l’entrée non mise en cache et de 6 à 13,5 yuans pour la sortie.
V4 Pro 0813 est la version de production du modèle phare de DeepSeek, tandis que DeepSeek Harness v0.1 fournit gratuitement un framework d’agents sous licence MIT.