Les tarifs API de DeepSeek V4 Flash et V4 Pro augmentent de 50 % à plus de 1 100 % selon le modèle, le type de jeton et l’horaire. Les heures de pointe, de 01 h à 04 h et de 06 h à 10 h UTC, sont facturées deux fois plus cher que les heures creuses.
Réponse de recherche

Create a landscape editorial hero image for this Studio Global article: How are DeepSeek’s August 2026 API price increases for V4-Flash and V4-Pro—including peak/off-peak rates, increases of 50% to more than 1,10. Article summary: DeepSeek is moving from a land-grab API strategy toward yield management and monetization, while OpenAI is using free consumer access to defend distribution and habit. They are not directly equivalent offers—developer AP. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
La refonte tarifaire de DeepSeek en août 2026 et l’élargissement de l’accès gratuit à ChatGPT par OpenAI répondent au même problème économique : comment attirer un volume massif d’utilisateurs tout en finançant l’inférence de modèles toujours plus coûteux.
DeepSeek s’éloigne de sa stratégie d’API à prix fixe ultra-bas. OpenAI, de son côté, utilise l’accès gratuit pour renforcer la distribution de son produit grand public. Ces deux annonces ne concernent pas le même marché — l’une vise l’infrastructure destinée aux développeurs, l’autre un service de conversation — mais elles illustrent un changement de terrain. La compétition ne porte plus seulement sur le prix du million de jetons : elle se joue aussi sur l’accès, les habitudes d’utilisation, le routage des requêtes et la capacité à dégager des revenus durables.
Les nouveaux prix de DeepSeek sont entrés en vigueur le 16 août 2026 à 16 h 00 UTC. L’entreprise applique désormais des tarifs distincts en période de pointe et en heures creuses pour V4-Flash et V4-Pro. Les tarifs hors pointe correspondent à la moitié des tarifs de pointe. Les créneaux de pointe sont fixés de 01 h 00 à 04 h 00 UTC et de 06 h 00 à 10 h 00 UTC ; toutes les autres heures sont considérées comme creuses.
| Modèle | Période | Entrée avec cache | Entrée sans cache | Sortie |
|---|---|---|---|---|
| V4-Flash | Heures creuses | 0,007 $ | 0,22 $ | 0,66 $ |
| V4-Flash | Pointe | 0,014 $ | 0,44 $ | 1,32 $ |
| V4-Pro | Heures creuses | 0,022 $ | 0,66 $ | 1,98 $ |
| V4-Pro | Pointe | 0,044 $ | 1,32 $ | 3,96 $ |
Tarifs en dollars américains par million de jetons. Les montants « avec cache » et « sans cache » concernent les jetons d’entrée.
Le terme « heures creuses » peut prêter à confusion : il ne signifie pas que les tarifs sont inférieurs aux anciens prix. La sortie de V4-Flash coûte désormais 0,66 $ en heures creuses, contre 0,28 $ auparavant. Pour V4-Pro, le tarif de sortie passe d’un prix promotionnel de 0,87 $ à 1,98 $ en heures creuses.
Selon Reuters, les nouveaux tarifs sont supérieurs de 50 % à 1 100 % aux anciens prix, en fonction du modèle, du type de jeton et de l’heure d’utilisation.
Les pourcentages les plus spectaculaires concernent les jetons d’entrée déjà présents dans le cache, car ils partent d’une base très faible. Pour un développeur, l’effet réel dépendra plutôt de la combinaison entre requêtes mises en cache, entrées non mises en cache, volume de sorties générées et concentration du trafic pendant les heures de pointe.
La sortie de V4-Pro coûte ainsi environ 128 % plus cher en heures creuses qu’avec l’ancien tarif promotionnel de 0,87 $, et environ 355 % plus cher en période de pointe, sur la base des prix indiqués.
Même après cette hausse, DeepSeek reste peu coûteux face à de nombreux modèles américains propriétaires. Les tarifs promotionnels précédents plaçaient la sortie de V4-Pro autour de 0,87 $ par million de jetons, très loin des prix historiques de plusieurs systèmes américains de pointe. L’entreprise réduit donc son avantage de coût, sans le faire disparaître.
Pour une application qui génère 10 millions de jetons de sortie V4-Pro par mois :
La facture liée aux sorties augmente donc d’environ 11,10 $ à 30,90 $ par mois, selon l’horaire. Ce calcul exclut les jetons d’entrée, les frais liés au cache, les taxes et les éventuels frais de plateforme.
Pour une application en production, le principal enjeu pourrait être la composition du trafic plutôt que le seul volume de sortie. Des prompts longs, un faible taux de réutilisation du cache ou une activité concentrée pendant les créneaux de pointe peuvent produire une hausse sensiblement différente. La planification des traitements par lots en heures creuses et le suivi du taux d’accès au cache deviennent donc plus importants.
OpenAI a annoncé une évolution très différente pour ChatGPT. GPT-5.6 Luna devient le modèle par défaut des utilisateurs Free et Go, tandis que l’entreprise propose aussi des conversations textuelles illimitées et un nouveau bouton « Think » pour les questions plus complexes.
Le titre de l’annonce doit toutefois être nuancé : l’accès illimité concerne les conversations textuelles, et non l’ensemble des fonctionnalités de ChatGPT. Des limites restent appliquées aux téléversements de fichiers, aux images, à la voix, à la génération d’images et à d’autres outils. L’offre reste également soumise à des mesures de prévention des abus.
Il s’agit d’une stratégie de distribution grand public, et non d’une modification des tarifs API. OpenAI réduit les obstacles à l’utilisation quotidienne et place un modèle récent au cœur de l’expérience ChatGPT par défaut. Selon TechCrunch, ChatGPT avait récemment dépassé le milliard d’utilisateurs hebdomadaires.
Les tarifs très bas ont aidé les modèles chinois à gagner du terrain auprès des développeurs. Une mesure de Vercel AI Gateway indique que les modèles open-weight développés en Chine représentaient 29 % des jetons traités en production en juin 2026, contre environ un neuvième en avril, tout en concentrant moins de 4 % des dépenses. Cette statistique concerne le trafic de cette passerelle, pas l’ensemble du marché mondial de l’IA.
Cette distinction est essentielle. La part de jetons mesure le volume de travail confié à un système, mais ne suffit pas à établir ses revenus, sa rentabilité, la fidélité de ses clients ou son pouvoir de marché à long terme. Les développeurs peuvent répartir leurs requêtes entre plusieurs fournisseurs, et les charges sensibles au prix peuvent changer rapidement dès qu’un tarif évolue.
Le nouveau barème montre que la conquête de l’usage n’est plus le seul objectif. La tarification selon l’horaire permet à DeepSeek de répartir sa capacité en fonction de la demande et de facturer davantage lorsque les utilisateurs sollicitent fortement ses serveurs. Sa documentation officielle présente cette évolution comme une mesure d’allocation des ressources et encourage les clients à planifier leurs tâches selon leurs besoins réels.
Cette décision intervient alors que d’autres entreprises chinoises de l’IA commencent elles aussi à proposer des offres payantes ou envisagent d’augmenter leurs tarifs. Des informations sur le marché chinois évoquent notamment les offres payantes de Moonshot AI et de ByteDance, ainsi que la volonté d’Alibaba de suivre le mouvement. Cela suggère un virage plus large, des subventions agressives vers la monétisation.
Cela ne prouve pas que DeepSeek ou ses concurrentes soient rentables. Mais cela montre qu’une part de marché conquise grâce à des prix très bas doit finir par être convertie en revenus par jeton, en contrats récurrents ou en un autre modèle économique viable.
Le lancement gratuit de Luna met l’accent sur la distribution plutôt que sur le prix API le plus bas possible. En rendant les conversations textuelles largement accessibles et en ajoutant un bouton « Think » clairement visible, OpenAI cherche à faire de ChatGPT une habitude durable, tout en conservant des limites plus strictes pour les fonctionnalités plus coûteuses.
Le contraste stratégique est net :
Ces stratégies peuvent parfaitement coexister. Un développeur peut choisir DeepSeek pour des charges à très haut volume tandis qu’un particulier utilise ChatGPT pour une assistance généraliste. Dans les deux cas, l’objectif est de rendre l’écosystème plus difficile à remplacer : DeepSeek mise sur le rapport qualité-prix et le routage des requêtes ; OpenAI sur la familiarité du produit et sa portée auprès du grand public.
DeepSeek reste une option peu coûteuse, mais son nouveau barème rend l’étiquette de « modèle le moins cher » trop simpliste. Les équipes doivent comparer la facture complète en tenant compte des entrées avec et sans cache, du volume de sorties et de la concentration du trafic pendant les heures de pointe.
Les questions pratiques sont désormais les suivantes :
La compétition entre la Chine et les États-Unis dans l’IA ne se résume donc plus à la question de savoir qui propose le tarif affiché le plus bas. DeepSeek cherche à démontrer que l’avantage chinois en matière de coût et de performances peut être transformé en économie unitaire durable. OpenAI teste, de son côté, si un accès gratuit et une habitude d’utilisation à grande échelle peuvent consolider le contrôle de son écosystème.
Dans les deux cas, le défi central reste le même : convertir un usage gigantesque en activité capable de financer durablement le coût récurrent du calcul nécessaire aux modèles de pointe.
Studio Global AI
Cette page comprend une réponse basée sur la source que vous pouvez continuer dans Studio Global.
Les tarifs API de DeepSeek V4 Flash et V4 Pro augmentent de 50 % à plus de 1 100 % selon le modèle, le type de jeton et l’horaire.
Les tarifs API de DeepSeek V4 Flash et V4 Pro augmentent de 50 % à plus de 1 100 % selon le modèle, le type de jeton et l’horaire. Les heures de pointe, de 01 h à 04 h et de 06 h à 10 h UTC, sont facturées deux fois plus cher que les heures creuses.
Pour 10 millions de jetons de sortie V4 Pro par mois, la facture passe d’environ 8,70 $ à 19,80 $ en heures creuses ou 39,60 $ en période de pointe.