Le moteur principal est le prix. DeepSeek V4 Flash coûte 0,14 $ par million de tokens en entrée et 0,28 $ par million de tokens en sortie—soit environ 0,03 $ par test de référence, ce qui en fait le modèle d'IA le moins cher à faire fonctionner à l'échelle mondiale . Des tests indépendants menés par la société de recherche Artificial Analysis montrent qu'il est environ 105 fois moins cher que le Claude Fable 5 d'Anthropic à exécuter sur une évaluation de référence standard . Des startups d'IA étrangères qui sont passées aux modèles chinois ont signalé une réduction de leurs coûts d'inférence mensuels de 60 % à 85 % .
Le déluge de modèles chinois à bas coût a créé ce que le Los Angeles Times décrit comme une « zone de mort pour quiconque ne dispose pas d'une technologie de pointe ou de prix cassant le marché » .
Aucune preuve de baisses de prix spécifiques de la part de xAI (Grok) n'a été trouvée dans les sources disponibles.
Le Kimi K3 de Moonshot AI, lancé les 16 et 17 juillet 2026, a provoqué un choc distinct mais connexe. Il s'agit d'un modèle à mélange d'experts de 2,8 billions de paramètres avec une fenêtre de contexte de 1 million de tokens, proposé à 3 $ par million de tokens en entrée et 15 $ par million de tokens en sortie (avec l'entrée en cache à 0,30 $) . Bien qu'il s'agisse du modèle le plus cher jamais commercialisé par un laboratoire chinois, il sous-cotait tout de même le Claude Fable 5 d'Anthropic d'environ 70 % (Fable 5 coûte 10 $/50 $ par million de tokens) .
Kimi K3 a été lancé avec des poids ouverts (prévus pour le 27 juillet), rendant ainsi l'intelligence de pointe ouvertement disponible. L'annonce a déclenché une vente massive sur le Nasdaq, les investisseurs réévaluant le paysage concurrentiel pour les entreprises américaines d'IA . Son prix est environ un tiers de celui du modèle Fable d'Anthropic .
Le 6 août 2026, DeepSeek a averti d'une « importante » hausse de prix à venir pour ses services API, exhortant les développeurs à « planifier votre utilisation en conséquence » . L'entreprise n'a pas précisé les nouveaux tarifs ni la date d'entrée en vigueur, indiquant seulement que l'augmentation serait « relativement importante » . La tarification actuelle de V4 Flash reste de 0,14 $ en entrée / 0,28 $ en sortie par million de tokens .
Les analystes interprètent cela comme un signe que les prix ultra-bas de DeepSeek étaient peut-être un produit d'appel non viable pour gagner des parts de marché—et qu'elle se sent désormais suffisamment confiante dans sa base d'utilisateurs pour augmenter ses prix . Les observateurs notent également que DeepSeek avait déjà procédé à une réduction de prix permanente de 75 % sur son modèle phare V4-Pro en mai 2026, comprimant davantage ses marges . Le Taipei Times a rapporté que « certaines des entreprises d'IA les plus en vue de Chine augmentent leurs tarifs alors que leurs offres open-source gagnent du terrain auprès des entreprises et des programmeurs du monde entier » .
Les guerres de l'IA ne se résument plus seulement aux scores des benchmarks. Elles portent sur le coût de l'intelligence elle-même. Les laboratoires chinois ont prouvé qu'une performance proche de celle des modèles de pointe pouvait être fournie à une fraction du prix américain, forçant l'ensemble de l'industrie à revoir ses attentes. Les mois à venir montreront si la guerre des prix continue de s'intensifier ou si le marché se stabilise—mais pour l'instant, l'ère de l'IA chinoise étonnamment bon marché a déjà remodelé le paysage mondial.