Il motore principale è il prezzo. DeepSeek V4 Flash costa 0,14 $ per milione di token in input e 0,28 $ per milione di token in output — circa 0,03 $ per test benchmark, rendendolo il modello di IA più economico in assoluto da eseguire a livello globale . Test indipendenti della società di ricerca Artificial Analysis mostrano che è circa 105 volte più economico di Anthropic Claude Fable 5 da eseguire in una valutazione benchmark standard . Le startup di IA estere che sono passate ai modelli cinesi hanno riferito di aver ridotto i costi mensili di inferenza dal 60% all'85% .
L'ondata di modelli cinesi a basso costo ha creato quella che il Los Angeles Times descrive come una "zona di morte per chiunque non abbia una tecnologia all'avanguardia o prezzi in grado di rivoluzionare il mercato" .
Non sono state trovate prove di tagli di prezzo specifici da parte di xAI (Grok) nelle fonti disponibili.
Kimi K3 di Moonshot AI, lanciato il 16-17 luglio 2026, ha rappresentato uno shock separato ma correlato. È un modello mixture-of-experts da 2,8 trilioni di parametri con una finestra di contesto di 1 milione di token, al prezzo di 3 $ per milione di token in input e 15 $ per milione di token in output (con input in cache a 0,30 $) . Sebbene sia il modello più costoso mai lanciato da un laboratorio cinese, ha comunque sottocostato Anthropic Claude Fable 5 di circa il 70% (Fable 5 costa 10/50 $ per milione di token) .
Kimi K3 è stato lanciato con pesi aperti (previsti per il 27 luglio), rendendo l'intelligenza di frontiera apertamente disponibile. L'annuncio ha innescato una vendita al Nasdaq poiché gli investitori hanno rivalutato il panorama competitivo per le aziende IA statunitensi . Il suo prezzo è circa un terzo di quello del modello Fable di Anthropic .
Il 6 agosto 2026, DeepSeek ha avvertito di un "significativo" imminente aumento di prezzo per i suoi servizi API, esortando gli sviluppatori a "pianificare il tuo utilizzo di conseguenza" . L'azienda non ha specificato le nuove tariffe esatte né una data di entrata in vigore, precisando solo che l'aumento sarebbe stato "relativamente grande" . I prezzi attuali per V4 Flash rimangono a 0,14 $ per input e 0,28 $ per output per milione di token .
Gli analisti interpretano questo come un segno che i prezzi ultra-economici di DeepSeek potrebbero essere stati un loss-leader insostenibile per conquistare quote di mercato, e che l'azienda ora si senta abbastanza sicura della sua base di utenti per aumentare i prezzi . Gli osservatori notano anche che DeepSeek aveva già effettuato un taglio permanente del 75% sul suo modello di punta V4-Pro nel maggio 2026, comprimendo ulteriormente i margini . Il Taipei Times ha riportato che "alcune delle aziende IA più alla moda della Cina stanno aumentando le tariffe mentre le loro offerte open-source guadagnano terreno tra aziende e programmatori in tutto il mondo" .
Le guerre dell'IA non riguardano più solo i punteggi dei benchmark. Riguardano il costo dell'intelligenza stessa. I laboratori cinesi hanno dimostrato che prestazioni vicine alla frontiera possono essere fornite a una frazione dei prezzi statunitensi, costringendo l'intero settore a resettare le aspettative. I prossimi mesi mostreranno se la guerra dei prezzi continuerà ad approfondirsi o se il mercato si stabilizzerà, ma per ora, l'era dell'IA cinese scioccamente economica ha già rimodellato il panorama globale.