| Tipo di Token | Prezzo Attuale | Nuovo Off-Peak | Nuovo Peak |
|---|---|---|---|
| Input (cache miss) | $0,435 | ~$0,44–$0,49 (st.) | ~$0,87–$0,98 (st.) |
| Output | $0,87 | $1,98 | $3,96 |
| Tipo di Token | Prezzo Attuale | Nuovo Off-Peak | Nuovo Peak |
|---|---|---|---|
| Input (cache miss) | $0,14 | ~$0,21 (st.) | ~$0,42 (st.) |
| Output | $0,28 | $0,63 | $1,26 |
(I prezzi per l'input cache miss nelle nuove fasce sono stimati dai moltiplicatori di output confermati. I salti dell'output sono confermati da più fonti .)
I token di input in cache rimangono drasticamente più economici. Per V4-Pro, l'input con cache hit rimane a circa $0,004 per milione di token, uno sconto di 100x che incentiva gli sviluppatori a ottimizzare le loro strategie di caching .
Entrambi i modelli V4 sono solo testo, con architettura Mixture-of-Experts (MoE) rilasciata sotto licenza MIT, il che li rende completamente open-weight e auto-ospitabili .
| Specifica | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| Parametri totali | 1,6 trilioni | 284 miliardi |
| Parametri attivi per token | ~49 miliardi | ~13 miliardi |
| Finestra di contesto | 1.000.000 token | 1.000.000 token |
| Lunghezza massima output | 384.000 token | 384.000 token |
| Licenza | MIT | MIT |
Entrambi i modelli supportano tre modalità di ragionamento: Non-think (veloce, intuitiva), Think High (analisi logica con chain-of-thought) e Think Max (ragionamento profondo) .
I nuovi prezzi ridefiniscono il posizionamento competitivo di DeepSeek. Il confronto seguente utilizza le tariffe API standard a contesto breve per 1 milione di token per tutti i fornitori.
| Modello | Input (per 1M) | Output (per 1M) |
|---|---|---|
| DeepSeek V4-Pro (peak) | ~$0,87–$0,98 | $3,96 |
| DeepSeek V4-Flash (peak) | ~$0,42 | $1,26 |
| OpenAI GPT-5.6 Luna | $0,20 | $1,20 |
| Anthropic Claude Fable 5 | $10,00 | $50,00 |
OpenAI ha tagliato i prezzi di GPT-5.6 Luna dell'80% il 30 luglio 2026, portandoli a $0,20 per l'input e $1,20 per l'output per milione di token . Il quadro competitivo è cambiato radicalmente:
Dove DeepSeek era un tempo la scelta economica per eccellenza, ora si trova di fronte a un leader di prezzo in OpenAI con la sua fascia più conveniente .
Il modello di ragionamento di punta di Anthropic ha un prezzo di $10 per l'input e $50 per l'output per milione di token . A questi livelli, DeepSeek rimane la scelta più conveniente:
Anche con le nuove tariffe più alte, entrambi i modelli DeepSeek rimangono drammaticamente più accessibili dell'offerta di punta di Anthropic .
I prezzi di xAI Grok 4.6 non erano disponibili dalle fonti fornite, quindi non è possibile fare un confronto diretto.
DeepSeek ha citato una domanda in forte crescita che mette a dura prova la capacità di inferenza come motivo principale dell'aumento . I modelli V4 hanno ottenuto un'adozione massiccia dopo il lancio in anteprima dell'aprile 2026, creando colli di bottiglia nella capacità delle GPU che l'azienda non poteva più assorbire con le sue tariffe ultra-basse
.
Diverse forze di mercato sono convergenti:
Gli aumenti dei prezzi di DeepSeek segnano la fine della sua era come fornitore di API frontier overwhelmingly più economico. L'azienda è ora più vicina alla parità con il modello più economico di OpenAI su alcune dimensioni, pur sottocostando il livello premium di Anthropic di un ordine di grandezza. Per gli sviluppatori, la combinazione di prezzi peak/off-peak, profondi sconti sulla cache e pesi open-weight con licenza MIT significa che l'architettura del carico di lavoro —piuttosto che la scelta grezza del modello— determinerà sempre più la fattura API finale.