Dal 17 agosto 2026 le API di V4 Pro applicano tariffe di punta e fuori punta: nelle fasce non di punta i prezzi sono la metà. V4 Pro 0813 è la versione definitiva del modello flagship, mentre DeepSeek Harness v0.1 aggiunge un framework gratuito e open source per costruire agenti.
Research answer

Create a landscape editorial hero image for this Studio Global article: What did DeepSeek announce about its V4 API pricing and V4 Pro launch on August 13, 2026—effective at midnight Beijing time on August 17—inc. Article summary: DeepSeek’s August 13 announcement paired a production V4 Pro release with materially higher, time-variable API prices. It is strong evidence that DeepSeek is no longer competing principally on the lowest possible token r. Topic tags: general, news, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
L’annuncio di DeepSeek del 13 agosto 2026 ha riunito tre novità: il rilascio generale di DeepSeek-V4-Pro-0813, la revisione delle tariffe API della famiglia V4 e l’apertura del codice di DeepSeek Harness (dsh) v0.1.
Per V4 Pro e V4 Flash, la fatturazione è passata da un prezzo fisso a un sistema basato sulle fasce di punta e fuori punta alle 00:00 del 17 agosto, ora di Pechino, cioè alle 16:00 UTC del 16 agosto. Le tariffe fuori punta sono pari alla metà di quelle applicate nelle ore di punta. Secondo la documentazione, le fasce di punta sono 09:00–12:00 e 14:00–18:00, dal lunedì al venerdì, ora di Pechino; tutte le altre ore rientrano nella fascia fuori punta. 9
14
Per V4 Pro, i prezzi fuori punta per ogni milione di token sono i seguenti:
| Categoria | Prezzo precedente | Nuovo prezzo fuori punta | Variazione |
|---|---|---|---|
| Input dalla cache | ¥0,025 | ¥0,15 | +500% |
| Input senza cache | ¥3 | ¥4,50 | +50% |
| Output | ¥6 | ¥13,50 | +125% |
I dati provengono dalla copertura dell’annuncio e dai riepiloghi delle tariffe DeepSeek. 11
16
Durante le ore di punta, i prezzi raddoppiano: ¥0,30 per un milione di token di input dalla cache, ¥9 per l’input senza cache e ¥27 per l’output. 11
13
L’aumento non è uniforme. L’input già presente nella cache registra la crescita percentuale più elevata rispetto alla precedente tariffa fissa. È un elemento importante per gli agenti che inviano ripetutamente gli stessi file di progetto, le medesime istruzioni o ampie porzioni del contesto di una conversazione. Anche l’output diventa sensibilmente più costoso: da 0,87 dollari per milione di token prima della modifica passa a 1,98 dollari fuori punta e 3,96 dollari nelle ore di punta. 6
9
Considerando l’intera famiglia V4, DeepSeek ha indicato aumenti compresi tra il 50% e l’1.100%, a seconda del modello, del tipo di token e dell’orario. 2 Per gli sviluppatori, quindi, il costo non dipende più soltanto dal modello scelto: conta anche quando viene eseguita l’inferenza.
V4-Pro-0813 è la versione disponibile in generale del modello di punta DeepSeek V4 Pro. Nella tabella comparativa pubblicata dall’azienda, il nuovo modello migliora nettamente rispetto all’anteprima V4 Pro in diversi benchmark dedicati al coding e agli agenti.
Per esempio, il punteggio in Terminal-Bench 2.1 sale da 72,1 a 87,9, mentre quello in DeepSWE passa da 12,8 a 62,7. 4
40
Un chiarimento è importante: il valore 7,3 talvolta citato non corrisponde alla versione V4 Pro Preview. La scheda del modello attribuisce infatti 7,3 a V4 Flash Preview e 12,8 a V4 Pro Preview nel test DeepSWE. Usare il dato corretto evita di sovrastimare il miglioramento della versione Pro.
La scheda tecnica di DeepSeek presenta V4-Pro-0813 come competitivo, in test selezionati, con modelli quali Claude Opus 4.8, Claude Fable 5, Kimi K3 e GLM-5.2. Il confronto, tuttavia, non mostra una vittoria assoluta: V4-Pro-0813 prevale in alcune prove, ma resta indietro in altre, comprese determinate valutazioni di conoscenza, generazione di repository e capacità agentiche. 35
36
40
Questi risultati vanno letti per quello che sono: dati dichiarati dal fornitore, non una verifica indipendente del fatto che V4 Pro superi universalmente i sistemi concorrenti. Le analisi disponibili sottolineano che la validazione di terze parti è ancora limitata e che i punteggi possono cambiare in base all’harness, ai prompt, agli strumenti e alla configurazione della valutazione. 41
Insieme a V4-Pro-0813, DeepSeek ha pubblicato DeepSeek Harness v0.1, un framework open source per agenti distribuito con licenza MIT. L’azienda lo ha presentato come un’alternativa a prodotti come Claude Code. 18
22
Il framework è gratuito, ma l’utilizzo dei modelli non lo è necessariamente: chi lo adotta continua a pagare il modello o l’API collegata. Il costo dipende quindi dal volume di inferenza e dal provider scelto, non da un abbonamento separato a Harness. 17
23
L’abbinamento tra modello e strumento è significativo. DeepSeek mette a disposizione il livello software per costruire agenti di coding e automazione, mentre monetizza le chiamate ai modelli che alimentano quei flussi di lavoro.
Per gli sviluppatori, questo sposta l’attenzione dal prezzo di una singola richiesta al costo necessario per portare a termine un’attività composta da molti passaggi: lettura dei file, pianificazione, esecuzione, correzione degli errori e nuovi tentativi.
Il nuovo schema non dimostra che i token economici siano terminati in tutto il settore dell’intelligenza artificiale. Mostra però che le precedenti tariffe fisse estremamente basse di DeepSeek per un modello di produzione ad alte prestazioni non rappresentavano un impegno permanente.
La fatturazione di punta e fuori punta ha anche una funzione operativa. DeepSeek afferma di voler distribuire le risorse in modo più razionale e incoraggiare gli utenti a pianificare i lavori in base ai propri modelli di utilizzo. 14
In pratica, attività rimandabili come elaborazioni batch, valutazioni, indicizzazione e test possono essere programmate nelle ore fuori punta. I flussi interattivi e sensibili alla latenza, invece, rischiano di costare di più se eseguiti nelle fasce di maggiore domanda.
La direzione più ampia è il passaggio dalla tokenomics all’economia delle attività. Un modello più costoso per token può comunque risultare conveniente se completa un lavoro di coding o ricerca con meno errori, meno tentativi, meno orchestrazione e meno supervisione umana. Al contrario, una tariffa nominalmente bassa non garantisce un costo totale ridotto quando un agente deve ripetere più volte la stessa operazione o produce risultati poco affidabili.
Il pacchetto del 13 agosto appare quindi meno come un abbandono della competizione sui costi e più come un riposizionamento. V4-Pro-0813 offre un modello premium, DeepSeek Harness fornisce un livello open source per gli agenti e la tariffazione variabile consente di monetizzare l’inferenza più richiesta o più urgente.
Le evidenze sostengono l’idea di un passaggio verso flussi di lavoro agentici completi. Non dimostrano però che DeepSeek abbia già sostituito il semplice endpoint di modello con un’attività pienamente integrata di fornitura di risultati o attività concluse.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Dal 17 agosto 2026 le API di V4 Pro applicano tariffe di punta e fuori punta: nelle fasce non di punta i prezzi sono la metà.
Dal 17 agosto 2026 le API di V4 Pro applicano tariffe di punta e fuori punta: nelle fasce non di punta i prezzi sono la metà. V4 Pro 0813 è la versione definitiva del modello flagship, mentre DeepSeek Harness v0.1 aggiunge un framework gratuito e open source per costruire agenti.
L’annuncio segnala un passaggio dalla competizione sul semplice costo dei token a quella sull’economia complessiva delle attività completate dagli agenti.