La beta di DeepSeek V4.1 Flash è partita l’8 settembre 2026 ed è terminata con il rilascio ufficiale del 10 settembre, accessibile tramite il nome API deepseek flash. La novità centrale è la multimodalità nativa: testo e immagini sono gestiti dal modello, senza dover scegliere la precedente variante sperimentale Vis...
Pubblicato daModificato con GPT-5.6 TerraImmagini generate con GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is DeepSeek V4.1 Flash, and what are the key details of its September 2026 time-limited internal beta—including its new native multimod. Article summary: DeepSeek V4.1 Flash was initially a short, evaluation-oriented API beta of an intermediate Flash-tier model. It launched on September 8, 2026 with a new architecture and native visual understanding, unlike the earlier V4. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
La breve beta di DeepSeek V4.1 Flash è ormai un fatto storico. Il modello, comparso l’8 settembre 2026 attraverso un endpoint API a scadenza, è stato pubblicato ufficialmente il 10 settembre con supporto multimodale nativo. Per le nuove integrazioni, il nome documentato da usare è:
deepseek-flash
Lo confermano sia l’annuncio di DeepSeek sia il changelog dell’API. 5
9
Per circa due giorni gli sviluppatori hanno potuto provare una build intermedia selezionando questo identificatore:
deepseek-v4.1-flash-expires-on-0910
Il nome stesso indicava che non si trattava di un endpoint destinato a durare. Era possibile mantenere invariato il base_url dell’API e modificare soltanto il campo del modello; la tariffazione era allineata a V4 Flash e ogni account poteva inviare fino a 20 richieste concorrenti. La disattivazione era prevista attorno al 10 settembre. 7
20
In altre parole, quella route era adatta a confronti, verifiche di integrazione e prove iniziali con immagini e testo, non a diventare una dipendenza infrastrutturale per il traffico di produzione.
L’elemento più importante di V4.1 Flash è l’integrazione della comprensione visiva nella nuova architettura del modello. Non è quindi necessario trattare la capacità per immagini come un’estensione separata, come accadeva con il precedente endpoint sperimentale deepseek-v4-flash-vision-exp.
Dopo il rilascio, DeepSeek ha comunicato che, per ragioni di compatibilità, le chiamate rivolte ai precedenti nomi deepseek-v4-flash e deepseek-v4-flash-vision-exp sarebbero state temporaneamente instradate verso V4.1 Flash. 5
DeepSeek descrive V4.1 Flash come un modello mixture-of-experts (MoE) da 552 miliardi di parametri, basato su un’architettura Causal Encoder–Decoder. Secondo l’azienda, sono attivi 8 miliardi di parametri nell’elaborazione dell’input e 16 miliardi nella generazione dell’output. 5
Per chi sviluppa applicazioni, il vantaggio pratico è semplice: le richieste che combinano testo e immagini rientrano nel modello Flash ufficiale, senza dover scegliere una vecchia variante Vision sperimentale.
Durante la beta sono circolate osservazioni di utenti che parlavano di circa 300-500 token in output al secondo, con alcune segnalazioni oltre i 500 token al secondo. Non erano però dati pubblicati da DeepSeek come benchmark standardizzato o impegno di servizio. 15
La velocità effettiva può variare in base alla lunghezza di prompt e risposta, alla regione, alla concorrenza, alle impostazioni del modello e all’implementazione dell’applicazione. Quei test indicano che il modello è apparso rapido in alcune condizioni, ma non sono una garanzia di capacità per attività come programmazione, prototipazione di interfacce o carichi continuativi.
Nell’annuncio iniziale, DeepSeek aveva indicato che dal 14 settembre le richieste API inviate a deepseek-v4-pro sarebbero state instradate a V4.1 Flash, con le relative tariffe, in attesa di un futuro V4.1 Pro. L’azienda aveva inoltre presentato V4.1 Flash come superiore a modelli di punta nei benchmark riportati nel proprio annuncio. 5
Il changelog API successivo contiene però l’aggiornamento più rilevante per chi integra il servizio oggi: DeepSeek ha deciso di continuare a offrire V4 Pro dopo il 14 settembre, lasciando invariato il metodo di fatturazione. 9
La lezione è pratica: durante una transizione di gamma, alias, routing e disponibilità dei modelli possono cambiare rapidamente. Conviene impostare esplicitamente il nome del modello documentato, seguire il changelog dell’API e rieseguire test di regressione prima di presupporre che endpoint diversi producano risultati identici.
| Beta dell’8-10 settembre | Rilascio ufficiale |
|---|---|
deepseek-v4.1-flash-expires-on-0910 |
deepseek-flash |
| Route temporanea di valutazione | Modello API documentato |
| Prezzi beta equivalenti a V4 Flash | Si applicano prezzi e condizioni del rilascio |
| 20 richieste concorrenti per account | Verificare limiti operativi nella documentazione aggiornata |
La storia duratura di V4.1 Flash non è quindi l’endpoint di due giorni, ma l’arrivo di un modello Flash multimodale nativo, con un identificatore API stabile e dettagli architetturali pubblicati da DeepSeek. 5
9
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
La beta di DeepSeek V4.1 Flash è partita l’8 settembre 2026 ed è terminata con il rilascio ufficiale del 10 settembre, accessibile tramite il nome API deepseek flash.
La beta di DeepSeek V4.1 Flash è partita l’8 settembre 2026 ed è terminata con il rilascio ufficiale del 10 settembre, accessibile tramite il nome API deepseek flash. La novità centrale è la multimodalità nativa: testo e immagini sono gestiti dal modello, senza dover scegliere la precedente variante sperimentale Vision.
Nella preview, il nome temporaneo era deepseek v4.1 flash expires on 0910: tariffazione come V4 Flash, base URL invariato e massimo di 20 richieste concorrenti per account.