Il prezzo dell’API è stato fissato a 0,14 dollari per milione di token in ingresso e 0,28 dollari per milione di token in uscita. Per gli input memorizzati nella cache, il costo può scendere fino a 0,028 dollari per milione di token . Secondo i confronti disponibili, questa tariffa rende V4-Flash uno dei modelli di ragionamento di fascia avanzata più economici sul mercato, al di sotto dei 0,30 dollari in ingresso e 2,50 dollari in uscita indicati per Gemini 2.5 Flash .
Il 31 luglio 2026 è arrivata la build ripetutamente addestrata “0731”, presentata come beta pubblica ufficiale dell’API. I risultati riportati indicano un vantaggio rispetto al più grande V4-Pro-Preview in alcuni benchmark per agenti: 82,7 in Terminal Bench 2.1 e 76,7 in Cybergym .
V4-Flash permette inoltre di scegliere il livello di ragionamento — standard, alto o massimo — oppure di disattivare la modalità di thinking per le pipeline che privilegiano velocità e volume .
MiniMax ha lanciato H3 il 31 luglio 2026, descrivendolo come un modello generativo multimodale in grado di lavorare in un contesto unificato con testo, immagini, video e audio .
Il sistema può creare video lunghi fino a 15 secondi, in risoluzione 2K — 2.560 × 1.440 pixel — a 24 fotogrammi al secondo, con audio stereo generato insieme alle immagini nella stessa fase di inferenza . In altre parole, non serve aggiungere successivamente una traccia audio separata.
H3 può ricevere contemporaneamente fino a 9 immagini, 3 clip video e 3 tracce audio come riferimenti . MiniMax ha inoltre annunciato l’intenzione di pubblicare i pesi del modello entro pochi giorni, subordinatamente agli adempimenti previsti, estendendo il modello degli “open weight” alla generazione video, un settore in cui molti concorrenti restano proprietari .
Sul fronte dei costi, l’azienda sostiene che la generazione in 2K costi meno di un terzo al secondo rispetto ai principali modelli concorrenti . Si tratta di una dichiarazione dell’azienda, non di un confronto indipendente universalmente verificato.
ByteDance ha annunciato Seedance 2.5 il 23 giugno 2026, durante la conferenza Volcano Engine FORCE . L’accesso pubblico all’API è stato poi aperto il 16 luglio 2026 .
L’aggiornamento più rilevante riguarda la durata: Seedance 2.5 può generare video audio-visivi lunghi fino a 30 secondi in un’unica passata, senza assemblare diversi segmenti brevi . La risoluzione arriva fino al 4K, cioè 3.840 × 2.160 pixel, con profondità colore a 10 bit .
Il modello supporta fino a 50 riferimenti multimodali — tra immagini, clip audio, modelli 3D di previsualizzazione, riferimenti di stile e indicazioni sulla scena — rispetto ai 12 della versione precedente .
ByteDance ha introdotto anche l’editing a livello di regione: è possibile modificare aree specifiche di una clip già generata senza dover rigenerare l’intera sequenza . Le applicazioni indicate includono cinema, pubblicità, istruzione, manifattura industriale e simulazioni per la guida autonoma .
Pur essendo arrivati in momenti diversi, i tre modelli condividono alcune direttrici.
Il quadro che emerge è quindi quello di una forte accelerazione del settore cinese a metà 2026, costruita su tre leve: riduzione dei costi, distribuzione più aperta dei pesi e aumento della durata e del controllo sui contenuti generati.
La ricostruzione originaria associava i tre lanci al 26 dicembre 2024 e li collegava ad altre affermazioni, tra cui l’idea che i modelli cinesi open source rappresentassero il 41% dei download globali e le accuse statunitensi di distillazione dei modelli. Le fonti disponibili per questa analisi non confermano né la data del dicembre 2024 né quelle statistiche specifiche.
È possibile che parte del contesto si riferisca a eventi precedenti legati a DeepSeek-V3 o Qwen, ma questa connessione non è stata verificata nelle fonti fornite. Anche per questo è più corretto parlare di una sequenza di lanci nel 2026, non di una singola triade annunciata nello stesso giorno.
| Modello | Data di lancio | Specifiche principali |
|---|---|---|
| DeepSeek V4-Flash | Anteprima: 24 aprile 2026; beta pubblica: 31 luglio 2026 | MoE da 284 miliardi di parametri, 13 miliardi attivi; contesto da 1 milione di token; 0,14 dollari per milione di token in ingresso |
| MiniMax H3 | 31 luglio 2026 | Video fino a 15 secondi in 2K; audio stereo nativo; pesi aperti promessi |
| ByteDance Seedance 2.5 | Annuncio: 23 giugno 2026; API: 16 luglio 2026 | Video fino a 30 secondi in un’unica passata; output fino a 4K; 50 riferimenti multimodali |
DeepSeek V4-Flash, MiniMax H3 e Seedance 2.5 non rappresentano dunque un evento del dicembre 2024. Sono piuttosto i tasselli di una fase di espansione dell’IA cinese nel 2026, in cui prezzo, apertura e capacità multimodali diventano strumenti centrali della competizione globale.