API-prisen er satt til 0,14 dollar per million input-tokens og 0,28 dollar per million output-tokens. Cachet input kan koste så lite som 0,028 dollar per million tokens . Det plasserer V4-Flash blant de rimeligste API-ene for avansert resonnering: Prisen er lavere enn for Gemini 2.5 Flash, som er oppgitt til 0,30 dollar for input og 2,50 dollar for output per million tokens .
En ny, omtrenet «0731-versjon» ble sluppet 31. juli 2026 og utgjør den offentlige betaversjonen av API-et. Ifølge rapporterte agenttester slo den større V4-Pro-Preview-modellen, med 82,7 poeng i Terminal Bench 2.1 og 76,7 i Cybergym .
V4-Flash støtter konfigurerbare nivåer for resonnering – standard, høy og maksimal tenkeinnsats – samt en modus uten resonnering for arbeidsflyter med høyt gjennomløp .
MiniMax lanserte H3 31. juli 2026 som en generell multimodal genereringsmodell. Den kan behandle tekst, bilder, video og lyd i én samlet kontekst . Modellen kan lage opptil 15 sekunder med video i 2K-oppløsning, altså 2560 × 1440 piksler, med 24 bilder per sekund. Stereolyden genereres samtidig med videoen i samme kjøring – uten behov for en separat lydpipeline .
H3 kan ta imot opptil ni bilder, tre videoklipp og tre lydspor som referanser i samme forespørsel . MiniMax sa at modellvektene skulle gjøres tilgjengelige i løpet av få dager, noe som vil utvide strategien med åpne modellvekter til videogenerering – et område der mange av de mest kjente konkurrentene fortsatt er proprietære .
Selskapet oppgir også at H3 koster mindre enn en tredel av de vanligste konkurrentene per sekund ved 2K-oppløsning .
ByteDance presenterte Seedance 2.5 på Volcano Engine FORCE-konferansen 23. juni 2026 . Offentlig API-tilgang ble åpnet 16. juli .
Den viktigste nyheten er muligheten til å generere opptil 30 sekunder med video i én sammenhengende kjøring. Det betyr at hele klippet lages under samme generering, i stedet for at flere korte sekvenser må settes sammen . Oppløsningen går opp til 4K, 3840 × 2160 piksler, med 10-bits fargedybde .
Modellen kan bruke opptil 50 multimodale referanser – blant annet bilder, lydklipp, 3D-modeller, stilreferanser og scenebeskrivelser. Det er en økning fra 12 referanser i forrige versjon .
ByteDance har også lansert redigering på områdenivå. Brukeren kan dermed endre bestemte deler av et generert klipp uten å lage hele sekvensen på nytt . Bruksområdene som er nevnt, omfatter film, reklame, utdanning, industriproduksjon og simulering for autonom kjøring .
De tre lanseringene er ikke én samlet lanseringsdag, men de peker i samme strategiske retning:
Den opprinnelige fremstillingen koblet lanseringene til 26. desember 2024. De tilgjengelige kildene støtter ikke denne datoen. De støtter heller ikke den konkrete påstanden om at kinesiske åpne modeller sto for 41 prosent av alle globale nedlastinger, eller de omtalte amerikanske anklagene om modell-destillasjon.
Disse påstandene kan være knyttet til tidligere hendelser rundt DeepSeek-V3 eller Qwen, men de kan ikke verifiseres med kildene som ligger til grunn for denne gjennomgangen.
| Modell | Dokumentert tidspunkt | Viktigste spesifikasjoner |
|---|---|---|
| DeepSeek V4-Flash | Forhåndsvisning: 24. april 2026. Offentlig beta: 31. juli 2026 | 284 milliarder MoE-parametere, 13 milliarder aktive, én million tokens kontekst, 0,14 dollar per million input-tokens |
| MiniMax H3 | 31. juli 2026 | Opptil 15 sekunder video i 2K, innebygd stereolyd, modellvekter lovet publisert |
| ByteDance Seedance 2.5 | Kunngjort 23. juni 2026. API: 16. juli 2026 | 30 sekunder i én generering, opptil 4K, 50 multimodale referanser |
DeepSeek V4-Flash, MiniMax H3 og Seedance 2.5 representerer dermed en kraftig opptrapping i Kinas AI-sektor sommeren 2026. Fellesnevneren er lavere kostnader, større vekt på åpne modeller og langt mer sammenhengende generering av tekst, lyd og video.