De API-prijs kwam uit op 0,14 dollar per miljoen invoertokens en 0,28 dollar per miljoen uitvoertokens. Voor gecachte invoer kan het tarief dalen tot 0,028 dollar per miljoen tokens . Daarmee behoort V4-Flash tot de goedkoopste API’s in de frontier-klasse voor redeneertaken. De prijs ligt bijvoorbeeld onder die van Gemini 2.5 Flash, dat 0,30 dollar voor invoer en 2,50 dollar voor uitvoer per miljoen tokens rekent .
Op 31 juli 2026 volgde de opnieuw getrainde 0731-build, die geldt als de officiële publieke API-bèta. Volgens beschikbare benchmarkgegevens presteerde deze versie beter dan de grotere V4-Pro-Preview op agentbenchmarks, met scores van 82,7 op Terminal Bench 2.1 en 76,7 op Cybergym . Gebruikers kunnen kiezen tussen verschillende redeneerniveaus — standaard, hoog en maximaal — of de denkmodus uitschakelen voor toepassingen met een hoge verwerkingssnelheid .
MiniMax lanceerde H3 op 31 juli 2026 als een algemeen multimodaal generatiemodel. Het systeem kan tekst, afbeeldingen, video en audio binnen één context verwerken . Vervolgens maakt het video’s van maximaal 15 seconden in 2K-resolutie — 2.560 bij 1.440 pixels — met 24 beelden per seconde. De stereoaudio wordt in dezelfde inferentiestap gegenereerd; een aparte audiopijplijn is dus niet nodig .
H3 kan tegelijk maximaal negen afbeeldingen, drie videoclips en drie audiotracks als referentie verwerken . MiniMax beloofde de modelgewichten binnen enkele dagen beschikbaar te stellen, onder voorbehoud van de toepasselijke wet- en regelgeving. Daarmee trekt het bedrijf het open-weight-model door naar videogeneratie, een terrein waarop veel commerciële concurrenten hun modellen gesloten houden .
Volgens MiniMax kost H3 bij 2K-resolutie per seconde minder dan een derde van de prijs van gangbare concurrerende modellen . De exacte besparing hangt af van de gekozen dienst en instellingen, maar de prijsstelling is duidelijk bedoeld om grootschalig gebruik door ontwikkelaars en mediabedrijven aantrekkelijk te maken.
ByteDance kondigde Seedance 2.5 aan tijdens de Volcano Engine FORCE-conferentie op 23 juni 2026 . Publieke API-toegang volgde op 16 juli 2026 .
De belangrijkste vernieuwing is de mogelijkheid om video’s van maximaal 30 seconden in één generatie te maken. Gebruikers hoeven daarvoor niet eerst meerdere korte fragmenten te genereren en die achteraf aan elkaar te plakken . De uitvoer kan volgens de beschikbare productinformatie oplopen tot 4K — 3.840 bij 2.160 pixels — met een kleurdiepte van 10 bits .
Seedance 2.5 accepteert maximaal 50 multimodale referenties. Dat kunnen onder meer afbeeldingen, audioclips, 3D-witmodellen, stijlbeelden en aanwijzingen voor de scène zijn. In de vorige versie lag die limiet op 12 referenties . ByteDance voegde bovendien bewerking op regioniveau toe: gebruikers kunnen een specifiek deel van een gegenereerde clip aanpassen zonder de hele video opnieuw te maken .
De genoemde toepassingsgebieden lopen uiteen van film en reclame tot onderwijs, industriële productie en simulaties voor autonoom rijden .
De drie aankondigingen zijn niet één gezamenlijke lancering, maar ze laten wel een aantal duidelijke bewegingen in de Chinese AI-sector zien:
De beschikbare bronnen ondersteunen niet de oorspronkelijke datum van 26 december 2024. Ook de bredere beweringen uit die framing — waaronder dat Chinese open-source modellen 41 procent van alle wereldwijde downloads zouden vertegenwoordigen en dat Amerikaanse overheidsfunctionarissen specifieke beschuldigingen over modeldistillatie uitten — konden met de aangeleverde bronnen niet worden geverifieerd.
Die claims kunnen verband houden met eerdere gebeurtenissen rond DeepSeek-V3 of Qwen, maar daaruit kan op basis van het beschikbare materiaal geen betrouwbare conclusie worden getrokken. Het is daarom nauwkeuriger om te spreken over een reeks releases in het midden van 2026, met de grootste concentratie op 31 juli 2026: toen verscheen MiniMax H3 en kwam ook de DeepSeek V4-Flash-0731-update uit.
| Model | Datum | Belangrijkste specificaties |
|---|---|---|
| DeepSeek V4-Flash | Preview: 24 april 2026; publieke bèta: 31 juli 2026 | 284 miljard parameters als MoE, 13 miljard actief; context van 1 miljoen tokens; 0,14 dollar per miljoen invoertokens |
| MiniMax H3 | 31 juli 2026 | Video tot 15 seconden in 2K; ingebouwde stereoaudio; modelgewichten aangekondigd voor vrijgave |
| ByteDance Seedance 2.5 | Aangekondigd op 23 juni 2026; API op 16 juli 2026 | Video tot 30 seconden in één generatie; tot 4K; maximaal 50 multimodale referenties |
DeepSeek V4-Flash, MiniMax H3 en Seedance 2.5 vormen dus geen trio dat op één dag in 2024 uitkwam. Samen illustreren ze wel de versnelling van de Chinese AI-industrie in 2026: lagere kosten, meer open gewichten en modellen die langere en multimodale content rechtstreeks kunnen genereren.