API se ustálilo na ceně 0,14 USD za milion vstupních tokenů a 0,28 USD za milion výstupních tokenů. U kešovaných vstupů může cena klesnout až na 0,028 USD za milion tokenů . Podle dostupného srovnání jde o jednu z nejlevnějších API služeb pro modely s pokročilým uvažováním — levnější než Gemini 2.5 Flash, jehož cena je 0,30 USD za vstup a 2,50 USD za výstup na milion tokenů .
Dne 31. července vyšla přeškolená verze označovaná jako 0731 build, která představuje oficiální veřejnou beta verzi API. Podle zveřejněných výsledků překonává větší V4-Pro-Preview v některých agentních benchmarcích: v Terminal Bench 2.1 získala skóre 82,7 a v Cybergym 76,7 . Uživatelé mohou nastavit různé úrovně náročnosti uvažování — standardní, vysokou nebo maximální — případně u zpracování ve velkém vypnout režim uvažování .
MiniMax uvedl H3 31. července 2026 jako obecný multimodální model. Dokáže pracovat s textem, obrázky, videem i zvukem v jednotném kontextu . Výsledkem může být až 15 sekund videa ve 2K rozlišení (2 560 × 1 440 pixelů) při 24 snímcích za sekundu, přičemž stereofonní zvuk vzniká v rámci stejného inferenčního průchodu . Není tedy nutné přidávat zvuk následně v odděleném procesu.
Do jedné žádosti lze podle dostupných specifikací vložit až 9 obrázků, 3 videoklipy a 3 zvukové stopy . MiniMax zároveň oznámil, že chce během několika dnů zveřejnit modelové váhy. Zatím šlo o příslib, nikoli o okamžitě dostupné vydání vah .
Firma uvádí, že cena za sekundu při výstupu ve 2K je nižší než třetina ceny hlavních konkurenčních modelů . Pokud se tento poměr potvrdí i v běžném používání, může H3 oslovit nejen vývojáře, ale také reklamní, herní a produktová studia.
ByteDance představil Seedance 2.5 23. června 2026 na konferenci Volcano Engine FORCE . Veřejný přístup k API se otevřel 16. července .
Nejvýraznější změnou je generování až 30sekundového audiovizuálního klipu v jediném průchodu. Výstup se tedy neskládá z několika kratších segmentů, což má pomoci s časovou návazností, pohybem i konzistencí postav . Oznámené parametry počítají s rozlišením až 4K .
Model podporuje až 50 multimodálních referencí — například obrázky, zvukové ukázky, stylové předlohy, 3D blokace nebo pokyny ke scéně. Oproti předchozí verzi jde o výrazný nárůst z 12 vstupů . ByteDance přidal také úpravy na úrovni konkrétních oblastí, takže lze změnit jen vybranou část klipu bez nutnosti znovu generovat celou sekvenci .
Mezi uváděné oblasti využití patří filmová tvorba, reklama, vzdělávání, průmyslová výroba a simulace autonomního řízení .
Tři uvedení nespojuje jedno datum, ale podobný strategický směr.
Pro vývojáře to znamená levnější experimentování a více možností provozovat modely mimo uzavřené platformy. Pro provozovatele komerčních služeb naopak další tlak na cenu, délku výstupu a míru kontroly nad generovaným obsahem.
Dostupné zdroje nepodporují tvrzení, že by k těmto třem uvedením došlo 26. prosince 2024. Nepotvrzují ani konkrétní údaj, podle kterého by čínské open-source modely představovaly 41 % globálních stažení, nebo širší tvrzení o obviněních amerických představitelů z distilace modelů. Tyto body mohou souviset s dřívějšími událostmi kolem DeepSeek-V3 či Qwen, v poskytnutých podkladech je však nebylo možné ověřit.
Nejpřesnější popis proto není „jednodenní trojité uvedení“, ale několikaměsíční zrychlení čínského AI sektoru v polovině roku 2026. Spojuje je nižší cena, otevřenější distribuce vah a snaha posunout hranice délky i multimodálnosti generovaného obsahu.