Harga API kemudiannya ditetapkan pada AS$0.14 bagi setiap sejuta token input dan AS$0.28 bagi setiap sejuta token output. Input yang dicache pula boleh serendah AS$0.028 bagi setiap sejuta token . Pada kadar ini, V4-Flash menjadi antara API penaakulan kelas hadapan paling murah — lebih rendah berbanding Gemini 2.5 Flash yang berharga AS$0.30 bagi input dan AS$2.50 bagi output untuk setiap sejuta token .
Binaan yang dilatih semula, dikenali sebagai versi 0731, dikeluarkan pada 31 Julai 2026 dan menjadi beta awam rasmi bagi API tersebut. Menurut laporan yang tersedia, versi ini mengatasi V4-Pro-Preview dalam beberapa penanda aras ejen, dengan skor 82.7 dalam Terminal Bench 2.1 dan 76.7 dalam Cybergym .
Pengguna boleh memilih tahap penaakulan standard, tinggi atau maksimum, selain mod tanpa penaakulan untuk tugasan berjumlah besar yang memerlukan pemprosesan pantas .
MiniMax melancarkan H3 pada 31 Julai 2026 sebagai model penjanaan multimodal umum. Ia boleh memahami teks, imej, video dan audio dalam satu konteks yang disatukan .
H3 mampu menghasilkan video sehingga 15 saat pada resolusi 2K — 2560 × 1440 piksel — dengan kadar 24 bingkai sesaat. Audio stereo asli dijana dalam proses inferens yang sama, tanpa memerlukan saluran audio berasingan selepas video siap .
Model ini boleh menerima sehingga 9 imej, 3 klip video dan 3 trek audio sebagai rujukan serentak . MiniMax berkata pemberat model akan dikeluarkan dalam masa beberapa hari, tertakluk kepada pematuhan undang-undang dan peraturan . Ini penting kerana pendekatan pemberat terbuka, yang sebelum ini lebih biasa dalam model bahasa, semakin diperluas kepada penjanaan video.
Syarikat itu juga mendakwa kos H3 pada resolusi 2K, dikira mengikut saat, adalah kurang daripada satu pertiga berbanding model arus perdana yang setara . Namun, pada tarikh pelancaran, pemberat tersebut masih dalam bentuk janji pelepasan dan belum tersedia sepenuhnya kepada umum .
ByteDance mengumumkan Seedance 2.5 pada 23 Jun 2026 semasa persidangan Volcano Engine FORCE . Akses API awam kemudiannya dibuka pada 16 Julai 2026 .
Peningkatan paling ketara ialah keupayaan menghasilkan video sehingga 30 saat dalam satu proses. Ini bermakna klip penuh dijana secara berterusan, bukannya menggabungkan beberapa segmen pendek selepas itu . Resolusi pula boleh mencapai 4K, atau 3840 × 2160 piksel, dengan kedalaman warna 10-bit .
Seedance 2.5 menerima sehingga 50 input rujukan multimodal, termasuk imej, klip audio, model putih 3D, bingkai gaya dan arahan adegan — meningkat daripada 12 dalam versi terdahulu .
ByteDance turut memperkenalkan penyuntingan peringkat kawasan. Dengan ciri ini, pengguna boleh mengubah bahagian tertentu dalam klip yang dijana tanpa menghasilkan semula keseluruhan video . Antara kegunaan yang disebut termasuk filem, pengiklanan, pendidikan, pembuatan industri dan simulasi pemanduan autonomi .
Walaupun ketiga-tiga model tersebut tidak dilancarkan pada hari yang sama, dua perkembangan besar — DeepSeek V4-Flash 0731 dan MiniMax H3 — berlaku pada 31 Julai 2026. Secara keseluruhan, siri pelancaran ini memperlihatkan beberapa strategi yang sama.
DeepSeek V4-Flash meletakkan harga input dan output pada paras yang jauh lebih rendah berbanding beberapa model penaakulan Barat . MiniMax pula secara terbuka menyasarkan kos video 2K kurang daripada satu pertiga harga pesaing .
Strategi ini boleh mengurangkan kos penggunaan untuk pembangun yang menjalankan aplikasi pada skala besar, seperti pengelasan, ringkasan, pengekstrakan data, e-dagang dan penghasilan kandungan.
DeepSeek V4-Flash hadir dengan lesen MIT, manakala MiniMax berjanji untuk menerbitkan pemberat H3 dalam masa terdekat . Jika dilaksanakan, pendekatan ini boleh memberi lebih banyak ruang kepada pembangun untuk memuat turun, mengubah suai dan menyesuaikan model dengan perkakasan mereka sendiri.
Ia juga memberi tekanan kepada penyedia model video komersial yang masih mengekalkan sistem secara proprietari.
Ketiga-tiga pelancaran ini meningkatkan jumlah maklumat yang boleh digunakan oleh model. DeepSeek menawarkan konteks sejuta token, Seedance 2.5 menerima sehingga 50 rujukan multimodal, manakala MiniMax H3 menggabungkan teks, imej, video dan audio dalam satu aliran kerja.
Bagi produksi kreatif, ini bermakna pengguna boleh memberikan lebih banyak panduan tentang watak, gaya, bunyi dan pergerakan sebelum video dijana.
Bingkai asal mendakwa bahawa ketiga-tiga pelancaran ini berlaku pada Disember 2024, selain menyebut dakwaan bahawa model sumber terbuka China menyumbang 41% daripada muat turun global serta dakwaan pegawai Amerika Syarikat mengenai penyulingan model. Hasil carian yang tersedia tidak menyokong tarikh Disember 2024 atau angka dan dakwaan khusus tersebut.
Kemungkinan dakwaan itu merujuk kepada peristiwa terdahulu yang melibatkan DeepSeek-V3 atau Qwen, tetapi ia tidak dapat disahkan melalui sumber yang diberikan. Oleh itu, konteks tersebut tidak wajar dianggap sebagai fakta bagi tiga pelancaran model yang dibincangkan di sini.
| Model | Tarikh pelancaran | Spesifikasi utama |
|---|---|---|
| DeepSeek V4-Flash | Pratonton: 24 April 2026; beta awam: 31 Julai 2026 | MoE 284B, 13B aktif; konteks 1 juta token; AS$0.14 bagi setiap sejuta token input |
| MiniMax H3 | 31 Julai 2026 | Video 2K sehingga 15 saat; audio stereo asli; pemberat terbuka dijanjikan |
| ByteDance Seedance 2.5 | Diumumkan: 23 Jun 2026; API: 16 Julai 2026 | Video 30 saat dalam satu proses; sehingga 4K; 50 input rujukan multimodal |
DeepSeek V4-Flash, MiniMax H3 dan ByteDance Seedance 2.5 tidak mewakili satu acara pelancaran pada 26 Disember 2024. Sebaliknya, ketiga-tiganya menunjukkan pecutan sektor AI China pada pertengahan 2026 — dengan kos lebih rendah, agihan pemberat terbuka dan keupayaan menjana kandungan yang semakin panjang serta multimodal.