Harga API-nya berada di US$0,14 per 1 juta token input dan US$0,28 per 1 juta token output. Untuk input yang tersimpan dalam cache, biayanya dapat turun hingga US$0,028 per 1 juta token . Dengan struktur tersebut, V4-Flash menjadi salah satu API penalaran kelas terdepan yang paling murah—lebih rendah dibandingkan Gemini 2.5 Flash, yang tercatat seharga US$0,30 untuk input dan US$2,50 untuk output per 1 juta token .
Versi yang dilatih ulang dengan penanda "0731 build" dirilis pada 31 Juli 2026 dan menjadi versi beta publik resmi untuk API. Menurut laporan yang tersedia, versi ini mengungguli V4-Pro-Preview dalam sejumlah tolok ukur agen, dengan skor 82,7 di Terminal Bench 2.1 dan 76,7 di Cybergym .
Pengguna dapat mengatur tingkat penalaran model—standard, high, atau max thinking effort—serta memilih mode non-thinking untuk alur kerja yang membutuhkan pemrosesan berkecepatan tinggi .
MiniMax meluncurkan H3 pada 31 Juli 2026 sebagai model generasi multimodal serbaguna. H3 dapat memproses teks, gambar, video, dan audio dalam satu konteks terpadu . Model ini mampu menghasilkan video hingga 15 detik pada resolusi 2K (2560×1440) dan kecepatan 24 frame per detik, lengkap dengan audio stereo yang dibuat dalam proses inferensi yang sama .
H3 dapat menerima hingga 9 gambar, 3 klip video, dan 3 trek audio sebagai referensi secara bersamaan . MiniMax juga menyatakan akan merilis bobot model dalam hitungan hari, meski bobot tersebut belum tersedia pada saat peluncuran. Jika terealisasi, langkah ini akan memperluas tren model berbobot terbuka ke ranah pembuatan video, sektor yang masih didominasi produk proprietary .
Perusahaan mengklaim biaya H3 untuk video 2K per detik berada di bawah sepertiga biaya model arus utama . Bagi pengembang, kombinasi input multimodal, audio bawaan, dan rencana pembukaan bobot dapat membuat H3 menarik untuk eksperimen lokal maupun pengembangan produk.
ByteDance mengumumkan Seedance 2.5 dalam konferensi Volcano Engine FORCE pada 23 Juni 2026 . Akses API publik kemudian dibuka pada 16 Juli 2026 .
Pembaruan paling menonjol adalah kemampuan membuat video berdurasi hingga 30 detik dalam satu kali proses. Artinya, pengguna tidak perlu menyatukan banyak segmen pendek untuk membentuk satu klip panjang . Resolusinya dapat mencapai 4K (3840×2160) dengan kedalaman warna 10-bit .
Seedance 2.5 juga mendukung hingga 50 referensi multimodal, termasuk gambar, klip audio, model putih 3D, referensi gaya, dan arahan adegan—meningkat dari 12 referensi pada versi sebelumnya .
ByteDance turut memperkenalkan penyuntingan berbasis wilayah. Fitur ini memungkinkan pengguna mengubah area tertentu dalam klip tanpa harus membuat ulang seluruh video . Use case yang disebutkan mencakup film, iklan, pendidikan, manufaktur industri, dan simulasi kendaraan otonom .
Ketiga peluncuran ini tidak terjadi pada hari yang sama, tetapi sebagian besar berdekatan pada akhir Juli 2026. Polanya memperlihatkan beberapa strategi yang sama:
Framing awal menyebut ketiga peluncuran tersebut terjadi pada 26 Desember 2024. Bukti yang tersedia tidak mendukung tanggal itu. Sumber yang ada justru menempatkan DeepSeek V4-Flash pada April dan Juli 2026, MiniMax H3 pada 31 Juli 2026, serta Seedance 2.5 pada Juni–Juli 2026.
Bukti yang tersedia juga belum memverifikasi klaim bahwa model open source China menyumbang 41% unduhan global, maupun klaim spesifik tentang tuduhan pejabat Amerika Serikat terkait distilasi model. Klaim tersebut mungkin berkaitan dengan peristiwa DeepSeek-V3 atau Qwen sebelumnya, tetapi tidak dapat dipastikan berdasarkan sumber yang digunakan di sini.
| Model | Waktu peluncuran | Spesifikasi utama |
|---|---|---|
| DeepSeek V4-Flash | Pratinjau: 24 April 2026; beta publik: 31 Juli 2026 | MoE 284 miliar parameter, 13 miliar aktif; konteks 1 juta token; US$0,14 per 1 juta token input |
| MiniMax H3 | 31 Juli 2026 | Video 2K hingga 15 detik; audio stereo bawaan; bobot model dijanjikan untuk dirilis |
| ByteDance Seedance 2.5 | Diumumkan 23 Juni 2026; API dibuka 16 Juli 2026 | Video satu kali proses hingga 30 detik; resolusi hingga 4K; 50 referensi multimodal |
DeepSeek V4-Flash, MiniMax H3, dan Seedance 2.5 menunjukkan percepatan kompetisi AI China pada pertengahan 2026. Ciri utamanya bukan peluncuran serentak pada Desember 2024, melainkan kombinasi biaya yang agresif, dorongan menuju bobot terbuka, konteks yang lebih panjang, dan kemampuan generasi video yang semakin mendekati kebutuhan produksi nyata.