API定價為每百萬輸入token 0.14美元,每百萬輸出token 0.28美元,快取輸入最低可達每百萬token 0.028美元 。這使V4-Flash成為市面上最便宜的前沿推理API之一——比Gemini 2.5 Flash(每百萬token 0.30美元輸入 / 2.50美元輸出)還要便宜 。
一款重新訓練的「0731版本」已於2026年7月31日作為API的官方公開測試版發佈。據報導,0731版本在代理(agent)基準測試中甚至擊敗了更大的V4-Pro-Preview,在Terminal Bench 2.1上獲得82.7分,在Cybergym上獲得76.7分 。該模型支援可配置的推理模式(標準、高、最大思考力度),以及適用於高吞吐管線的非思考模式 。
MiniMax於2026年7月31日發佈H3,將其定位為一個通用多模態生成模型,能夠在統一的上下文中處理文字、圖片、影片和音訊 。該模型可生成最長15秒的2K解析度(2560×1440)影片,每秒24幀,並在同一次推理中直接輸出原生立體聲音訊——無需單獨的音訊管線 。
H3最多可同時接受9張圖片 + 3段影片 + 3條音軌作為參考輸入 。MiniMax承諾在數天內釋出模型權重,將開源權重的做法擴展到影片生成領域,而該領域的多數商業競爭對手仍採封閉式 。該公司宣稱,H3在2K解析度下的每秒成本不到主流競品的三分之一 。
字節跳動在火山引擎FORCE大會上於2026年6月23日發佈Seedance 2.5 ,並於2026年7月16日開放公開API存取 。
最大的升級亮點是:30秒單次生成影片——一次連續生成即可產出完整片段,無需拼接多個較短片段 。解析度最高可達4K(3840×2160),並支援10位元色彩深度 。該模型最多可接受50個多模態參考輸入——包括圖片、音訊片段、3D白模、風格幀和場景指令——遠高於上一版本的12個 。
字節跳動還推出了區域級編輯功能,使用者可以修改生成片段的特定區域,而無需重新生成整個序列 。其應用範圍涵蓋電影、廣告、教育、工業製造和自動駕駛模擬等領域 。
這三款集中在2026年7月31日前後發佈的模型,展現了共同的戰略主題:
原始框架暗示這三款模型於2024年12月26日同日發佈,並伴隨中國開源模型佔全球下載量41%以及美國指控模型蒸餾等廣泛主張。現有搜尋結果既不支持2024年12月的日期,也不支持這些具體統計數據。這些說法可能與更早的DeepSeek-V3或Qwen事件有關,但本分析無法透過所提供的來源進行驗證。
| 模型 | 發佈日期 | 主要規格 |
|---|---|---|
| DeepSeek V4-Flash | 預覽:2026年4月24日;公開測試:2026年7月31日 | 2840億MoE(130億活躍參數),100萬上下文,每百萬輸入token 0.14美元 |
| MiniMax H3 | 2026年7月31日 | 15秒2K影片,原生立體聲音訊,承諾開源權重 |
| 字節跳動 Seedance 2.5 | 發表:2026年6月23日;API:2026年7月16日 | 30秒單次生成,4K解析度,50組多模態參考輸入 |
這三款模型——DeepSeek V4-Flash、MiniMax H3、字節跳動Seedance 2.5——代表了2026年中中國AI領域的一次協同加速,其特點是更低成本、開源權重分發以及大幅提升的生成能力。