API定價定喺每百萬輸入tokens $0.14,每百萬輸出tokens $0.28,快取輸入更平到每百萬tokens $0.028。呢個價錢令V4-Flash成為目前最平嘅前沿推理API——比Gemini 2.5 Flash($0.30/$2.50)平一大截。
一個重新訓練嘅「0731版本」喺2026年7月31日作為官方公測版推出。0731版本喺智能體(agent)基準測試上甚至贏過更大嘅V4-Pro-Preview:Terminal Bench 2.1得分82.7,Cybergym得分76.7。模型支援可設定嘅推理模式(標準、高、最高思考強度),同時保留非思考模式俾高吞吐量Pipeline使用。
MiniMax喺2026年7月31日正式發布H3,定位為通用多模態生成模型,可以喺統一嘅上下文入面同時處理文字、圖像、影片同音訊。模型可以生成最長15秒嘅2K解像度(2560×1440)影片,行24fps,仲有原生立體聲音訊——唔需要另外駁音訊Pipeline。
H3一次過可以接受最多9張圖像 + 3段影片 + 3條音軌作為參考輸入。MiniMax承諾會喺數日內開放模型權重,將開源策略延伸至影片生成領域——呢個領域嘅主流商業競爭對手多數都唔肯開源。公司仲話H3喺2K解像度下每秒生成成本唔到主流競品嘅三分之一。
ByteDance喺2026年6月23日嘅火山引擎FORCE大會上宣布Seedance 2.5,然後喺2026年7月16日開放公開API。
最大升級係:30秒單次生成影片——唔使駁片,一次過生成完整片段。解像度最高可達4K(3840×2160),支援10-bit色深。模型可以接受最多50個多模態參考輸入——包括圖像、音訊剪輯、3D白模、風格參考同場景指示——比上一代嘅12個大幅增加。
ByteDance仲推出區域編輯功能,容許用戶只修改生成片段嘅特定區域,唔使成條片重新生成。應用場景涵蓋電影、廣告、教育、工業製造同自動駕駛模擬。
呢三款模型——特別係7月31日同日登場嘅DeepSeek V4-Flash同MiniMax H3——有以下共通策略:
原始敘述話呢三款模型係2024年12月26日同時發布,仲提到中國開源模型佔全球下載量41%、美國指控模型蒸餾等內容。但現有搜尋結果完全唔支持呢個2024年12月嘅時間點,亦搵唔到相關統計數據。呢啲說法可能同更早嘅DeepSeek-V3或Qwen事件有關,但通過現有資料冇辦法核實。
| 模型 | 發布日期 | 主要規格 |
|---|---|---|
| DeepSeek V4-Flash | 預覽版:2026年4月24日;公測版:2026年7月31日 | 284B MoE(13B激活),100萬上下文,$0.14/M輸入tokens |
| MiniMax H3 | 2026年7月31日 | 15秒2K影片,原生立體聲,承諾開放權重 |
| ByteDance Seedance 2.5 | 發布:2026年6月23日;API:2026年7月16日 | 30秒單次生成,4K,50個多模態參考輸入 |
呢三款模型——DeepSeek V4-Flash、MiniMax H3同ByteDance Seedance 2.5——代表咗2026年中中國AI行業嘅一次協同加速:更低成本、開源權重分發、以及大幅延長嘅生成能力。