DeepSeek喺2026年8月13日宣布V4 Pro同V4 Flash嘅API價格上調50%至1,100%,新嘅高峰/離峰收費制度將喺UTC時間8月16日下午4點生效 [17][19]。 V4 Pro同V4 Flash都支援100萬token嘅上下文視窗、MIT開源授權,以及最高38.4萬token嘅輸出長度。
研究答案

Create a landscape editorial hero image for this Studio Global article: What new API pricing did DeepSeek announce for its V4 models, when does it take effect, and what are the key details about the models' conte. Article summary: On August 13, 2026, DeepSeek announced major API price increases for its V4-Pro and V4-Flash models, with new peak/off-peak billing tiers taking effect at **16:00 UTC on August 16, 2026** [1][4]. The increases range from. Topic tags: general, academic, documentation, general web, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
2026年8月13日,DeepSeek宣布V4-Pro同V4-Flash模型嘅API價格將會大幅調整,最高加幅達1,100%,仲會引入「高峰/離峰」收費制度,UTC時間2026年8月16日下午4點正式生效 。具體加幅由50%到1,100%不等,視乎模型、token種類同使用時段而定
。呢次加價標誌住DeepSeek告別咗以往「平到笑」嘅定價策略,迎嚟全新嘅收費時代。
DeepSeek係第一個引入「按時段浮動收費」嘅主要AI API供應商,概念同電費嘅高峰/離峰收費差唔多 。離峰時段嘅收費係高峰時段嘅一半,即係話高峰時段用API會貴一倍
。根據資料,高峰時段(UTC)係01:00–04:00同06:00–10:00
。
| Token類型 | 現有價格 | 新離峰價格 | 新高峰價格 |
|---|---|---|---|
| 輸入(cache miss) | $0.435 | 約$0.44–$0.49(估算) | 約$0.87–$0.98(估算) |
| 輸出 | $0.87 | $1.98 | $3.96 |
| Token類型 | 現有價格 | 新離峰價格 | 新高峰價格 |
|---|---|---|---|
| 輸入(cache miss) | $0.14 | 約$0.21(估算) | 約$0.42(估算) |
| 輸出 | $0.28 | $0.63 | $1.26 |
(輸入cache miss嘅新價格係根據已確認嘅輸出倍數估算。輸出價格嘅升幅已獲多個來源確認 。)
快取輸入token就平好多。以V4-Pro為例,cache-hit輸入大約係每百萬token $0.004,折扣幅度高達100倍,明顯係想鼓勵開發者善用快取策略 。
V4-Pro同V4-Flash都係純文字、Mixture-of-Experts(MoE)架構,採用MIT授權,完全開放權重,可以自己host 。
| 規格 | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| 總參數 | 1.6萬億 | 2840億 |
| 每個token活躍參數 | 約490億 | 約130億 |
| 上下文視窗 | 1,000,000 tokens | 1,000,000 tokens |
| 最大輸出長度 | 384,000 tokens | 384,000 tokens |
| 授權 | MIT | MIT |
兩個模型都支援三種推理模式:Non-think(快速、直覺)、Think High(邏輯分析,連鎖思維)同Think Max(深度推理) 。
新價格重塑咗DeepSeek嘅競爭定位。以下比較係基於所有供應商嘅標準短上下文API價格(每百萬token)。
| 模型 | 輸入(每百萬) | 輸出(每百萬) |
|---|---|---|
| DeepSeek V4-Pro(高峰) | 約$0.87–$0.98 | $3.96 |
| DeepSeek V4-Flash(高峰) | 約$0.42 | $1.26 |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 |
| Anthropic Claude Fable 5 | $10.00 | $50.00 |
(資料來源:DeepSeek ,OpenAI
,Anthropic
)
OpenAI喺2026年7月30日將GPT-5.6 Luna嘅價格大幅削減80%,變成輸入$0.20、輸出$1.20每百萬token 。競爭格局完全扭轉:
以前DeepSeek係平價首選,但而家OpenAI嘅最平方案反而變咗價格領導者 。
Anthropic嘅旗艦推理模型定價係輸入$10、輸出$50每百萬token 。喺呢個價位,DeepSeek仍然係抵玩之選:
就算係新嘅高價,兩個DeepSeek模型仍然遠比Anthropic嘅頂級方案平得多 。
xAI嘅Grok 4.6價格喺提供嘅資料入面搵唔到,所以冇得直接比較。
DeepSeek指出,需求爆升導致推論容量緊張係加價嘅主因 。V4模型喺2026年4月預覽版推出之後極速普及,造成GPU容量樽頸,公司冇辦法再維持以前咁低嘅價格
。
多個市場因素同時出現:
DeepSeek呢次加價,標誌住佢作為「最平前沿API供應商」嘅時代已經結束。而家佢喺某啲方面同OpenAI最平模型嘅價格水平差唔多,但仍然遠比Anthropic嘅頂級方案平一個數量級。對於開發者嚟講,高峰/離峰收費、深度快取折扣同MIT開放權重呢個組合,意味住決定最終API賬單嘅,將會係工作量嘅架構設計,而唔係單純嘅模型選擇。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
DeepSeek喺2026年8月13日宣布V4 Pro同V4 Flash嘅API價格上調50%至1,100%,新嘅高峰/離峰收費制度將喺UTC時間8月16日下午4點生效 [17][19]。
DeepSeek喺2026年8月13日宣布V4 Pro同V4 Flash嘅API價格上調50%至1,100%,新嘅高峰/離峰收費制度將喺UTC時間8月16日下午4點生效 [17][19]。 V4 Pro同V4 Flash都支援100萬token嘅上下文視窗、MIT開源授權,以及最高38.4萬token嘅輸出長度。
DeepSeek解釋加價係因為需求激增同GPU容量樽頸,呢個決定令佢哋成為首間引入結構性按時段收費嘅主要AI API供應商 [1][22]。