DeepSeek 於 2026 年 8 月 17 日凌晨 0 時(北京時間)起,將 V4 Flash 與 V4 Pro 改為分時定價;離峰價格是尖峰價格的一半,尖峰時段為每日 09:00–12:00 與 14:00–18:00。 尖峰時段每百萬輸出 token 的價格,V4 Flash 為人民幣 9 元、V4 Pro 為人民幣 27 元;命中快取的輸入 token 仍遠低於未命中快取的輸入。
研究答案

Create a landscape editorial hero image for this Studio Global article: What changed when DeepSeek’s new API pricing for DeepSeek-V4-Flash and DeepSeek-V4-Pro took effect at midnight on August 17, 2026—including. Article summary: At 00:00 Beijing time on August 17 (16:00 UTC on August 16), DeepSeek replaced flat V4 API pricing with time-of-use pricing: off-peak rates are exactly half peak rates. Peak is 09:00–12:00 and 14:00–18:00 Beijing time da. Topic tags: general, news, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, waterm
DeepSeek 已於 2026 年 8 月 17 日 00:00(北京時間) 將 V4 API 從固定價格改為尖峰/離峰分時計費,對應 2026 年 8 月 16 日 16:00 UTC。新制下,離峰價格固定是尖峰價格的一半;但與原本的固定價格相比,實際漲幅會依模型、token 類型與使用時段而不同,介於 50% 至 1,100%。1
2
此次調整適用於 DeepSeek-V4-Flash 與 DeepSeek-V4-Pro。每日尖峰時段為:
其餘時間皆屬離峰。單一請求會依平台伺服器收到請求的時間計費,而不是依模型完成回應的時間判定;因此,開發者若要排程流量,必須將北京時間納入系統邏輯。2
7
換句話說,同一個 API 呼叫在尖峰時段的費用是離峰時段的兩倍。這並非單純全面調高價格,而是把算力成本與使用時間綁在一起。
以下金額均為每百萬 token 的人民幣價格。其中,「快取命中」代表輸入內容可沿用先前已快取的提示詞前綴;「快取未命中」則按較高的未快取輸入價格計算。
| 模型/token 類型 | 原固定價格 | 離峰價格 | 與原價相比 | 尖峰價格 | 與原價相比 |
|---|---|---|---|---|---|
| V4-Flash 快取命中輸入 | ¥0.02 | ¥0.05 | +150% | ¥0.10 | +400% |
| V4-Flash 快取未命中輸入 | ¥1.00 | ¥1.50 | +50% | ¥3.00 | +200% |
| V4-Flash 輸出 | ¥2.00 | ¥4.50 | +125% | ¥9.00 | +350% |
| V4-Pro 快取命中輸入 | ¥0.025 | ¥0.15 | +500% | ¥0.30 | +1,100% |
| V4-Pro 快取未命中輸入 | ¥3.00 | ¥4.50 | +50% | ¥9.00 | +200% |
| V4-Pro 輸出 | ¥6.00 | ¥13.50 | +125% | ¥27.00 | +350% |
官方文件列出的 V4-Flash 離峰價格,依序為快取命中輸入 ¥0.05、快取未命中輸入 ¥1.50、輸出 ¥4.50;尖峰時段則為 ¥0.10、¥3 與 ¥9。2 Reuters 報導指出,這次 V4 調價依模型、token 類別與使用時間而定,整體漲幅最高達 1,100%。
1
模型評測、文件索引、資料回填、合成資料生成,以及其他不要求即時完成的任務,都可以避開上述兩個尖峰區間。由於離峰價格只有尖峰的一半,單靠排程就可能明顯降低彈性工作負載的成本。2
這也讓時區成為 AI 基礎設施的新營運變數。佇列系統若同時知道任務期限與北京時間的計費窗口,就能延後處理,不必更換模型或壓縮 token 預算。
客服機器人、程式撰寫助手與即時代理通常必須在使用者提出要求時回應,幾乎沒有利用時段差價的空間。這類應用可能需要承擔尖峰費率,但仍可從幾個方向控管成本:重複利用提示詞、提高快取命中率、縮短輸出,以及根據任務難度進行模型路由。
快取尤其重要。兩個模型的快取命中輸入價格,都明顯低於快取未命中輸入。對於反覆傳送相同系統指令、工具定義或文件內容的高流量服務,提高快取命中率,可能比小幅降低請求量更有效。
長篇推理過程、自動產生報告與大型程式碼回覆,都會消耗大量輸出 token。尖峰時段,V4-Flash 輸出每百萬 token 為 ¥9,V4-Pro 則為 ¥27。開發者可考慮設定更嚴格的輸出上限、讓 Flash 處理例行請求,並只在額外能力值得支付溢價時使用 Pro。1
2
V4-Pro 尖峰時段的快取命中輸入價格,是原固定價格的 12 倍,為本次調整中百分比漲幅最大的一項。它的絕對價格仍低於未命中輸入與輸出,但對大量處理重複快取提示詞的服務而言,影響會較為明顯。1
19
這次價格調整發生在 DeepSeek-V4-Pro-0813 正式可用之後。該版本透過 deepseek-v4-pro 端點提供服務;外部報導的規格包括 100 萬 token context window、最高 384,000 token 輸出,以及採用混合專家(MoE)架構、總參數約 1.6 兆、每個 token 啟用約 490 億參數。29
33
DeepSeek 的帳戶級併發限制也區分兩個產品層級:
請求從開始處理到完整回應結束前都會占用併發名額,串流回應也包括在內。28
綜合價格與併發限制來看,Flash 較適合高吞吐量的例行流量;Pro 則更像是提供給高難度推理與大型上下文工作負載的容量受限層級。不過,這是根據公開價格與限制所作的推論,並非 DeepSeek 對所有使用情境的直接定義。2
28
DeepSeek 的做法近似於對 GPU 推論需求進行「需求塑形」:互動式使用者通常在特定時段集中上線,而批次工作往往可以等待。服務商在需求高峰收取較高費用、在其他時段提供較低價格,便能鼓勵工作負載分散到全天不同時段。
對開發團隊而言,成本最佳化不再只是選擇模型、計算 token 數量,還包括:
更大的訊號是,大型模型市場可能逐漸從單純的固定低價競爭,轉向依照算力稀缺程度定價。DeepSeek 仍為可彈性調度的需求保留較低成本通道,但也讓高階推論的價格更直接反映使用時間與容量壓力。Reuters 將這次調整描述為依模型、token 類別與使用時段而變動的大幅漲價,而非單一、全面性的加價。1
對使用 DeepSeek V4 的團隊來說,實際重點很清楚:排程、快取、模型路由與輸出控制,都應納入 API 成本模型。無法延後的工作,可能需要改用其他模型或收緊 token 預算;可以等待的工作,則有機會透過離峰執行保留更多成本效益。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
DeepSeek 於 2026 年 8 月 17 日凌晨 0 時(北京時間)起,將 V4 Flash 與 V4 Pro 改為分時定價;離峰價格是尖峰價格的一半,尖峰時段為每日 09:00–12:00 與 14:00–18:00。
DeepSeek 於 2026 年 8 月 17 日凌晨 0 時(北京時間)起,將 V4 Flash 與 V4 Pro 改為分時定價;離峰價格是尖峰價格的一半,尖峰時段為每日 09:00–12:00 與 14:00–18:00。 尖峰時段每百萬輸出 token 的價格,V4 Flash 為人民幣 9 元、V4 Pro 為人民幣 27 元;命中快取的輸入 token 仍遠低於未命中快取的輸入。
模型選擇、提示詞快取、輸出長度與工作排程,如今已成為彼此相連的 API 成本管理決策。