DeepSeek 於 2026 年 8 月 13 日一次過公布三項更新:正式推出 DeepSeek-V4-Pro-0813、重新設計 V4 API 收費,以及開源 DeepSeek Harness(dsh)v0.1。
對開發者嚟講,重點唔只係模型跑分上升。V4 Pro 的 API 不再採用簡單劃一的超低價,而係按繁忙及非繁忙時段收費;與此同時,DeepSeek 亦提供一層用嚟建立編程及自動化智能體的工具。換句話講,模型本身更強,但成本計算亦變得複雜。
8 月 17 日起改行繁忙、非繁忙時段收費
新收費於 **2026 年 8 月 17 日凌晨 0 時(北京時間)**生效,即 8 月 16 日 16:00 UTC。V4 Pro 及 V4 Flash 會由原本的劃一價格,改為繁忙時段(peak)及非繁忙時段(off-peak)兩級收費;非繁忙時段價格固定為繁忙時段的一半。
9
14
官方列出的工作日繁忙時段為北京時間 09:00–12:00 及 14:00–18:00,其餘時間屬於非繁忙時段。
9
14
以 V4 Pro 每百萬 token 計算,非繁忙時段的新舊價格如下:
| 收費項目 |
之前價格 |
新非繁忙時段價格 |
變幅 |
| 已命中快取的輸入(cached input) |
¥0.025 |
¥0.15 |
+500% |
| 未命中快取的輸入(uncached input) |
¥3 |
¥4.50 |
+50% |
| 輸出(output) |
¥6 |
¥13.50 |
+125% |
以上數字來自發布公告報道及 DeepSeek API 價格資料。
11
16
繁忙時段價格則是上述非繁忙價格的兩倍,即每百萬 token 收費 ¥0.30(快取輸入)、¥9(未快取輸入)及 ¥27(輸出)。
11
13
對智能體工作流程而言,快取輸入加價尤其值得留意。編程智能體往往會在多個步驟反覆送出同一批項目檔案、指令或對話背景;即使內容被快取,相關輸入成本仍由每百萬 token ¥0.025 升至非繁忙時段的 ¥0.15。輸出價格亦明顯上升:以美元計,由調整前每百萬 token US$0.87,升至非繁忙時段 US$1.98,繁忙時段則為 US$3.96。
6
9
整個 V4 系列的加幅視乎模型、token 類別及使用時段而定,介乎 50% 至 1,100%。
2 因此,開發者預算日後唔可以只睇「用邊個模型」,亦要計埋「幾點鐘執行」。批量處理、評測、索引等可以延後的工作,安排喺非繁忙時段進行,或有助控制成本;需要即時回應的工作就可能面對最高收費。
V4-Pro-0813:編程及智能體跑分大幅上升
V4-Pro-0813 是 DeepSeek V4 Pro 旗艦模型的正式版(General Availability)。DeepSeek 發布的比較表顯示,正式版在多項編程及智能體基準測試中較 V4 Pro 預覽版有明顯進步。例如,Terminal-Bench 2.1 由 72.1 升至 87.9,而 DeepSWE 由 12.8 升至 62.7。
4
40
有些比較文章將 DeepSWE 的起點寫成 7.3,但呢個數字其實係 V4 Flash Preview 的分數;V4 Pro Preview 的正確基線為 12.8。將兩者混為一談,會誇大 V4 Pro 的提升幅度。
40
DeepSeek 的模型卡亦將 V4-Pro-0813 與 Claude Opus 4.8、Claude Fable 5、Kimi K3 及 GLM-5.2 等模型作比較。結果並非每一項都勝出:V4-Pro-0813 在部分編程、工具使用及智能體測試領先,但在某些知識、程式庫生成及智能體評測中仍落後其他模型。
35
36
40
更重要的是,以上主要屬於 廠商自行公布的基準測試結果,唔應直接視為 V4 Pro 在所有情況下都超越競爭對手的獨立證明。現有分析指出,第三方驗證仍然有限,而結果亦可能受到測試工具、提示詞、可用工具及評測設定影響。
41
DeepSeek Harness:由賣模型走向智能體工作流程
DeepSeek 同日推出 DeepSeek Harness(dsh)v0.1,一套採用 MIT 授權的開源智能體框架,定位上可視為 Anthropic Claude Code 一類產品的開源替代方案。
18
22
Harness 軟件本身免費,但使用者仍要為接駁的模型或 API 付費。因此,使用智能體的實際成本,唔係來自另一個 Harness 訂閱,而係來自模型推理用量。
17
23
兩項更新放埋一齊看,戰略意味相當清楚:DeepSeek 免費提供用嚟建立編程及自動化智能體的工作流程層,再透過模型 API 的推理用量變現。對開發者嚟講,真正要計的唔再係單獨一次 prompt 價錢,而係一個智能體完成整項任務時,總共要行幾多步、重試幾多次,以及需要幾多人工覆核。
低價 token 時代完結?證據未足,但模式已變
今次調整唔足以證明全行業的低成本 AI token 已經完結。不過,佢清楚顯示 DeepSeek 早期針對高能力生產模型採用的超低劃一價格,並唔係永久承諾。
繁忙及非繁忙時段收費同時具備資源管理及收入變現作用。DeepSeek 表示,制度旨在更合理分配資源,並鼓勵使用者按實際用量安排工作。
14 對開發者而言,這會令可延後的批量任務更有誘因移到非繁忙時段;而對延遲敏感、必須即時執行的工作,成本就會較高。
更大的轉變,係競爭單位由 token 經濟轉向 任務經濟。一個模型就算每個 token 貴啲,但如果可以用更少失敗嘗試、更少協調步驟或更少人工覆核完成編程及研究任務,總成本未必更高。相反,token 單價再低,如果智能體經常重試、出錯或需要人手介入,整體成本亦可能上升。
所以,8 月 13 日的發布組合更像係 DeepSeek 的重新定位,而唔係單純退出價格競爭:V4-Pro-0813 提供更強的高階模型,DeepSeek Harness 提供開放的智能體工作流程層,而繁忙時段定價則為稀缺或急切的推理算力設置更高價格。
現有證據支持 DeepSeek 正向完整的智能體工作流程靠攏,但未足以說明公司已經由模型 API 供應商,完全轉型成為交付整項任務結果的服務商。