DeepSeek 於 2026 年 8 月 16 日將 API 定價從單一費率改為尖峰/離峰制,V4 Pro 輸出 token 價格從 $0.87 漲至尖峰時段的 $3.96,漲幅高達 355%。 獨立評測公司 Composio 測試顯示,DeepSeek V4 Flash 在 8 種 Agent 框架下,240 次任務中僅成功 129 次,總體通過率為 53.8%。
研究答案

Create a landscape editorial hero image for this Studio Global article: What pricing changes did DeepSeek implement for its V4 API models on August 16, 2026, how does the new peak and off-peak tiered structure co. Article summary: **Pi Agent** led in both success rate (20/30) and cost efficiency ($0.028/task).. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence
2026 年 8 月 16 日,DeepSeek 實施了 AI API 市場中最重大的定價變革之一,將原先的每 token 固定費率改為尖峰/離峰定價結構,部分 token 類型的成本漲幅最高達 1,555% 。同一週,獨立測試公司 Composio 的報告顯示,DeepSeek 排名最高的 V4 Flash 模型在 8 種不同的 Agent 調度框架中,僅完成了 53.8% 的真實世界任務,暴露了基準測試分數與生產可靠性之間的巨大差距
。這兩項發展迫使企業重新評估大規模部署 DeepSeek V4 所需的總體成本和調度成熟度。
自 2026 年 8 月 16 日 UTC 時間 16:00 起,DeepSeek 將 V4-Flash 和 V4-Pro 的定價從單一費率改為雙層結構 。尖峰時段為 UTC 時間 01:00–04:00 和 06:00–10:00(每日共 7 小時);其餘所有時間均為離峰時段
。離峰費率為尖峰費率的一半,但與先前的固定費率相比,每種 token 類型的價格仍然上漲
。
| 模型 | Token 類型 | 舊固定費率 | 離峰費率 (新) | 尖峰費率 (新) | 有效變動 |
|---|---|---|---|---|---|
| V4-Flash | 輸入 (cache miss) | $0.14 | $0.21 | $0.42 | 離峰 +50%, 尖峰 +200% |
| V4-Flash | 輸入 (cache hit) | $0.0028 | $0.007 | $0.014 | 離峰 +150%, 尖峰 +400% |
| V4-Flash | 輸出 | $0.28 | $0.42 | $0.84 | 離峰 +50%, 尖峰 +200% |
| V4-Pro | 輸入 (cache miss) | $0.435 | $0.99 | $1.98 | 離峰 +128%, 尖峰 +355% |
| V4-Pro | 輸入 (cache hit) | $0.003625 | $0.03 | $0.06 | 離峰 +728%, 尖峰 +1,555% |
| V4-Pro | 輸出 | $0.87 | $1.98 | $3.96 | 離峰 +128%, 尖峰 +355% |
價格資料來源:DeepSeek 官方費率卡及獨立追蹤平台 。
漲幅最驚人的是 V4-Pro 的快取命中 (cache-hit) 輸入 token,從 $0.003625 飆升至尖峰時段的 $0.06,漲幅約 1,555% 。DeepSeek 表示,這項變更是為了更有效地分配資源,並鼓勵用戶將非緊急的工作負載安排在離峰時段執行
。
2026 年 8 月,獨立測試公司 Composio 在 8 種不同的 Agent 調度框架上,對 DeepSeek V4 Flash 進行了 30 個精心設計、步驟複雜的真實工作流程測試,這些任務涵蓋了 Gmail、GitHub、Slack 和 Google Sheets 等即時工具 。每個任務有 900 秒的超時限制,所有框架皆使用相同的 Composio MCP 工具
。
整體結果:在總共 240 次運作中,只有 129 次成功——總體通過率為 53.8%。僅有 6 個工作流程被所有框架成功完成 。
| 調度框架 (Harness) | 通過率 (30 項任務中) | 每項成功任務的成本 |
|---|---|---|
| Pi Agent | 20/30 (66.7%) | $0.028 |
| Prime Agent | ~15/24 (62.5% 有效運作) | $0.131 |
| OMP (Oh My Pi) | 17/30 (56.7%) | $0.103 |
| Claude Code | 16/30 (53.3%) | $0.195 |
| Codex | 16/30 (53.3%) | $0.081 |
| Deep Agents (LangChain) | 16/30 (53.3%) | $0.045 |
| Hermes Agent | 15/30 (50.0%) | $0.056 |
| OpenCode | 14/30 (46.7%) | $0.067 |
Pi Agent 在成功率(20/30)和成本效率(每任務 $0.028)方面均領先 。不同的框架在成功率、成本和速度這幾個指標上各有所長,這意味著調度框架的選擇與模型能力本身同等重要
。最佳與最差框架之間高達 20 個百分點的差距,顯示任務表現對 Agent 框架、工具配置、快取策略、重試機制和供應商堆疊具有極高的敏感性
。
價格上漲和不穩定的現實世界測試結果,促使分析師重新評估 DeepSeek V4 在企業中的適用性。
VentureBeat 指出,同一個 V4 Flash 模型,只因搭配了不同的框架、工具和快取堆疊,就產生了顯著不同的結果——這意味著企業在選擇模型的同時,也必須投資於調度成熟度 。Composio 自己的評論也表明,僅是框架的選擇就能讓成功率相差三個任務,成本相差近 3 倍,速度相差 2.2 倍
。
即使是離峰時段,每一種 token 類型都比以前更貴。分析師認為,這將改變高流量 Agent 工作負載(特別是先前依賴 DeepSeek 低價策略的客服機器人和程式碼生成管線)的投資回報率(ROI)計算 。
DeepSeek 官方 Agent 基準測試分數看起來很亮眼(Terminal-Bench 2.1 得分 82.7,Toolathlon-Verified 得分 70.3),但僅 53.8% 的真實世界通過率提醒我們,在充滿即時 API、速率限制和狀態化工作流程的生產環境中,排行榜上的高分並不保證可靠性 。
API 流量會經過位於中國的伺服器,這為受到監管的企業帶來了合規挑戰。分析師建議,在資料治理、審計軌跡和工具權限控管方面,需要進行謹慎的架構規劃 。對於受監管行業來說,自行託管開源權重仍然是導入生產環境的唯一可行途徑
。
BayTech Consulting 的企業框架建議,DeepSeek V4 適用於非敏感文件的摘要生成、開放儲存庫的程式碼生成以及高容量的內容草稿——但在投入生產前,必須對每個工作負載進行嚴格的評估 。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
DeepSeek 於 2026 年 8 月 16 日將 API 定價從單一費率改為尖峰/離峰制,V4 Pro 輸出 token 價格從 $0.87 漲至尖峰時段的 $3.96,漲幅高達 355%。
DeepSeek 於 2026 年 8 月 16 日將 API 定價從單一費率改為尖峰/離峰制,V4 Pro 輸出 token 價格從 $0.87 漲至尖峰時段的 $3.96,漲幅高達 355%。 獨立評測公司 Composio 測試顯示,DeepSeek V4 Flash 在 8 種 Agent 框架下,240 次任務中僅成功 129 次,總體通過率為 53.8%。
Pi Agent 框架表現最佳,成功完成 20/30 項任務,且每成功任務成本僅 $0.028,顯示調度框架的選擇比模型本身更關鍵。