DeepSeek 表示,V4 Pro 0813 在 Terminal Bench 2.1、CyberGym 與 DeepSWE 的分數,較 4 月預覽版分別提升至 87.9、83.3 與 62.7;不過這些仍是廠商自行公布、尚待獨立驗證的結果。 開源的 MIT 授權 Harness 讓 DeepSeek 從模型 API 延伸到 Agent 工作流程與開發者工具層;同時,V4 Pro 輸出定價從每百萬 Token 0.87 美元提高至離峰 1.98 美元、尖峰 3.96 美元。
研究答案

Create a landscape editorial hero image for this Studio Global article: What does DeepSeek’s move to general availability for its 1.6-trillion-parameter V4 Pro 0813 flagship model—released through the app’s Exper. Article summary: DeepSeek’s GA release appears to be a strategic pivot from a low-cost model vendor toward an integrated agent platform: a stronger flagship model, an open developer runtime, demand-shaping pricing, and capital-intensive . Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
DeepSeek V4 Pro 0813 正式上市,透露的訊息不只是「模型變強了」。這家中國 AI 新創同時推出開源 Agent 執行環境、依需求調整的 API 定價,以及足以支撐長期擴張的大型基礎設施計畫,顯示它正從低價模型供應商,轉向涵蓋模型、工具與算力的完整 AI 平台。
不過,最亮眼的效能數字目前仍主要來自 DeepSeek 自行公布的資料。因此,較穩妥的解讀不是宣稱它已經全面擊敗競爭對手,而是:DeepSeek 正試圖在整個 Agent 技術堆疊上與市場領先者競爭。
DeepSeek 表示,V4 Pro 0813 相較 4 月的預覽版本,在軟體工程與 Agent 評測上有明顯進步:
這些數字來自 DeepSeek 公布的比較表,並由發布相關報導轉載。 在 Terminal-Bench 2.1 上,V4 Pro 0813 的 87.9 分,僅比同一比較表中歸給 Anthropic Fable 5 的 88.0 分低 0.1 分。
若這些結果能在獨立測試中重現,V4 Pro 0813 將具備接近前沿水準的 Agent 能力,尤其適用於瀏覽程式碼儲存庫、呼叫工具、執行指令,以及完成多步驟軟體開發任務。
但這裡必須加上一個重要前提:上述分數是廠商自行公布的結果,目前可取得的報導也沒有證明它們已在共同評測框架下獲得第三方重現。DeepSWE 從 12.8 分大幅升至 62.7 分確實值得注意,卻不能單靠一次基準測試,就推論模型在真實工作環境中同樣可靠。
這次發布中,更具戰略意義的部分或許是 DeepSeek Harness。這是一套採 MIT 授權的開源 Agent 執行環境,位於語言模型與使用者開發環境之間,負責協調工具、檔案、指令、工作階段與多步驟流程。DeepSeek 的程式碼儲存庫將它描述為開源 Agent harness,並揭露第三方相依套件及其授權資訊。
這讓競爭範圍發生變化。DeepSeek 不再只是和其他模型供應商爭奪 API 呼叫量;透過 Harness,它也進入了 Claude Code 與 Codex 所處的工作流程層。對開發者而言,這一層決定了 Agent 如何運作、能存取哪些工具,以及使用者能保留多少對執行環境的控制權。
Harness 上線後迅速受到關注。第三方追蹤顯示,專案發布約一小時後便突破 20,000 顆 GitHub 星星,至 8 月 17 日則超過 141,000 顆。 這反映開發者有高度興趣,但 GitHub 星星不等於正式部署量、留存使用者數,也不代表已完成安全整合。
實務上仍需保持謹慎。Harness v0.1 目前是開發者預覽版,相關報導指出,未來預期會出現相容性破壞性變更。 以插件為核心的架構能提高客製化彈性,也可能增加營運複雜度。每加入一項工具或插件,就會衍生權限管理、維護、錯誤處理與資料存取等問題。
此外,多步驟協調流程與冗長的工具描述可能推高 Token 用量,讓模型表面上的低單價,不一定等於完整自主工作流程的低成本。
目前超過 2,000 項插件提案,代表生態系具有熱度,卻不代表插件市場已經成熟或值得信任。 有意導入 Harness 的團隊,應先在隔離環境測試插件、審查權限,並以完成一項任務的總成本評估框架,而不是只看儲存庫的星星數。
DeepSeek API 的定價改革之所以重要,在於它從過去的固定價格,轉向依照需求時段計費。最初公布的方案以北京時間劃分尖峰時段,但後續價格追蹤資料則列出相對應的 UTC 時段。由於不同報導對已公布的時段說法並不完全一致,開發者在安排工作負載前,仍應以 DeepSeek 官方定價文件的最新資訊為準。
目前較明確的是價格方向,而不是每個時段的具體安排。根據新價格相關報導,V4 Pro 輸出 Token 的費用,從每百萬 Token 0.87 美元提高至離峰 1.98 美元,尖峰則為 3.96 美元。 視模型、Token 類型與計費時段而定,V4 家族部分 Token 類別的價格增幅甚至超過 1,100%。
對開發者而言,影響相當直接:
這不只是一次變現策略調整。尖峰定價也可作為容量管理工具,鼓勵具備時間彈性的工作避開需求最高的時段。這透露 DeepSeek 開始把推論服務視為稀缺的基礎設施資源,而不是單純以低價作為主要成長手段。
即使尖峰輸出價格達每百萬 Token 3.96 美元,V4 Pro 仍遠低於發布報導中所引用、Fable 5 每百萬輸出 Token 50 美元的價格。 因此,對大量程式碼與 Agent 工作負載而言,DeepSeek 仍保有明顯的價格優勢。
但它已不再等同於「幾乎免費」。相較過去 0.87 美元的價格,尖峰價格上漲 355%,會改變大量產出型生產系統的成本計算。 團隊應比較一項任務成功完成的總成本,包括重試、工具呼叫、上下文與延遲,而不只是查看每百萬 Token 的標價。
換句話說,DeepSeek 的價值主張正變得更接近市場常態:它可能仍提供很強的價格/能力比,但同時也要求客戶為更高階的能力付費,並配合公司的算力容量調整工作負載。
DeepSeek 公布的產品策略,也和外界報導的融資及基礎設施計畫相互呼應。路透社報導,DeepSeek 在首輪融資中籌得超過 500 億人民幣,約合 74 億美元。 彭博社則報導,公司計畫在內蒙古烏蘭察布推動資料中心專案,目標新增約 1GW 的運算容量。
這些報導並不能證明整套策略一定成功,也不能保證相關設施會按計畫如期完成;但它們確實顯示 DeepSeek 正走向更資本密集的營運模式。
模型升級、開源執行環境、差異化定價、外部融資與規劃中的算力容量,指向四個彼此連結的目標:
這與過去主要靠「成為最便宜、但仍夠好用的模型供應商」競爭,是截然不同的姿態。
DeepSeek V4 Pro 0813 值得測試,尤其適合程式碼開發、程式碼儲存庫自動化,以及需要呼叫工具的工作流程。但企業與開發團隊應獨立驗證以下四點:
因此,這次發布最值得關注的不是單一分數,而是它所代表的策略轉向。DeepSeek 正試圖從低成本模型供應商,進化為整合式 Agent 平台:V4 Pro 0813 提供能力主張,Harness 提供開發者入口,尖峰定價負責調節需求,而新增資本與規劃中的算力則支撐長期供應。
這能否成為持久優勢,最終仍取決於幾件事:獨立評測是否能驗證效能、軟體是否足夠穩定、插件生態是否安全,以及在價格上調後,開發者是否仍認為它提供足夠的價值。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
DeepSeek 表示,V4 Pro 0813 在 Terminal Bench 2.1、CyberGym 與 DeepSWE 的分數,較 4 月預覽版分別提升至 87.9、83.3 與 62.7;不過這些仍是廠商自行公布、尚待獨立驗證的結果。
DeepSeek 表示,V4 Pro 0813 在 Terminal Bench 2.1、CyberGym 與 DeepSWE 的分數,較 4 月預覽版分別提升至 87.9、83.3 與 62.7;不過這些仍是廠商自行公布、尚待獨立驗證的結果。 開源的 MIT 授權 Harness 讓 DeepSeek 從模型 API 延伸到 Agent 工作流程與開發者工具層;同時,V4 Pro 輸出定價從每百萬 Token 0.87 美元提高至離峰 1.98 美元、尖峰 3.96 美元。
超過 74 億美元的融資,以及內蒙古規模達 1GW 的資料中心計畫,顯示 DeepSeek 正投入長期算力供應,不再只靠「最便宜的模型」競爭。