Standard 係功能最完整嘅模式,提供檔案編輯、Shell、搜尋、Skills、規劃、目標、子 Agent 同工作流,適合一般軟件開發任務。
Code mode 透過面向程式碼嘅介面提供工具,模型可以用一段 TypeScript 程式組合多個操作。對於本身包含大量連續工具呼叫嘅任務,咁樣有機會減少逐個工具呼叫嘅重複開銷。
Minimal mode 只保留持久化 Shell 同檔案編輯工具,將執行環境收窄到較基本嘅程度。呢種設計適合較受控嘅模型測試,亦方便研究者觀察模型喺工具較少時會點樣行動。
Creator mode 面向開發自訂 preset 嘅人,加入 runtime 檢查同記憶體內外掛實驗功能,方便開發者了解元件點樣重新組合。
四種模式真正展示嘅,唔係四種產品定位,而係 Harness 可以用唔同外掛組合,砌出唔同類型嘅 Agent。
Harness 另一個重點係可觀測性。佢會將模型睇到同做過嘅內容,以僅追加(append-only)事件串流記錄落來,包括系統提示詞、推理內容、工具呼叫及結果、子 Agent 排程,以及每次上下文注入。呢條事件歷史亦支援搜尋、回放、恢復同分叉。
對開發者來講,最大好處係除錯同重現會容易啲。一次 Agent 執行失敗時,可以返查當時嘅上下文、工具結果同執行次序,而唔係淨係睇最後一句錯誤訊息。分叉功能亦可以由較早嘅時間點開一條新路線,唔使每次都由零開始。
但詳細記錄亦帶來私隱同營運風險。Session Log 可能包含敏感 Prompt、原始碼、工具輸出、意外暴露畀模型嘅憑證,或者其他私人資料。團隊正式使用之前,應該先訂好資料保留期限、存取權限、遮罩規則同 Sandbox 政策,唔好將完整 Trajectory 當成普通日誌咁處理。
DeepSeek Harness 成日被拎來同 Anthropic Claude Code 及 OpenAI Codex 比較,但三者嘅產品位置其實唔一樣。
Claude Code 同 Codex 係整合式編程 Agent 產品,目標係提供一套相對完整、較少設定嘅工作流程。Harness 則係一個開放 runtime,重點唔係聲稱自己一定有更強嘅模型,而係俾開發者控制成個執行層。
可以咁樣理解:
| 比較面向 | DeepSeek Harness | Claude Code/OpenAI Codex |
|---|---|---|
| 產品定位 | 開放式 Agent runtime | 整合式編程 Agent 產品 |
| 模型選擇 | 以模型適配器及外掛方式提高可替換性 | 主要圍繞各自供應商嘅模型同服務 |
| 可擴充程度 | 連核心 Agent Loop 等子系統都可以替換 | 有工具及擴充能力,但核心協調邏輯較由產品控制 |
| 使用方式 | 自行組合、自行管理,透明度較高 | 較方便上手,整體工作流較完整 |
| 追蹤能力 | 以僅追加事件日誌作為核心設計 | 有各自嘅 Session 歷史同工具紀錄,但唔係同一種可替換 runtime 架構 |
因此,Harness 嘅競爭點唔係單純「打贏 Claude Code 或 Codex」,而係提供一個更開放、更高控制度嘅 Agent substrate。佢最終能否成功,取決於呢份自由度值唔值得開發團隊付出額外整合成本。
Harness 公開後吸引到非常強嘅早期關注。有報道指,項目喺公開後約一至一個半鐘已經獲得超過 20,000 粒 GitHub Star,亦有後續報道指截至 2026 年 8 月 17 日,倉庫已超過 141,000 粒 Star。
數字當然矚目,但要留意 GitHub Star 主要反映關注、好奇同收藏意欲,唔代表:
比較穩妥嘅結論係:市場對開放式 Agent 技術棧有相當大興趣。但由 Star 數直接推論 Harness 已經適合生產環境,就未免言之過早。
MIT 授權只適用於框架程式碼,並唔代表模型推理唔使錢。Agent runtime 喺多輪工作入面,可能反覆將系統指令、工具結果、政策同累積歷史重新送畀模型。如果每次互動真係涉及約 47,600 個未命中快取嘅輸入 Token,Context 數量就可能成為成本同延遲嘅重要因素;不過,目前提供嘅較可靠來源未能獨立確認呢個數字。
模型供應商嘅收費亦會直接影響總成本。DeepSeek V4-Pro 推出時,API 收費由固定價格轉向繁忙時段及非繁忙時段定價。有報道列出,V4-Pro 繁忙時段輸出價格為每 100 萬 Token 3.96 美元,較早前嘅 0.87 美元高。
實際一個 Harness 工作流要幾錢,仍然要睇:
所以,「框架開源」同「整套服務低成本」係兩回事。Harness 提供模型選擇自由,但如果使用 DeepSeek 託管 API,推理費用仍然會隨使用量上升。
市場上有關早期第三方外掛失效,以及短期內出現大量外掛提案嘅報道,現階段未有足夠扎實證據可以當成決策級指標。唔過,工程上嘅提醒就好明顯:每增加一個可擴充接口,就同時增加兼容性、安全審查同維護工作。
透過 Cordis 外掛架構同僅追加 Session Log,開發者可以更深入控制模型點樣推理、點樣用工具、點樣保存狀態,以及出錯後點樣檢查同重現。
對研究人員、基礎設施團隊同需要自訂 Agent 系統嘅開發者來講,呢種可組合性有實際價值。但對只係想要一個穩定編程助手、唔想處理大量基礎設施嘅團隊,Harness 未必係最省事嘅選擇。
短期內,Harness 更可能成為 Claude Code 同 Codex 以外嘅開放式替代方案,而唔係即時取代佢哋。佢日後能否變成長期平台,關鍵會落喺 API 穩定性、外掛質素、安全邊界、文件完整度,以及開發者最終要為呢份自由度承擔幾多營運複雜性。