DeepSeek-V4-Pro-0813 于 2026 年 8 月 12 日至 13 日期间转为正式版 (GA),取代了 deepseek-v4-pro API 端点背后的预览版本 。它是一个总参数 1.6 万亿的混合专家模型(每个 token 活跃参数 490 亿),拥有 100 万 token 的上下文窗口,最高支持 384K 输出 token
。0813 版本带来了增强的智能体能力和原生 OpenAI Responses API 兼容性
。V4 Pro 的开放权重同样采用 MIT 许可
。
DeepSeek 在 2026 年 5 月就开始组建专门的 Harness 团队,内部对标 Claude Code 和 Codex 。团队发布了两个位于北京的职位:Harness 产品经理和 Harness 研发工程师
。该团队的使命是构建“Code Harness”(内部有时也称为“DeepSeek Code”),作为一个桌面端智能体产品,将 DeepSeek 的模型能力与完整的智能体体验连接起来
。
自 2026 年 8 月 16 日起,DeepSeek 为 V4 Pro API 引入了高峰/非高峰定价层级 。输出价格从预览期的每百万 token 0.87 美元上涨至非高峰 1.98 美元和高峰 3.96 美元——涨幅达到 2.3 倍至 4.6 倍
。这一举措逆转了此前的降价趋势,并造成了一种战略上的张力:智能体框架(Harness)变得更加开放(MIT 许可、完全模块化、可自托管),而托管 API 却变得相当昂贵,尤其在高峰时段
。
竞争对手(Anthropic 的 Claude Code、OpenAI 的 Codex CLI)提供托管式、垂直整合的智能体体验,其模型、工具、沙箱和运行时紧密耦合且为专有 。DeepSeek 的策略则截然相反:以 MIT 许可开源整个智能体框架,让开发者可以替换任何模型适配器、任何沙箱、任何 UI——同时以溢价对托管推理服务进行收费
。认为 API 过于昂贵的开发者可以自托管开源的 V4 Pro 权重,并通过 Harness 在本地运行
。
简而言之: 2026 年 8 月 13 日是 DeepSeek 迄今最具影响力的发布日——开源其智能体基础设施以与 Claude Code/Codex 竞争、让 1.6 万亿参数旗舰模型转为正式版,同时将托管 API 价格提高 2-4 倍,形成了一个清晰的“开放框架,提高门槛”的策略。