OpenAI在2026年9月10日宣布,面向所有开发者推出 Agents API 公开测试版;这一消息在9月11日被广泛报道。核心变化是:原本支撑 Codex 的智能体运行与编排能力,现在以托管API的形式对外开放。
11
对开发团队而言,分工被明确划开:开发者定义任务、模型、工具和计算环境,OpenAI则负责运行智能体所需的“编排底座”(harness),包括智能体循环、会话管理、上下文处理和恢复机制。
11
不只是调用模型,而是托管智能体运行时
传统上,要把智能体真正部署到生产环境,团队往往还要自行搭建工具路由、长期会话、上下文管理、沙箱隔离、异常恢复和多智能体协作等基础设施。Agents API的定位,就是把这些共性工作交由OpenAI维护的Codex harness处理。
11
开发者仍可决定智能体运行在哪里:
- OpenAI托管的沙箱;
- 开发者自托管基础设施;
- 已接入的合作方沙箱,包括 Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop 和 Vercel。
11
换句话说,OpenAI托管的是编排层,而开发者仍掌握自身的工具、知识来源与工作负载。这样的设计也允许企业按自身基础设施和数据处理需求选择计算环境。
11
长任务、多工具与多智能体:API自动处理哪些环节?
OpenAI列出的能力主要针对智能体在生产环境中常见的难题:
- 自动上下文压缩:当会话接近模型上下文窗口上限时,系统会压缩上下文,以支持更长时间的任务执行;
- 工具搜索:仅在需要时加载相关工具的schema,避免把大量工具定义持续塞进上下文;
- 程序化工具调用:可并行执行工具调用,也可将调用串联起来;
- 多智能体模式:把彼此独立的工作拆分给并发运行、且拥有各自上下文的子智能体处理。
11
这意味着,开发者可将更多精力放在任务逻辑、业务工具和数据连接上,而不是从零搭建一套智能体调度系统。
开源基础、公开测试与价格
Agents API建立在开源Codex harness之上,开发者可以查看相关代码;不过,公开测试中提供的是由OpenAI运行与维护的托管版本。
11
OpenAI表示,Agents API已向所有开发者开放公开测试,不额外收取Agents API服务费。使用者只需为智能体实际消耗的模型Token和工具付费。公司计划在测试期间继续迭代,逐步走向正式全面可用(GA)。
11
Ciridae称评测分数提升,延迟降至四分之一
OpenAI公布了早期客户Ciridae的使用结果:其评测分数据称从 0.71 提升至 0.85;Ciridae首席技术官还表示,并发子智能体让其工作流延迟降低了4倍。
6
8
不过,这些数字属于客户报告的结果,并非独立第三方基准测试,应按案例数据而非通用性能结论看待。
6
8
同日推出ChatGPT Work的Data agent
在开发者侧开放Agents API的同时,OpenAI也为企业产品ChatGPT Work推出了 Data agent。它可通过对话分析获批的公司数据、调查指标变化、制作可分享的交互式仪表盘,并利用企业定义的指标口径与数据关系等语义上下文。
6
Data agent支持连接的来源包括:
- Amazon Redshift、Datadog、Google BigQuery、ClickHouse、Databricks、MongoDB 和 Snowflake;
- Google Drive与SharePoint中的文件和文档。
6
它还可跨商业智能和协作系统开展工作,包括 Omni、Oracle BI、Power BI、Sigma、Tableau、ThoughtSpot、Slack及电子邮件;实际可访问范围仍受管理员配置和底层数据源原有权限控制。
6
GPT‑Live‑1也进入API:支持“边听边说”的全双工语音
OpenAI同日还将 GPT‑Live‑1 开放至API。该模型主打全双工语音交互:语音智能体可以在说话时继续听取用户输入,而不是必须一方说完、另一方再开始。OpenAI公布的前端语音层价格为每分钟0.05美元。
4
12
关于Yelp整合:现有材料不足以确认具体细节
可用资料中没有足够可靠的第一方证据,能够确认与此次发布直接相关的某项Yelp具体整合,或验证其所谓通话量数据。因此,相关说法不宜在缺少Yelp或OpenAI一手材料的情况下视为已证实事实。
对智能体框架市场意味着什么?
OpenAI此次的产品定位,不只是再提供一个可供开发者拼装的智能体框架,而是提供一套托管式生产运行时:将编排、上下文管理、工具路由、持久会话、沙箱和多智能体协调等层级交给OpenAI运营。
11
这会对那些需要开发者自行组合、部署和维护上述层级的方案形成直接的实践层面竞争。不过,这是根据产品设计得出的解读,并不意味着OpenAI在公告中点名或基准测试了任何特定竞争对手。
11