OpenAI与Ironclad将复杂的合同相关工作流程转化为研究任务,用于训练和评估AI代理。 目前公开信息说明了研究目标,但没有提供任务设置、评分方法或模型表现等足够细节,不能据此认定AI已能独立处理合同工作。
发布者使用 GPT-6 Luna 编辑图片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What is OpenAI’s Oct. 6 partnership with Ironclad to train and test AI agents on complex contracting workflows, how were the 11 tasks select. Article summary: OpenAI announced on October 6, 2026, that it is working with Ironclad to train and evaluate agents on complex contracting work: understanding business rules, carrying out multi-step workflows, and checking the result aga. Topic tags: general, documentation, general web, academic. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, chart
OpenAI在2026年10月6日公布了与合同管理软件公司Ironclad的研究合作,重点是探索AI代理能否处理复杂的专业工作流程。双方希望训练和评估模型,使其能够理解企业业务规则、执行多个步骤,并检查结果是否符合最初要求。现有公告确认了研究方向,但没有披露足以核实具体基准测试数字的细节。3
OpenAI表示,公司正与少数熟悉相关工作流程的软件企业合作,共同找出有挑战性、价值较高的任务,再将这些任务转化为模型训练和评估中的研究问题。与Ironclad的合作聚焦合同工作,以及AI在专业软件中的电脑操作能力。3
这更像是在真实业务流程的背景下研究AI代理的能力,而不是证明AI已经可以在无人监督的情况下安全地处理合同。公告提出的目标——遵循业务规则、完成多步骤操作、按要求核验结果——也说明了为什么代理的最终产出仍需结合具体业务情境进行检查。3
现有资料没有说明任务集的数量及筛选方式、任务如何模拟或评分,也没有交代这些结果如何用于GPT-6 Astra训练。同样,资料并未证实不同模型的具体得分,或每次尝试预计耗时。因此,不能仅凭这份公告摘要,就把相关数字当作已确认的结果。3
如果缺少评估方法,单看一个分数也难以判断其含义:需要知道什么算完成任务、测试如何进行,以及结果能在多大程度上代表真实合同流程。合作的研究目标是明确的;若要比较模型表现,则需要有材料支持具体的比较结论。
OpenAI还介绍了一项Ironclad Contracts集成:用户可以用日常语言,让ChatGPT搜索合同库和工作流程;搜索结果会按照每位用户的权限范围提供。这是已描述的产品功能,与此次AI代理训练研究的成效并非一回事。
目前最稳妥的结论是,OpenAI和Ironclad正在探索如何针对复杂合同流程测试AI代理。公告展示了研究方向,但现有证据不足以评估任务层面的表现,也不足以证明自主处理合同已适合实际部署。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
OpenAI与Ironclad将复杂的合同相关工作流程转化为研究任务,用于训练和评估AI代理。
OpenAI与Ironclad将复杂的合同相关工作流程转化为研究任务,用于训练和评估AI代理。 目前公开信息说明了研究目标,但没有提供任务设置、评分方法或模型表现等足够细节,不能据此认定AI已能独立处理合同工作。
OpenAI与Ironclad将复杂的合同相关工作流程转化为研究任务,用于训练和评估AI代理。 目前公开信息说明了研究目标,但没有提供任务设置、评分方法或模型表现等足够细节,不能据此认定AI已能独立处理合同工作。
发布者使用 GPT-6 Luna 编辑图片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What is OpenAI’s Oct. 6 partnership with Ironclad to train and test AI agents on complex contracting workflows, how were the 11 tasks select. Article summary: OpenAI announced on October 6, 2026, that it is working with Ironclad to train and evaluate agents on complex contracting work: understanding business rules, carrying out multi-step workflows, and checking the result aga. Topic tags: general, documentation, general web, academic. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, chart
OpenAI在2026年10月6日公布了与合同管理软件公司Ironclad的研究合作,重点是探索AI代理能否处理复杂的专业工作流程。双方希望训练和评估模型,使其能够理解企业业务规则、执行多个步骤,并检查结果是否符合最初要求。现有公告确认了研究方向,但没有披露足以核实具体基准测试数字的细节。3
OpenAI表示,公司正与少数熟悉相关工作流程的软件企业合作,共同找出有挑战性、价值较高的任务,再将这些任务转化为模型训练和评估中的研究问题。与Ironclad的合作聚焦合同工作,以及AI在专业软件中的电脑操作能力。3
这更像是在真实业务流程的背景下研究AI代理的能力,而不是证明AI已经可以在无人监督的情况下安全地处理合同。公告提出的目标——遵循业务规则、完成多步骤操作、按要求核验结果——也说明了为什么代理的最终产出仍需结合具体业务情境进行检查。3
现有资料没有说明任务集的数量及筛选方式、任务如何模拟或评分,也没有交代这些结果如何用于GPT-6 Astra训练。同样,资料并未证实不同模型的具体得分,或每次尝试预计耗时。因此,不能仅凭这份公告摘要,就把相关数字当作已确认的结果。3
如果缺少评估方法,单看一个分数也难以判断其含义:需要知道什么算完成任务、测试如何进行,以及结果能在多大程度上代表真实合同流程。合作的研究目标是明确的;若要比较模型表现,则需要有材料支持具体的比较结论。
OpenAI还介绍了一项Ironclad Contracts集成:用户可以用日常语言,让ChatGPT搜索合同库和工作流程;搜索结果会按照每位用户的权限范围提供。这是已描述的产品功能,与此次AI代理训练研究的成效并非一回事。
目前最稳妥的结论是,OpenAI和Ironclad正在探索如何针对复杂合同流程测试AI代理。公告展示了研究方向,但现有证据不足以评估任务层面的表现,也不足以证明自主处理合同已适合实际部署。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
OpenAI与Ironclad将复杂的合同相关工作流程转化为研究任务,用于训练和评估AI代理。
OpenAI与Ironclad将复杂的合同相关工作流程转化为研究任务,用于训练和评估AI代理。 目前公开信息说明了研究目标,但没有提供任务设置、评分方法或模型表现等足够细节,不能据此认定AI已能独立处理合同工作。