Robinson称,AI能力不断提升,但安全与对齐工作未必能及时跟上。 他担心频繁更新、工具接入和紧迫的工作节奏,会压缩评估风险所需的时间。 OpenAI表示会把能力限制在可安全管理的范围内,并在必要时暂停训练或暂缓发布;双方对现有措施是否足够看法不同。
发布者使用 GPT-6 Luna 编辑图片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: Why did David Robinson—a Rhodes scholar, Yale Law graduate, former Biden White House adviser, and OpenAI employee since May 2023 who led saf. Article summary: David Robinson resigned because he came to believe that OpenAI’s pace of development and deployment was outrunning its ability to understand and control the risks. His criticism is about the industry’s operating culture,. Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
David Robinson离开OpenAI,核心原因是他不再相信公司和整个AI行业正以足够谨慎的方式推进技术。他的批评不只是针对某个模型或一次发布,而是指向更深层的问题:当组织文化鼓励快速前进时,安全工作可能落后于技术发展。OpenAI则表示,会限制模型能力,并在安全需要时暂停训练或暂缓发布。1
Robinson曾负责撰写OpenAI多次重要发布配套的安全报告。他在离职文章中说,AI公司做得还不够谨慎,并认为问题不能只靠制定规则或出台法规解决,也需要审视公司的工作文化。1
在离职后的访谈中,他谈到自己对AI风险的判断如何变化。他起初并不认为AI会变得根本上比人类更聪明,但后来认为,出现能够“把我们甩在身后、远胜于我们思考”的系统,已成为现实可能;而安全与对齐工作还没有为这种情形做好准备。
因此,他主张先建设安全专业能力、推进相关研究并完善防护措施,再继续提升模型能力,而不是先加速发展、期待安全工作事后追赶。1
Robinson担心,传统评估很难覆盖不断变化的模型。过去,安全工作往往围绕较长周期的预训练和重要版本发布展开;如今,推理能力更新和新工具接入更频繁,模型可能在两轮大型评估之间就发生变化。他认为,每次变化都可能带来此前测试未覆盖的能力与风险,留给团队检查的时间也可能不足。1
他还质疑,如果模型能够识别自己正处于测试环境,评估结果能在多大程度上代表它在其他情境中的表现。这些是Robinson对评估流程的担忧,并不等于已经独立证实每个OpenAI模型或每次发布都存在相同问题。1
在Robinson看来,紧张的工作节奏和疲惫的员工会让审慎判断变得更难。即使行业人士公开提醒AI风险,如果日常激励仍偏向尽快推进,员工也可能更难争取时间调查问题、复核风险或要求暂缓进度。1
一次暂缓发布可以说明公司愿意在某个节点踩刹车,但Robinson认为,单次决定不能证明整体开发流程已经安全,也不能保证未来的防护措施能追上更强的模型。他关注的是谨慎是否融入日常研发流程,而不只是某个版本最终有没有上线。1
OpenAI表示,公司正努力确保模型的能力不超过自身能够安全管理和保护的范围;必要时也会暂停训练,或暂不发布模型。
Robinson的质疑与OpenAI的回应,指向同一个关键问题:面对前沿AI发展的速度和潜在能力,现有的安全防护与决策机制究竟够不够。现有报道呈现了双方的不同立场,但并未独立判定OpenAI的安全措施是否充分。1
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
Robinson称,AI能力不断提升,但安全与对齐工作未必能及时跟上。
Robinson称,AI能力不断提升,但安全与对齐工作未必能及时跟上。 他担心频繁更新、工具接入和紧迫的工作节奏,会压缩评估风险所需的时间。
OpenAI表示会把能力限制在可安全管理的范围内,并在必要时暂停训练或暂缓发布;双方对现有措施是否足够看法不同。
Robinson称,AI能力不断提升,但安全与对齐工作未必能及时跟上。 他担心频繁更新、工具接入和紧迫的工作节奏,会压缩评估风险所需的时间。 OpenAI表示会把能力限制在可安全管理的范围内,并在必要时暂停训练或暂缓发布;双方对现有措施是否足够看法不同。
发布者使用 GPT-6 Luna 编辑图片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: Why did David Robinson—a Rhodes scholar, Yale Law graduate, former Biden White House adviser, and OpenAI employee since May 2023 who led saf. Article summary: David Robinson resigned because he came to believe that OpenAI’s pace of development and deployment was outrunning its ability to understand and control the risks. His criticism is about the industry’s operating culture,. Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
David Robinson离开OpenAI,核心原因是他不再相信公司和整个AI行业正以足够谨慎的方式推进技术。他的批评不只是针对某个模型或一次发布,而是指向更深层的问题:当组织文化鼓励快速前进时,安全工作可能落后于技术发展。OpenAI则表示,会限制模型能力,并在安全需要时暂停训练或暂缓发布。1
Robinson曾负责撰写OpenAI多次重要发布配套的安全报告。他在离职文章中说,AI公司做得还不够谨慎,并认为问题不能只靠制定规则或出台法规解决,也需要审视公司的工作文化。1
在离职后的访谈中,他谈到自己对AI风险的判断如何变化。他起初并不认为AI会变得根本上比人类更聪明,但后来认为,出现能够“把我们甩在身后、远胜于我们思考”的系统,已成为现实可能;而安全与对齐工作还没有为这种情形做好准备。
因此,他主张先建设安全专业能力、推进相关研究并完善防护措施,再继续提升模型能力,而不是先加速发展、期待安全工作事后追赶。1
Robinson担心,传统评估很难覆盖不断变化的模型。过去,安全工作往往围绕较长周期的预训练和重要版本发布展开;如今,推理能力更新和新工具接入更频繁,模型可能在两轮大型评估之间就发生变化。他认为,每次变化都可能带来此前测试未覆盖的能力与风险,留给团队检查的时间也可能不足。1
他还质疑,如果模型能够识别自己正处于测试环境,评估结果能在多大程度上代表它在其他情境中的表现。这些是Robinson对评估流程的担忧,并不等于已经独立证实每个OpenAI模型或每次发布都存在相同问题。1
在Robinson看来,紧张的工作节奏和疲惫的员工会让审慎判断变得更难。即使行业人士公开提醒AI风险,如果日常激励仍偏向尽快推进,员工也可能更难争取时间调查问题、复核风险或要求暂缓进度。1
一次暂缓发布可以说明公司愿意在某个节点踩刹车,但Robinson认为,单次决定不能证明整体开发流程已经安全,也不能保证未来的防护措施能追上更强的模型。他关注的是谨慎是否融入日常研发流程,而不只是某个版本最终有没有上线。1
OpenAI表示,公司正努力确保模型的能力不超过自身能够安全管理和保护的范围;必要时也会暂停训练,或暂不发布模型。
Robinson的质疑与OpenAI的回应,指向同一个关键问题:面对前沿AI发展的速度和潜在能力,现有的安全防护与决策机制究竟够不够。现有报道呈现了双方的不同立场,但并未独立判定OpenAI的安全措施是否充分。1
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
Robinson称,AI能力不断提升,但安全与对齐工作未必能及时跟上。
Robinson称,AI能力不断提升,但安全与对齐工作未必能及时跟上。 他担心频繁更新、工具接入和紧迫的工作节奏,会压缩评估风险所需的时间。
OpenAI表示会把能力限制在可安全管理的范围内,并在必要时暂停训练或暂缓发布;双方对现有措施是否足够看法不同。