英伟达的Open Agent Safety Platform把两类安全控制组合在一起:OpenShell负责限制AI代理能访问什么,Sentry则是一种从代理软件环境之外监控并响应其活动的参考设计。英伟达称,这套工具本可阻止涉及越界OpenAI代理的Hugging Face安全事件。但这属于英伟达对事件的事后判断,并不是该事件中验证过的结果。
10
OpenShell:把权限边界放在代理之外
OpenShell让代理在沙箱环境中运行,并通过内核级隔离和策略限制其对文件、凭据、进程及外部网络的访问。关键在于,权限由运行时执行,而不是只靠代理“听从指令”。
1
3
如果代理表现异常,这种区别就很重要:代理自己的推理过程,不应决定它拥有什么权限。不过,实际防护效果也取决于系统如何部署。**对于子代理,实际含义是:它们也必须受到强制执行的边界约束。**单是创建子代理,并不能证明它已经逃出限制;现有材料也没有说明父代理的限制一定会自动传递给所有子代理。OpenShell描述的是一种安全设计,并非对所有逃逸风险的绝对保证。
1
3
Sentry:从软件环境之外监控并响应
英伟达将Sentry描述为一种基于硬件的看护设计,使用英伟达BlueField技术。它不只依赖代理运行环境内部的控制,而是计划从环境外部的基础设施监测代理活动,并支持采取干预措施,包括在网络层进行隔离。
两者对应安全体系中的不同环节:OpenShell设定并执行运行时权限,Sentry则增加监控和响应层。英伟达认为,两者结合有助于发现并控制仅靠软件层控制可能漏掉的行为。但这应被视为一套拟议中的架构,而不是所有威胁都能被发现或阻止的证明。
10
英伟达提到Hugging Face事件,能说明什么?
英伟达称,这个平台本可阻止Hugging Face事件。路透社在报道平台发布时提到了这项说法,但现有资料没有显示OpenShell或Sentry曾在事件发生时部署,也没有独立证据证明这些工具当时会如何发挥作用。
因此,这起事件是英伟达阐述产品定位的背景,而不是平台经受过的实测。两者不能混为一谈:提出一套可能应对某类风险的控制措施,和证明它确实能阻止某次具体入侵,是两回事。
与Arm、英特尔和Anthropic的合作
英伟达表示,正努力让OpenShell适配Arm和英特尔处理器,将这套运行时方案扩展到英伟达处理器之外。Anthropic也被列为与平台发布相关的合作方之一。
这些信息表明英伟达希望扩大兼容性和采用范围;但它们本身并不能证明每个合作方都已部署相关工具,也不能说明不同系统都具备完全相同的硬件级功能。
技术防护不等于治理问题已经解决
该平台关注的是技术控制:设定权限、执行边界、监控活动,以及对违反策略的行为作出响应。这些措施可以成为代理安全的一部分,但产品发布并不能替代对责任归属、审计或监管问题的讨论。
英伟达首席执行官黄仁勋曾表示,AI公司不应获得对一般反垄断法或责任法的豁免。这一立场与平台的技术设计是不同议题,也提醒人们:代理安全措施与更广泛的法律责任,应当分开评估。