2026年6月2日,特朗普总统签署了一项名为“促进先进人工智能创新与安全”的行政令,要求联邦机构与顶级AI开发商达成自愿协议,对其最先进模型进行发布前的网络安全评估。该框架明确禁止任何强制性许可或设立新的监管机构。
行政令并未建立新的监管机构,而是指示财政部、国防部、商务部和国土安全部与AI开发商就模型测试达成协议。选择加入自愿框架的开发商需要为30天的发布前政府访问窗口做好准备。
在2026年8月4日与AI开发商的白宫会议上,特朗普顾问确认,开源权重模型——那些核心组件可公开访问、允许用户在自己的基础设施上下载、修改和运行的AI系统——将不会被纳入自愿安全测试。白宫还告知企业,该框架下中国的开源权重模型也将免于政府测试。
据五位知情人士透露,Meta、Anthropic、Google、英伟达和OpenAI的代表出席了会议。此次会议召开之际,OpenAI和Anthropic披露其AI工具曾侵入其他公司的系统,引发立法者担忧功能日益强大的AI模型可能被用于实施或协助网络攻击。
最终确定的测试聚焦于衡量前沿AI模型的黑客和网络安全能力,而非更广泛的安全或偏见评估。界定何为“受覆盖前沿模型”的门槛将通过国家安全局(NSA)的机密流程设定,这使得开发商几乎无法了解界限所在。
批评者认为,豁免开源权重模型造成了重大的安全盲区。开源权重模型可以被自由下载、修改并被不法分子武器化,而且它们缺乏专有实验室在其封闭系统中构建的防护栏。Anthropic CEO Dario Amodei曾辩称,开源权重模型更难以保持安全,因为一旦发布,开发者就失去了对模型使用方式的控制。
由于该框架仅审查OpenAI和Anthropic等美国实验室的领先专有模型,而对包括中国模型在内的开源权重模型不予理睬,一些人担心美国前沿实验室将面临相对于海外开源竞争对手的监管劣势。
通过国家安全局机密流程设定界定门槛,意味着开发商几乎无法了解受覆盖与未受覆盖模型之间的界限,从而为哪些模型最终可能面临审查带来了不确定性。
OpenAI和Anthropic一直在向政策制定者警告强大开源权重模型的风险,他们主张对开源系统进行更严格的审查。包括特朗普顾问David Sacks在内的批评者称,这些实验室是出于商业私利行事,这种审查可能构成“监管俘获”——旨在提高AI安全性的规则反而可能通过提高竞争对手发布模型的难度,来巩固最大公司的地位。
Meta和英伟达直接从该豁免中受益,因为它们的Llama和Nemotron模型仍处于测试框架之外。
包括Proton和Y-Combinator在内的近200家公司敦促政府不要限制对中国开源权重AI模型的访问,认为这样做可能扼杀美国下一代初创企业。新成立的“小科技协会”向特朗普总统和商务部长Howard Lutnick发出了这一呼吁。
《纽约时报》形容政府的做法引发了“过山车效应”——先是撤销拜登时代的AI安全指令,然后推出自愿框架,接着又豁免开源权重模型——让整个行业不确定究竟适用什么规则。拜登政府前新兴技术顾问Saif Khan称白宫的新做法“不透明,几乎凭感觉”,可能比传统监管对AI行业更具破坏性。