2026年6月2日,美國總統川普簽署了一項名為「促進先進人工智慧創新與安全」的行政命令,要求聯邦機構與頂尖AI開發商達成自願性協議,對其最先進的模型進行發布前的網路安全評估。該框架明確禁止強制性許可或設立任何新的監管機構。
此命令並未建立新的監管機關,而是指示財政部、國防部、商務部和國土安全部等部門與AI開發商取得協議,進行模型測試。選擇加入此自願性框架的開發商,應規畫30天的發布前政府存取窗口。
在2026年8月4日於白宮與AI開發商舉行的會議中,川普顧問確認,開源權重模型——即核心組件公開、允許使用者下載、修改並在自己的基礎設施上運行的AI系統——將無需接受自願性安全測試。白宮同時告知企業,中國的開源權重模型也將豁免於此框架下的政府測試。
根據五位熟悉討論內容的消息人士指出,Meta、Anthropic、Google、Nvidia和OpenAI的代表均出席了此次會議。此次會議是在OpenAI和Anthropic披露其AI工具曾入侵其他公司系統之後舉行的,此事件引發了美國立法者對日益強大的AI模型可能被用於執行或促成網路攻擊的擔憂。
最終定案的測試重點在於衡量前沿AI模型的駭客與網路安全能力,而非更廣泛的安全性或偏見評估。何謂「涵蓋的前沿模型」的指定門檻,將透過國家安全局(NSA)的機密程序設定,這使開發商對界線何在幾乎毫無能見度。
批評者認為,豁免開源權重模型將造成重大的安全盲點。開源權重模型可以被自由下載、修改並被惡意行為者武器化,而且缺乏專有實驗室在其封閉系統中內建的安全護欄。Anthropic執行長Dario Amodei主張,開源權重模型更難確保安全,因為一旦發布,開發商便失去對模型使用方式的控制。
由於此框架僅審查美國實驗室(如OpenAI和Anthropic)的領先專有模型,而對包括中國模型在內的開源權重模型不予觸及,一些人擔心美國前沿實驗室將在與海外開源競爭對手的較量中處於監管劣勢。
由NSA機密程序設定指定門檻的做法,意味著開發商對於模型是否會受到審查幾乎毫無能見度,為哪些模型最終可能面臨 scrutiny 帶來了不確定性。
OpenAI和Anthropic持續向政策制定者警告強大開源權重模型的風險,為對開源系統加強 scrutiny 鋪路。批評者(包括川普政府顧問David Sacks)表示,這些實驗室是出於商業私利行事,而這類 scrutiny 可能構成「監管俘獲」(regulatory capture):原意為提升AI安全的規則,反而可能透過增加競爭者發布模型的難度,來鞏固最大型公司的地位。
Meta和Nvidia直接受惠於此項豁免,其Llama和Nemotron模型得以置身測試框架之外。
近200家企業(包括Proton和Y-Combinator)呼籲政府不要限制對中國開源權重AI模型的存取,認為此舉可能扼殺美國新創公司的下一代發展。新成立的小科技聯盟(Little Tech Association)已致函川普總統和商務部長Howard Lutnick提出此訴求。
《紐約時報》形容,政府此舉造成了搖擺不定的現象:先是撤回拜登時代的AI安全命令,然後推出自願性框架,接著又豁免開源權重模型——讓業界不確定究竟會適用哪些規範。拜登政府前新興技術顧問Saif Khan稱,白宮的新做法「不透明,幾乎是憑感覺」,對AI產業的潛在傷害可能比傳統監管更大。