根據報導,亞馬遜的研究人員針對Anthropic新發表的Fable 5模型,下了一連串精心設計的提示詞,並成功讓模型吐出可用於輔助網路攻擊的資訊——而這些資訊,本該是模型安全護欄嚴格禁止提供的內容。這並非表面的小故障;消息來源將其定性為一個真正的安全繞過手法,揭露了模型潛在的危險能力。
賈西決定將這些疑慮直接帶到政府最高層,為一場戲劇性的聯邦干預行動搭好了舞台。作為Anthropic的投資人,亞馬遜此舉一方面被視為負責任的紅隊演練(一種透過模擬攻擊來測試系統安全性的方法),另一方面也被外界解讀為這個既力挺合作夥伴、又與之激烈競爭的科技巨頭,所使出的一記複雜、甚至帶點競爭意味的險棋。
賈西的對話不僅點燃了一場審查,更直接催化了一次快如閃電的出口管制行動。川普政府判定,Anthropic的模型已構成足夠的國家安全風險,必須立即祭出出口限制。就在6月12日週五晚間,商務部長霍華德·盧特尼克(Howard Lutnick)致函Anthropic執行長達里奧·阿莫迪(Dario Amodei),正式將Fable 5與Mythos 5置於出口管制之下。
這項指令的範圍極為廣泛。它暫停了所有外國公民對這些模型的存取權限,無論其人身在美國境內或境外——這個定義甚至涵蓋了Anthropic自己的外籍員工。此舉將Anthropic推入了一個不可能的處境。
由於Anthropic無法在即時環境中可靠地區分使用者是外國人或本國人,以遵守這項限縮的法律命令,該公司做出了一個斷然的決定。為了確保完全合規,美東時間下午5點21分整,他們突然在全球範圍內對「所有使用者」關閉了Fable 5與Mythos 5的存取權。這兩個在6月9日才剛風光發表、僅上線短短72小時的模型,瞬間在全世界熄燈。
禁令頒布後,隨之而來的是一場針對威脅嚴重性與政府反應是否過當的激烈公開論戰。
亞馬遜並未公開否認《華爾街日報》的報導。儘管該公司未就賈西的對話發表任何正式聲明,但消息來源所引述的立場是,亞馬遜是在進行內部安全研究時發現了真正的漏洞,而向官員示警是負責任的行為。這個說法將亞馬遜塑造成善意的安全研究員,然而其作為Anthropic主要投資人的角色,仍為這起事件的觀感增添了一層複雜性。
Anthropic旋即對政府行動的實質內容與規模,提出了強烈質疑。在一份公開聲明中,該公司確認收到了這項指令,但將其稱為一場「誤會」。Anthropic坦承審查了特定的越獄技術,但將調查結果定性為極度輕微。該公司表示,這個方法只找出了「少數幾個已知的、輕微的漏洞」,並主張其他公開可用的模型,包括OpenAI的GPT-5.5,也具備找出類似漏洞的能力。
Anthropic對這項開創先例的行動進行了強力反擊,聲明寫道:「我們不同意,發現一個狹隘的潛在越獄手法,就構成召回一個部署給數億人使用的商業模型的正當理由。」
然而,政府的說法卻是截然不同的面貌。曾任白宮AI與加密貨幣沙皇(AI and crypto czar,指在該領域擁有跨部門協調權力的高階顧問)、現任總統科學技術顧問委員會聯合主席的大衛·薩克斯(David Sacks),提供了一份詳盡的公開說明,將矛頭直接指向Anthropic的高層。
薩克斯發文指出,一個「同時受Anthropic與美國政府高度信任的合作夥伴」——外界普遍認為就是亞馬遜——發現了一種越獄手法,能剝去Fable 5的安全護欄,讓底層Mythos模型的完整、且更危險的能力暴露在外。根據薩克斯的說法,政府隨後向Anthropic執行長阿莫迪給出了一個明確的選擇:要嘛修復漏洞,要嘛將模型下架。
薩克斯聲稱,阿莫迪拒絕了這兩個選項。「政府要求達里奧修復越獄漏洞或將模型下架。達里奧拒絕了,」薩克斯表示,並補充說明這項出口管制是必要且「迫不得已」的手段,目的是管控一個該公司不願處理的風險。薩克斯更進一步指控Anthropic行事不誠懇,批評該公司先前大肆宣揚Mythos是需要監管的網路安全超級武器,現在當同樣的能力被證明有外洩風險時,卻又對疑慮嗤之以鼻。
這場羅生門——一方是自稱因政府對微小漏洞反應過度而受害的公司,另一方則是頂級官員指控其拒絕修復一個真正的武器級風險——定義了迄今為止最重大的AI政策攤牌。白宮方面則堅稱,這是一項臨時措施,只要Anthropic修復了安全漏洞,禁令即可解除。