美國眾議員羅·卡納要求OpenAI、Anthropic、Google、Meta與xAI交代兩件事:是否知道有中國或其他敵對勢力試圖非法取得其AI模型權重,以及公司用哪些資安措施保護這些核心技術。這不只是追問公司有沒有遭駭,更是在問:當先進AI被視為國家安全議題時,企業是否應交代如何防止模型落入不受控制的勢力手中。
3
模型權重遭竊,不等於模型被「蒸餾」
模型權重是AI模型在訓練過程中形成的內部參數,決定模型如何運作。若有人竊得權重,就取得了原模型的核心組成;相較之下,蒸餾是透過查詢既有模型、利用它產生的答案或其他輸出,訓練另一個模型。後者可能讓競爭者打造出功能相似的系統,但不代表取得原模型的權重。
3
OpenAI與Anthropic曾通報中國AI公司蒸餾其模型;但目前報導所列的模型權重遭竊案例不多。因此,蒸餾的相關報導不能直接當成這些公司的權重已遭竊的證據。
3
為何權重安全牽涉國安
卡納關切的是另一種風險:若敵對行為者真的取得模型權重,就可能不必只透過開發公司的服務使用模型,而是直接掌握模型本身。這使得「誰能取得權重、公司如何保護權重」成為資安與國家安全問題。卡納此前也曾把透過查詢模型取得輸出的蒸餾,與保護模型權重的問題分開討論。
5
不過,現有公開資料並未證實中國已成功竊取題目所列任何一家公司的模型權重。
3
自願承諾,還是更強的政府監督?
政策分歧在於,安全措施是否應主要由業界自願採行。川普政府與主要AI公司推動自願性安全承諾,包括內部控管與外部稽核;政府也表示,在一項自願測試安排下,不會對開放權重模型進行安全測試。
9
卡納則主張提高政府監督力度,包括要求AI公司在發布模型前接受稽核,並推動具約束力、可驗證的美中AI安全協議。他要求公司說明已知入侵嘗試與防護措施,反映出他的核心疑問:只靠企業自行承諾,是否足以保護重要模型?
5
至於各家公司實際採取了哪些防護措施,以及是否發生尚未公開的入侵嘗試,現有資料並未提供確切答案。