Ro Khanna要求OpenAI、Anthropic、Google、Meta及xAI披露已知的非法存取企圖,並說明保護模型權重的網絡安全措施,重點是要了解:這些公司能否守住最重要的AI資產,以及防護是否足夠。他關注的並非只有競爭對手會否仿效模型表現,而是對方能否直接拿到模型本身。
3
10
偷模型權重,和「蒸餾」有甚麼分別?
模型權重是模型經訓練後形成的一組核心參數。若有人非法取得權重,拿到的是模型本身的關鍵組成部分,而不只是使用服務時得到的回答。權重一旦外流,原開發者便較難控制它之後如何被使用;這也是開放權重模型較難設限和監察的一個原因。
16
蒸餾則是向現有模型取得輸出,再用這些答案訓練另一個模型。OpenAI和Anthropic曾披露中國公司涉及蒸餾;這可能涉及未經授權地利用其模型輸出,但本身不代表對方取得了原模型的權重。
10
目前報道指已知的模型權重失竊個案不多;現有資料亦未證實題目所列任何公司的權重已被中國成功竊取。因此,蒸餾的報告不能當作權重已遭竊取的證據。
10
為何牽涉國家安全?
若敵對行為者取得強大模型的權重,便可能在原開發者服務以外直接運行模型,令開發者較難監察或施加使用限制。Anthropic亦指出,模型權重一旦公開,便難以收回,而且更難套用防護措施或追蹤使用情況。
16 Khanna把保護權重與蒸餾分開追問,正是要釐清兩種不同的風險,而不是把仿效模型等同入侵成功。
5
自願守則,還是政府監管?
特朗普政府推動的方向較倚重業界自願承諾;白宮與多家科技公司公布的安全安排包括內部控制及外部審核,但屬自願框架。
9 美國政府亦表示,在一項自願測試安排下,不會對開放權重模型進行安全測試。
Khanna則主張政府角色更積極,包括要求AI公司在發布前審核模型,並推動有約束力、可核實的美中AI安全協議及監察安排。
2
5 他要求企業交代保安措施,反映他不認為單靠公司自行承諾便足以回答關鍵問題。
至於各公司實際採用甚麼防護措施,或是否有未公開的入侵企圖,現有資料並未交代。