英國據報未能在 Anthropic 的 Claude Mythos 5.1 發布前取得模型作測試,重點未必是英國技術人手不足,而是「有冇得入場」。當一個國家的評估機構最終仍要靠開發商點頭,便難以保證可及時、獨立地檢視前沿模型。
歐盟網絡安全局 ENISA(European Union Agency for Cybersecurity)獲准測試 Anthropic 的 Mythos 5 和 OpenAI 的 GPT-6 Astra,當然是重要進展;但這不代表歐盟已取得長期、通用的權利,可測試每一個後繼版本,更不代表 ENISA 曾取得 Mythos 5.1 的存取權。
9
20
先搞清楚:存取權是逐個模型計
歐盟委員會發言人表示,ENISA 已獲准使用 Mythos 5 及 GPT-6 Astra 作測試。
9 另一邊廂,有報道指 Anthropic 沒有在 Mythos 5.1 推出前,向英國 AI Security Institute 提供該模型測試;這是首宗據報 Anthropic 未有讓該英國機構在重大模型發布前參與測試的情況。
20
23
這不宜簡化成「歐盟贏、英國輸」。ENISA 的安排針對兩個已點名的模型,並是在特定條件下達成;Mythos 5.1 是另一個版本,亦屬更嚴格受限的個案。實際上,安全評估正按模型版本、能力、用途、司法管轄區,以及開發商的伙伴篩選準則而分層。
為何 Mythos 5.1 特別敏感?
Anthropic 表示,Claude Fable 5.1 與 Claude Mythos 5.1 的底層模型相同,但安全防護程度不同。Fable 5.1 一般可用;Mythos 5.1 則只透過「可信存取計劃」提供,所採用的防護設計是為支援網絡安全及生命科學工作而設。
12
因此,這已不只是一般產品測試。一個面向敏感網絡安全或科學工作的系統,會牽涉受控運行環境、濫用監察、人員審核,以及國家安全層面的資訊處理。報道指,Mythos 5.1 初期只向經審核的美國機構開放。
18
24
現有資料未能證明 Anthropic 是因為不信任英國或英國 AI Security Institute,才不提供存取權。受限計劃本身的設計、操作安全考慮,以及公司對存取權的商業控制,都是合理解釋。不過結果仍然值得注意:即使已有合作關係、評估機構亦具聲譽,都未必能保證及時接觸高風險模型。
ENISA 的存取權,反映歐盟有甚麼籌碼?
歐盟比單靠自願合作的制度,有較強的法律基礎。根據歐盟《AI Act》第 55 條,具系統性風險的通用 AI 模型供應商,必須按標準化協議及工具進行模型評估、評估及減低系統性風險、追蹤和申報嚴重事故,並維持適當的網絡安全保護。
43
37
該法例亦設想模型首次投放市場前應進行評估,包括記錄在案的對抗測試;視乎情況,可由內部或獨立外部進行。
35
34
不過,這些是加諸供應商身上的責任,並不等於 ENISA 有一張「通行證」,可取得模型權重、無限制系統使用權,或在每次發布前接觸所有前沿模型。ENISA 今次的測試安排之所以重要,正是因為看來是透過與公司接觸協商,加上歐盟較整體的監管地位而取得。
4
9
換言之,法規可以提升歐盟要求證據、風險管理和合規的能力;但要測試具敏感網絡安全、生物或自主代理能力的模型,仍需要安全而實際的合作安排。
英國為何更容易處於被動?
Mythos 5.1 事件把自願存取的弱點攤開來看。相關報道指出,在 Anthropic 未向英國 AI Security Institute 提供最新模型後,外界要求賦予該機構更強法定地位和權力。
23
自願模式在實驗室願意合作時可以運作良好,亦可能比僵硬規則更快、更有技術彈性;但其問題是可預測性不足。開發商可以限制存取、改變合資格伙伴的範圍,或判定某個模型只應放進更嚴格的國家安全渠道。
對英國而言,這帶來策略風險:若評估人員只能在模型發布後才取得系統,又或要等其他政府和獲批准伙伴先完成測試,英國便可能由參與塑造安全證據的一方,變成接收其他地方產生的證據。
英國可怎樣建立較穩陣的制度?
短期政策目標不一定是強制交出模型權重。對能力極高的模型而言,這本身亦可能帶來安全和知識產權風險。較可行的方向,是建立受控、可審計的存取安排。
可考慮的措施包括:
- 指定前沿模型部署前須通知。 開發商如準備部署達到既定能力或風險門檻的模型,可被要求預先通知指定機關。
- 法定索取資料權。 英國 AI Security Institute 可獲清晰授權,索取安全個案、評估結果、事故資訊及相關技術文件。
- 安全評估環境。 以限時、受監察的 API、沙盒系統或其他受控環境提供測試,而非一律要求交出模型權重。
- 國家安全審查途徑。 對網絡安全、生命科學或自主代理能力有重大影響的模型,可啟動由網安、生物安全、情報及 AI 評估專家共同參與的審查。
- 與歐盟正式合作。 共享評估協議、建立互惠的安全測試渠道,以及對接嚴重事故處理程序,可減少重複工作,也有助英國不被排除於歐洲測試網絡之外。
這些做法針對的是今次事件揭露的核心問題:模型存取不應完全靠與個別實驗室的關係維繫,而要成為管治制度的一部分。
前沿 AI 測試或會愈來愈分級
可預期的方向,是多層式評估制度。面向廣泛市場的模型,會受供應商測試、監管文件和事故申報責任約束;更敏感的網絡安全、生物及自主代理能力,則愈來愈可能只在受限環境評估;最高風險的系統,或只會開放予少數已審核的政府、實驗室和安全伙伴。
ENISA 的安排與英國未能在 Mythos 5.1 發布前參與測試,正好說明這個分野為何重要。競爭已不只是哪一方能造出最強模型,更是誰能在模型擴大部署前,檢視、測試及管治最具影響力的版本。
9
12
20
對英國來說,技術評估能力依然重要,但單靠這一點未必夠。要維持影響力,還需要本土具可依靠的法定權力,以及與海外伙伴建立長遠、兼顧安全要求的存取安排。