沒有公開理由,就不能把推測當成定論
Anthropic並未公開說明,為何沒有向英國AI安全研究所(AI Security Institute,AISI)提供 Mythos 5.1 的發布前存取權。因此,目前無法確定這是出於國安、出口管制、商業機密、研究資格審查,或其他考量。
能較謹慎地說的是:依題述情況,AISI未能在模型發布前接觸 Mythos 5.1;相對地,部分經審核的美國機構可獲得存取。將此直接定性為美國保護主義,仍超出現有公開證據;那是英國方面可以理解的憂慮與地緣政治解讀,而不是Anthropic已確認的決策理由。
3
4
Mythos 5.1與公開版的差別是什麼?
Anthropic的發布說明將 Claude Mythos 5.1 列為提供給「Project Glasswing」參與者的模型;Claude Fable 5.1 則面向長時間代理式程式開發、知識工作與研究,可透過Claude API,以及AWS、Google Cloud與Microsoft等平台使用。兩者均提供預設100萬token上下文視窗、最高12.8萬token輸出,並啟用自適應思考功能。
16
這種產品分流的重要性在於:受限模型若涉及資安或生物研究等高風險能力,其可測試範圍與安全防護設定,可能與一般可取得版本不同。題述資料亦指出,Anthropic先前曾將類似的受限版本描述為與公開對應產品共用底層模型、但在特定高風險領域放寬防護的版本;不過,這並不能單獨證明 Mythos 5.1 必然具備相同安排。
為何AISI未能測試會引起關注?
AISI是英國政府的研究機構,任務是協助政府以實證方式理解先進AI的風險、測試領先模型,並研究及驗證風險緩解措施。
6
7 該機構已有逾100名技術人員,並表示其團隊已測試超過30個全球最先進的模型。
2
4
不過,這類發布前評估高度依賴開發商合作,而非由AISI可單方面要求取得模型。若開發商不提供受限版本,政府外部評估者便無法獨立檢驗:
- 模型在資安、生物或化學相關任務上的實際能力;
- 防護措施在對抗性測試下是否有效;
- 限定存取機制是否足以降低濫用風險。
AISI的測試涵蓋網路安全、生物與化學協助、自主行為及安全防護等領域,正是為了讓政府掌握前沿模型能力演變所可能帶來的國安與公共安全風險。
8
14
美國政府有介入嗎?目前沒有證據
現有資料不足以證明,Anthropic的決定是由美國政府下令,或是法律強制要求。較可能、但都尚未獲證實的解釋包括:對高階網路或生物能力的國安敏感性、出口管制風險、商業保密需求,或僅向特定受審核計畫參與者開放的政策。
因此,將事件視為AI能力與安全評估逐步被當成戰略資源,確實是一種值得留意的趨勢;但不能據此推論存在已協調的美國排他政策。
這不等於Mythos 5.1已被證明不安全
AISI沒有獲得存取權,並不代表 Mythos 5.1 必然不安全,也不代表它已構成極端風險。真正的問題是:當模型被定位為受限、高風險研究用途時,一個具備技術能力的獨立政府評估機構卻無法在公開部署前進行檢測,外界就少了一道可驗證開發商安全主張的防線。
簡言之,這起事件尚未揭露Anthropic的確切動機;它揭露的是,前沿AI安全監督的有效性,仍很大程度取決於模型開發商是否願意開放外部審查。