Anthropic喺2026年9月公開嘅威脅情報報告,整理咗其團隊喺八個月內偵測並阻止嘅Claude濫用個案。報告最值得留意嘅唔係AI突然創造咗一套全新傷害模式,而係模型可以協助使用者完成以往要更多專業人手、時間同技術資源先做到嘅步驟,甚至幫手串連整個流程。
1
3
涉及七個風險範疇
報告涵蓋2025年12月至2026年8月期間被阻止嘅活動,共七類:網絡行動、影響力行動、監控、騙案及詐騙、生物濫用、常規武器研發,同埋非法模型蒸餾——即嘗試複製模型能力。
1
5
Anthropic稱,個案用到Claude Haiku、Sonnet及Opus;除咗一宗非法蒸餾案之外,冇個案涉及Fable或Mythos級模型。
3
5
報告所述行動者背景亦相當雜:包括疑似獲國家支持嘅組織、以賺錢為目標嘅罪犯、間諜軟件供應商、宣傳行動同政治動機團體。呢點反映,AI濫用唔只係傳統網絡罪案問題,而係橫跨多個領域嘅風險。
1
網絡攻擊:由輔助走向協調
網絡安全部分係報告最明確嘅警示。Anthropic形容,模型嘅用途已不止於解釋程式碼或起草文字,亦被用於規劃工作流程、偵察目標、處理竊取所得資料,以及支援入侵或勒索行動。
1
報告提到、歸因於「Midnight Blizzard」及疑似「ShinyHunters」關聯者嘅活動,用作說明呢種趨勢。Anthropic將Claude協助嘅活動,連繫到針對烏克蘭、歐洲及無人機供應鏈目標嘅入侵,以及涉嫌大規模竊取付款卡與乘客資料嘅行動。不過,呢啲組織名稱同作業判斷都屬Anthropic嘅評估,唔應視為對每個行動者身份或結果嘅獨立證明。
1
實際意思係:AI可以減少攻擊者組織一場行動時嘅時間同協調負擔。佢並唔會取代存取權限、基礎設施、實戰判斷或人類意圖,但可以令複雜流程更易砌出嚟同運作。
生物濫用:嚴重提問,不等於已製造武器
Anthropic亦報告,有人嘗試取得與基孔肯雅病毒功能增益研究、高致病性禽流感適應哺乳類動物,以及活性正痘病毒研究相關嘅協助。呢啲都屬高度敏感嘅「軍民兩用」研究範圍:合法科研問題有時可以同可被錯誤利用嘅知識重疊。
1
最重要嘅分野係:有人嘗試提出請求,唔等於研究計劃已完成。報告描述嘅係Anthropic稱已阻止嘅濫用嘗試,並冇證實有生物武器被製成,亦冇證實所提出嘅研究已經實行。
1
Anthropic點樣應對?
Anthropic表示已加強保障措施、封禁帳戶、干擾相關基礎設施,並向有關科技公司及政府部門分享威脅指標同經驗。公司亦稱已公開「入侵指標」(indicators of compromise),協助保安團隊識別可能有關聯嘅活動。
1
呢類行動反映,AI公司嘅角色愈來愈似平台營運者兼安全守門人:除咗開發模型,亦要監察濫用、決定幾時收回存取權,以及同外部防禦單位協調。
呢份報告講到乜,又講唔到乜?
報告嘅價值,在於提供一批Anthropic稱已發現嘅個案紀錄;但佢唔係一項量度全網、或不同模型供應商之間AI濫用比例嘅普查。單靠一批被阻止嘅個案,無法判斷每類濫用有幾普遍、有幾多活動冇被發現,亦無法證明AI喺每宗行動中都實質改變咗最終結果。
1
3
所以,監管討論要同時睇兩邊:企業要有能力迅速截停可信嘅濫用風險,尤其係網絡安全同生物領域;但監察、限制存取、終止帳戶同公開資訊等決定,亦牽涉私隱、正當程序同公眾問責。報告令建立清晰規則、接受有意義嘅外部監督,以及跨機構協作嘅需要更為突出,避免高風險判斷只交由單一公司決定。
總結
Anthropic嘅報告記錄咗多種嘗試濫用Claude嘅情況,由網絡入侵、詐騙、監控,到武器相關工作同敏感生物研究都有。核心警號係,AI可以令攻擊者以較少資源協調更多行動步驟;但證據範圍始終有限:呢啲係被偵測及阻止嘅個案,應理解為風險正在演變嘅訊號,而唔係所有AI支援威脅嘅完整統計。
1
3