Anthropic喺2026年9月發布嘅威脅情報報告指出,團隊喺2025年12月至2026年8月期間,截停咗疑似有國家背景或犯罪組織嘗試濫用Claude嘅活動,範圍包括網絡行動、影響力行動、監控、詐騙、生物濫用、常規武器研發,同非法模型蒸餾。已識別個案涉及Claude Haiku、Sonnet及Opus。
16
報告最值得留意嘅唔係「每宗嘗試都成功」,而係AI正減低偵察、監視、詐騙同網絡行動所需嘅人手、時間同技術門檻。至於武器相關個案,Anthropic明確表示,未有證據顯示任何以Claude協助研發嘅可操作武器已被部署。
4
6
點樣繞過平台限制?
據Anthropic所述,涉事者嘗試以VPN避開地區限制,並使用虛假帳戶、已被入侵嘅登入憑證,以及輪換帳戶等方式取得或維持存取權。
4
濫用亦延伸到AI服務周邊環節,例如遭盜用或轉售嘅API金鑰和工作階段權杖;另有網站冒充AI產品或供應商,包括Claude Code,散播竊取登入資料嘅惡意程式。
4
12
換句話講,模型安全唔可以只睇系統點回應提示詞。帳戶開設、身分驗證、付款濫用、憑證保護,以及識別協同行動帳戶,都係防線一部分。
報告披露咗咩濫用情況?
武器工程與無人機研究
Anthropic描述,一個位於也門嘅制導武器工程小組,曾用Claude協助與制導火箭、多級彈道導彈及高超音速滑翔導彈相關嘅軟件工作。不過,公司稱未發現有Claude參與研發嘅可操作武器已實際部署。
6
另一名與俄羅斯有關連嘅行動者,據報曾尋求協助開發自主式自殺無人機群。現有資料將此定性為嘗試借助AI進行研發,並無證據顯示系統已完成或投入實戰。
5
監控、打壓與影響力行動
報告亦提及AI輔助嘅監控及情報蒐集。一宗與中國有關連嘅個案中,一名參與市級公安局案件管理系統嘅工程師,據報開發工具,以居民身分證號碼將個人移動軌跡同警方紀錄作比對。
4
其他個案包括:一項與馬里有關連、試圖截取各流動通訊營辦商通訊內容嘅行動;以及伊朗相關行動蒐集社交網絡身分資料,並分析逾15.5萬則帖文,以作情報或影響力用途。現有材料支持Anthropic偵測到相關活動嘅說法,但未能證實每一場行動喺現實世界嘅成效或影響。
4
Anthropic嘅警告係,AI未必一定創造全新類型嘅傷害,但可以令既有監控同打壓手法更平、更快,亦更容易大規模運作。
4
網絡間諜、詐騙與模型能力竊取
報告記錄嘅網絡相關活動,由竊取憑證、協助入侵,以至半自主式AI輔助攻擊流程都有;部分行動針對亞洲多地嘅政府、金融及商業機構。
4
與俄羅斯有關連嘅活動,據報包括網絡間諜行動,以及透過模型查詢路由而暴露一個與俄羅斯國防相關政府資料庫嘅憑證。
5
至於與中國有關連嘅個案,則包括試圖抽取或「蒸餾」Claude能力,據報涉及大量虛假帳戶。Anthropic將非法蒸餾列為今次調查涵蓋嘅七個風險領域之一。
4
16
Anthropic做咗啲乜?
Anthropic表示已中斷已識別行動、封禁相關帳戶、按個案更新防護措施,並向合適嘅政府部門及業界夥伴分享相關威脅情報。
4
呢類行動可以切斷特定商業模型嘅使用途徑,亦有助其他防守者識別風險訊號;但並唔會令背後嘅工具、意圖或行動能力消失。
封帳戶唔等於問題完結
Anthropic自己亦強調,挑戰遠超Claude本身:被某一服務移除嘅行動者,可以轉用被盜帳戶、其他供應商,或者開源模型。
4
所以,呢份報告應理解為威脅環境正在轉變,而唔係「封一批帳戶」就可以永久解決濫用。平台執法能夠提高濫用成本、揭露行動並保護正常用戶;但同時亦要配合更嚴格嘅身分控制、憑證防護、跨平台威脅情報共享,以及針對單一平台以外AI工具嘅防禦策略。
總結
Anthropic呈現嘅核心問題,係AI令有害行動更容易擴展。行動者據報沿用VPN、假帳戶、失竊憑證等常見規避手法,再將通用AI模型套用到武器相關研究、監控、影響力行動、網絡活動同詐騙之上。
4
16
公司嘅封禁和中斷措施,限制咗已識別個案對Claude嘅存取;但更大嘅警號係,能力愈強嘅AI正降低有害工作嘅門檻。而現有證據亦提醒讀者,唔應將每宗被偵測嘅嘗試當成已成功落地——包括武器相關工作在內,並無證據顯示全部已達到實際部署階段。
4
6