Anthropic 在 2026 年 9 月發布的威脅情報報告指出,該公司在 2025 年 12 月至 2026 年 8 月期間,阻斷了疑似具國家背景或犯罪動機的行為者濫用 Claude 的多起活動。涉及範圍包括網路行動、影響力行動、監控、詐騙與欺詐、生物濫用、常規武器研發,以及非法模型蒸餾;已辨識的案件使用了 Claude Haiku、Sonnet 與 Opus。
16
報告的重點不在於每一次企圖都已成功,而是指出生成式 AI 能降低偵察、監控、詐欺與網路行動所需的人力和技術門檻。Anthropic 同時表示,沒有證據顯示任何以 Claude 協助開發的可運作武器已被實際部署。
4
6
如何繞過平台與地區管制
Anthropic 指出,行為者曾試圖透過 VPN、假帳號、遭入侵的登入憑證及帳號輪替,規避地區和平台存取限制。
4
濫用也不只發生在提示詞層面。報告提到,AI 生態系周邊也出現遭竊或轉售的 API 金鑰與工作階段權杖;另有假冒 AI 產品或供應商、包括假借 Claude Code 名義的網站,被用來散布竊取憑證的惡意軟體。
4
12
這代表模型安全不能只看模型是否拒答。帳號註冊、身分驗證、支付濫用防治、憑證保護,以及協同帳號活動的偵測,同樣是防線的一部分。
報告中提到的濫用情境
武器相關工程與無人機研究
Anthropic 稱,一個位於葉門的導引武器工程小組曾使用 Claude,協助處理與導引火箭、多節彈道飛彈及高超音速滑翔飛彈相關的軟體工作。公司強調,尚無證據顯示以 Claude 協助研發的可作戰武器已經部署。
6
另有俄羅斯相關行為者據稱尋求與自主神風無人機群有關的協助。現有資料將此描述為嘗試以 AI 輔助研發,並不能據此認定系統已完成或投入實戰。
5
監控、壓制與影響力行動
報告也描述 AI 輔助的監控與情報蒐集。在一宗中國相關案例中,參與地方公安局案件管理系統的工程師,據稱開發了可利用公民身分證號碼,將個人移動軌跡與警方紀錄進行比對的工具。
4
其他案例包括:一項與馬利有關、試圖攔截多家行動電信業者通訊的行動;以及一項伊朗行動,涉及蒐集社群網路身分資料,並分析逾 15.5 萬則推文,用於情報或影響力目的。現有資料支持 Anthropic 對這些活動的偵測說法,但不足以證明每個行動都在現實世界中達成了何種效果。
4
Anthropic 的警告是,AI 未必會創造全新類型的傷害,卻可能讓既有的監控與政治壓制手段變得更便宜、更快速,也更容易擴大規模。
4
網路間諜、詐欺與模型能力竊取
報告記錄的網路相關活動,從竊取憑證、支援入侵,到半自主式 AI 輔助攻擊工作流程皆有涉及,也包含針對亞洲政府、金融及商業機構的行動。
4
俄羅斯相關活動據稱包含網路間諜行動,以及透過模型查詢路由暴露一個與俄羅斯國防相關政府資料庫的憑證。
5
中國相關案例則包括試圖擷取或「蒸餾」Claude 的能力;Anthropic 表示,這類行動曾使用大量假帳號,而非法蒸餾正是該公司調查的七類危害之一。
4
16
Anthropic 採取了哪些措施?
Anthropic 表示,已中斷所辨識的活動、封禁相關帳號,並依據案例更新防護措施;同時向適當的政府機關及產業合作夥伴分享相關威脅情報。
4
這些措施可切斷特定行為者通往商業模型的一條路徑,也能為其他防禦方提供可用的警訊與指標。不過,這並不會消除行為者背後的工具、能力與動機。
為何封號不是終點
Anthropic 明確指出,問題不只在於能否使用 Claude。被移出單一服務的行為者,仍可能改用遭竊帳號、轉往其他供應商,或使用開源模型。
4
因此,這份報告較適合被視為威脅環境正在變化的證據,而不是「封掉一批帳號」即可永久解決濫用的證明。平台執法能提高濫用成本、揭露行動並保護正常使用者;但更完整的應對還須結合更嚴格的身分與帳號控管、憑證安全、跨組織威脅情報共享,以及涵蓋單一平台以外 AI 工具的防禦機制。
結論
Anthropic 的報告將 AI 濫用描述為一個「作業規模化」問題:行為者據稱利用 VPN、假帳號與遭竊憑證等既有規避手法,把通用型模型套用到武器相關研究、監控、影響力行動、網路活動及詐欺之中。
4
16
公司阻斷行動限制了已辨識案件取得 Claude 的管道;但其更大的警訊是,能力愈強的 AI 正在降低有害行動的門檻。與此同時,現有證據並不支持所有通報的企圖都已落地,例如武器相關工作並無證據顯示已形成並部署可作戰武器。
4
6