Anthropic 在 2026 年 9 月發表的威脅情報報告稱,該公司在 2025 年 12 月至 2026 年 8 月期間,發現並中斷多類企圖濫用 Claude 的行動,涵蓋網絡行動、影響力行動、監控、詐騙與欺詐、生物濫用、常規武器研發及模型蒸餾等七個範疇。
15
38
當中最受注目的個案之一,是一個被 Anthropic 定性為與伊朗有關連的行動者,涉嫌以 Claude 蒐集及分析公開資料,為中東地區的美國海軍部隊製作目標建議。Anthropic 表示已中斷該活動。
15
18
要先講清楚一點:這份報告說的是有人嘗試利用 AI 協助研究及策劃,並不代表已有襲擊發生、海軍系統遭攻破,或相關材料造成任何已證實的實戰後果。
所謂「目標手冊」包括甚麼?
按 Anthropic 的說法及相關報道,涉事者利用 Claude 編製公開來源的目標手冊,並追蹤海軍位置。資料包括:從公開軍方相片說明文字擷取的人員姓名、公開可查的艦艇與飛機應答器識別資料、商業衛星影像查詢腳本,以及披露海軍動向的公開網站。
18
23
26
報告亦指,該行動者研究過海上通訊及艦上系統可能存在的弱點。
20
51 這較貼切的理解是「AI 輔助情報準備」:把原本散落、但公開可取得的資料,快速彙集、分類及分析。
Claude 在事件中的作用,並非自行監控目標或發動攻擊;其被指帶來的價值主要是速度與整合能力,將零散公開資訊整理成結構化的研究與目標材料。
另有境內監控系統研發個案
Anthropic 又提到另一個伊朗關聯帳戶,曾在開發境內監控系統時使用 Claude。該系統結合自動車牌辨識,以及流動裝置識別碼截取或追蹤功能。
51
不過,現有報道未能確認該平台有否實際部署、覆蓋範圍有多大、針對哪些人,或是否已形成大規模監控能力。設計或改良一種能力,跟證實它已投入使用及產生效果,是兩回事。
宣傳操作:將國家敘事包裝成「獨立觀點」
報告亦點出三個與伊朗政府立場一致的影響力行動。相關人士將工作稱為「軟戰」或「認知戰」,目標是在伊朗境內及海外塑造輿論。報道列出的機構包括伊斯蘭文化與傳播組織、呼羅珊拉扎維伊斯蘭宣傳辦公室,以及伊斯蘭宣傳組織旗下的 Bina Cultural Observatory。
2
7
據報,相關帳戶以 Claude 協助製作宣傳計劃、政策或操作文件、人物設定系統、目標資料庫,並生產多語言內容。
2
7
其中一個核心手法是「來源洗白」:把國家支持的敘事,包裝成彷彿由獨立分析員或西方智庫提出。現有證據支持有人嘗試掩飾內容來源,但未能證明這些行動觸及大量受眾、改變公眾看法,或實質影響事件發展。
7
Anthropic 的應對與報告的界線
Anthropic 表示,其威脅情報團隊已識別並中斷報告涵蓋的行動。除伊朗個案外,報告亦提及被指與俄羅斯有關、針對烏克蘭目標的網絡活動;與中國有關的活動;以及一個也門小組利用 Claude 處理與彈道導彈制導相關的工作。
4
5
這些個案加強了報告對 AI 濫用的警告,但就每一宗個案而言,公開材料都不足以讓外界斷言行動是否成功,或造成了甚麼具體現實影響。
真正的安全啟示:AI 壓縮了「由資料到行動構想」的時間
這份報告最值得留意的,不是 AI 已取代傳統情報或軍事行動,而是能力較強的模型可以降低研究目標、整合公開資料、草擬程式和文件、規劃監控概念,以及用多種語言製作具說服力內容所需的時間和人力門檻。
對軍方及其他高價值機構而言,這突顯減少不必要公開人員、行蹤、技術及行動資料的重要性;對 AI 服務供應商而言,則再次說明偵測機制、帳戶執法及威脅情報共享不可或缺。Anthropic 所描述的是被嘗試濫用及被加速的工作流程,而不是獲證實的自主攻擊或戰場成果。
15
18