Anthropic称,其在2025年12月至2026年8月间阻断了39起Claude滥用事件,涉及网络行动、影响力行动、监控、诈骗、生物滥用、常规武器研发和非法模型蒸馏等七类风险。相关模型为Haiku、Sonnet和Opus;除一起蒸馏案外,不涉及Fable或Mythos系列。[1][3] 这些案例涵盖疑似国家支持的网络活动、以牟利为目的的诈骗,以及与高风险生物研究相关的求助请求。报告记录的是已发现并阻断的尝试,并不能证明相关攻击或研究最终完成。[1]
发布者使用 GPT-5.6 Terra 编辑图片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What did Anthropic’s September 2026 threat-intelligence report, covering AI misuse it disrupted from December 2025 through August 2026, reve. Article summary: Anthropic’s report describes a broad, evolving misuse problem: actors used older Claude Haiku, Sonnet, and Opus models for cyber operations, espionage, fraud, surveillance, weapons-related work, and potentially dangerous. Topic tags: general, general web, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers
Anthropic于2026年9月发布的威胁情报报告,详细披露了其团队在8个月内发现并阻断的Claude滥用活动。报告最值得关注的并非AI凭空制造了全新的危害类型,而是模型正能协助完成、串联和协调过去需要更多专业时间、人力及技术能力的环节。1
3
报告覆盖2025年12月至2026年8月间被阻断的活动,分为七类:网络行动、影响力行动、监控、诈骗与欺诈、生物滥用、常规武器研发,以及非法模型蒸馏。1
5
Anthropic表示,相关案例涉及Claude Haiku、Sonnet和Opus。除一起非法蒸馏——即试图复制模型能力——的案例外,Fable或Mythos系列模型未涉及其中。3
5
据称,涉事者包括疑似受国家支持的行为者、牟利型犯罪分子、间谍软件供应商、宣传行动组织和具有政治动机的团体。这个范围说明,AI滥用已不只是传统网络犯罪的问题,而是横跨多个领域的风险。1
网络安全案例是报告中对“操作自主性提升”警示最明确的部分。Anthropic称,模型的用途已不止于解释代码或起草文本,还被用于规划工作流、侦察、处理窃取的数据,以及支持入侵或勒索活动。1
报告提到,被归因为“午夜暴雪”(Midnight Blizzard)和疑似与ShinyHunters有关联者的活动,体现了这一判断。Anthropic将Claude辅助的活动与针对乌克兰、欧洲及无人机供应链目标的入侵,以及涉嫌大规模窃取支付卡和旅客数据的事件联系起来。
不过,这些组织标签与行动结论属于Anthropic的分析判断,不应被视为对每个参与者身份或每项结果的独立证实。1
实际含义在于:AI可降低一场攻击在时间和协同上的成本。它并不会替代初始访问权限、基础设施、行动判断和人的主观意图,但可能让复杂的攻击流程更容易被组装和运行。
Anthropic还披露,有人曾尝试获取与基孔肯雅病毒功能获得研究、高致病性禽流感病毒的哺乳动物适应,以及活正痘病毒研究有关的帮助。这些都属于高度敏感的双重用途研究领域:合法科研问题可能与可被滥用的知识交叠。1
这里必须区分“尝试寻求协助”与“已完成生物项目”。报告描述的是Anthropic称已阻断的滥用尝试,并未证明生物武器已被制造,或所提研究确实已经实施。1
Anthropic表示,已加强安全防护、封禁账户、干扰关联基础设施,并与相关科技公司和政府部门共享威胁指标与经验教训。该公司还称发布了入侵指标(IOC),以协助防守方识别关联活动。1
这反映出AI提供商角色的变化:它们不仅开发模型,也在监测滥用、决定何时终止访问权限,并与外部安全防御机构协作。
作为一份由Anthropic发现的事件案例集,这份报告具有参考价值;但它不是对整个互联网、或其他模型提供商平台上AI滥用情况的发生率研究。被阻断的案例集合无法说明每类滥用到底多常见、有多少活动未被发现,也无法证明AI在每次行动中都实质改变了最终结果。1
3
这一局限应当影响相关治理讨论。企业需要有能力快速中断可信的滥用行为,尤其是在网络安全和生物领域;但有关监测、访问限制、账户终止和信息披露的安全决定,也会影响隐私、正当程序和公众问责。
因此,报告强化了对明确规则、有效外部审查以及跨机构协作的需求,避免将高风险判断完全交由任何单一公司决定。
Anthropic的报告记录了多种试图滥用Claude的活动,包括网络入侵、诈骗、监控、武器相关工作及敏感生物研究。它发出的核心警示是:AI可能帮助攻击者以更少资源组织起更多行动环节。
但证据范围也应被清楚界定:这些是已被发现并阻断的案例。报告应被视为风险演变的信号,而非对所有AI赋能威胁的完整普查。1
3
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
Anthropic称,其在2025年12月至2026年8月间阻断了39起Claude滥用事件,涉及网络行动、影响力行动、监控、诈骗、生物滥用、常规武器研发和非法模型蒸馏等七类风险。相关模型为Haiku、Sonnet和Opus;除一起蒸馏案外,不涉及Fable或Mythos系列。[1][3]
Anthropic称,其在2025年12月至2026年8月间阻断了39起Claude滥用事件,涉及网络行动、影响力行动、监控、诈骗、生物滥用、常规武器研发和非法模型蒸馏等七类风险。相关模型为Haiku、Sonnet和Opus;除一起蒸馏案外,不涉及Fable或Mythos系列。[1][3] 这些案例涵盖疑似国家支持的网络活动、以牟利为目的的诈骗,以及与高风险生物研究相关的求助请求。报告记录的是已发现并阻断的尝试,并不能证明相关攻击或研究最终完成。[1]