换句话说,它不仅能阅读复杂代码库,还能主动分析系统、定位漏洞,甚至构造利用方式。这意味着AI正在进入一个新阶段:
正因为能力过于强大,Anthropic并没有像其他模型那样直接公开发布。
为了安全地测试这一能力,Anthropic推出了 Project Glasswing。
这是一个专注于防御性网络安全的合作计划。与普通产品发布不同,Mythos只提供给 经过严格审核的少数合作伙伴 使用,例如大型科技公司以及负责关键软件基础设施的组织。
这些合作伙伴利用Mythos来执行防御性任务,例如:
随着项目推进,参与组织已经扩展到 约50家合作伙伴,包括大型科技公司和开源基础设施维护者。
这种方式的核心理念是:让防御方先获得能力优势,在类似技术普及前先修补关键漏洞。
即使只在有限范围内使用,Mythos也已经产生了相当惊人的结果。
Anthropic表示,通过Project Glasswing合作,研究人员已经在全球广泛使用的软件系统中发现 超过1万处高危或严重漏洞。
公开报道还指出,Mythos可以:
在软件工程能力方面,一些报告称该模型在 SWE‑bench Verified 基准测试中达到约 93.9% 的成绩,不过这一具体数字并未全部由Anthropic官方材料独立确认。
这些能力解释了为什么Mythos被视为典型的 “双重用途技术”:
由于Mythos通常被严格限制在Project Glasswing内部,一旦它出现在普通开发工具界面,就很容易引发行业猜测。
一些观察者认为,这可能意味着:
当然,目前仍没有证据表明Anthropic已经准备公开发布该模型,开发者工具中的出现也可能只是内部测试痕迹。
Mythos的能力同样引起了政策层面的关注。
美国政府官员和机构已经讨论过是否需要对类似AI系统实施额外监管,因为能够自动发现和利用漏洞的AI工具也可能被用于高级网络攻击。
一些报道称,政府方面甚至曾反对扩大Mythos的访问范围,理由包括:
这些因素也是该模型至今仍未公开发布的重要原因。
从更宏观的角度看,Mythos代表着AI与网络安全关系的一次重要转变。
过去的AI主要是辅助开发者写代码,而新一代模型已经开始能够:
如果这种能力未来被整合进开发平台或安全工具,软件漏洞的发现速度和修复速度都可能大幅提升。
Anthropic选择通过 Project Glasswing 这种受控方式部署Mythos,正是因为它既拥有巨大的防御价值,也伴随着真实的安全风险。
而这次在开发者工具中的短暂出现,则让外界开始猜测:这种强大的网络安全AI,也许终有一天会成为开发平台中的标准能力。