換句話講,Mythos 唔只係幫開發者寫 code——佢可以:
呢種能力令 AI 首次真正踏入 自動化漏洞研究(automated vulnerability research) 嘅新階段。
正因為能力太強,Anthropic 冇選擇直接公開 Mythos。
相反,公司建立咗一個名為 Project Glasswing 嘅合作計劃,只向少數受審核機構提供模型存取。
參與機構包括多間大型科技公司同基礎設施維護組織,例如:
呢些機構利用 Mythos 做 防禦性安全研究,例如檢查系統漏洞同向軟件維護者報告問題。
到目前為止,計劃已經擴展到 約 50 個合作組織。
目的好簡單:
先畀防守方用 AI 找出漏洞,再等整個軟件生態系統修補好。
即使只係有限測試階段,Mythos 已經交出相當驚人嘅成果。
Anthropic 表示,Project Glasswing 合作已經發現 超過 10,000 個高或嚴重級別漏洞。
當中包括:
有報導亦指出,Mythos 喺軟件工程基準測試 SWE‑bench Verified 上達到 約 93.9% 成績。不過部分數據未完全由 Anthropic 官方文件確認。
呢些結果顯示一件事:
AI 已經可以以接近自動化方式,大規模發現軟件漏洞。
因為 Mythos 原本只存在於 Project Glasswing 嘅封閉環境。
如果真係有人喺 Claude developer tools 入面見到相關模型,可能代表幾件事:
當然,目前仍然 冇官方宣布公開推出,而且實際係點樣被發現亦未完全確認。
Mythos 另一個特別之處係——佢已經引起政府層面注意。
美國政府同多個機構曾討論如何監管或限制呢類 AI,因為:
有官員甚至反對 Anthropic 將 Mythos 存取擴展到更多公司,理由包括:
呢些因素令 Mythos 成為 AI 安全政策討論嘅焦點。
Mythos 其實象徵一個更大趨勢:
AI 正由「輔助開發者」變成 主動分析整個軟件世界嘅安全系統。
未來模型可能可以:
如果呢種能力最終整合入開發平台,軟件安全研究嘅速度可能會大幅提升。
但同時,亦代表 AI 同網絡攻防之間嘅競賽將會 急速升級。
而 Mythos 喺 developer tools 短暫現身,正好提醒大家:
AI 網絡安全革命,可能已經開始。