WizのProject Atlasは、CyberGymベンチマークでスコア90.9%を記録し1位に。OpenAIのGPT 5.5 Cyber(85.6%)やAnthropicのMythos(83%)を上回った——ただし、より優れた単一モデルを使ったわけではなく、複数の専門特化型AIエージェントを組織的に連携させた成果である。 この自律型システムは、長年にわたり徹底的に監査・ファズテストされてきたオープンソースプロジェクト(Linuxカーネル、Kubernetes、gVisor、containerd、dnsmasqなど)で、未発見の脆弱性200件以上を発見。また、GitHubの重大なRCE脆弱性(CVE 2026 3854、CV...

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What did Wiz announce with Project Atlas — an autonomous AI vulnerability research system that ou. Article summary: On **July 27, 2026**, Wiz (acquired by Google for $32 billion in March 2026) announced **Project Atlas** — an autonomous, multi-model AI system for vulnerability research that achieved a **90.9% success rate** on the **C. Topic tags: general, government, general web, user generated, academic. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, wate
2026年7月27日、クラウドセキュリティプロバイダーWiz(2026年3月にGoogleが320億ドルで買収)は、脆弱性研究のための自律型マルチモデルAIシステム「Project Atlas」を発表した。このシステムは、CyberGymベンチマークで90.9%の成功率を達成し、AnthropicのMythos(約83%)やOpenAIのGPT-5.5 Cyber(約85.6%)を上回って1位を獲得した
。これはAIセキュリティの軍拡競争における重要な節目であり、その理由はAtlasがより強力な単一モデルを使用したからではなく、複数のモデルと専門エージェントを連携させる仕組みにある。
ベンチマークでトップに。 Atlasは、188のオープンソースソフトウェアプロジェクトから抽出した1,507のタスクを通じて、AIエージェントが実際の脆弱性を再現・発見する能力を測定する公開ベンチマーク「CyberGym」で90.9%を記録した。参考までに、これまで最良だった単一モデルシステム——GPT-5.5 Cyber(85.6%)やAnthropicのMythos(83%)——は、5~8ポイント及ばなかった
。2026年5月に100以上の専門エージェントで88.45%を叩き出したMicrosoftのMDASHシステムでさえも超えられた
。
200件以上のゼロデイ発見。 Wiz社内のテストでは、AtlasはLinuxカーネル、Kubernetes、gVisor、containerd、dnsmasqなど、長年にわたって徹底的にファズテストと監査が行われてきた広く使われているオープンソースプロジェクトにおいて、未発見の脆弱性200件以上を発見した。重要なのは、各発見がエージェントシステムによってエンドツーエンドで自律的に検証され、モデルが「怪しい」と示唆する段階から、実際のセキュリティ問題である再現可能な証明へと昇華されている点である
。
CVE-2026-3854——GitHubの深刻なRCE。 Atlasの初期バージョンは、GitHubの内部gitインフラストラクチャにおける深刻なリモートコード実行(RCE)脆弱性(CVE-2026-3854、CVSS 8.8)を特定した。この欠陥により、プッシュアクセス権を持つ認証済みユーザーは、たった1回の
git push。Wizは2026年3月4日にバグ報奨金プログラムを通じてGitHubに報告
。GitHubは40分で問題を再現し、2時間足らずでgithub.comへの修正を展開、悪用の形跡はないことを確認した
。
10万ドルの報奨金。 GitHubはこの発見に対し、プログラム史上最大級となる10万ドルの報奨金を支払った(ただしWizの総報酬額は、2026年7月の公開プログラム削減前のレートに基づいて決定された可能性がある)。
これこそが中核となるアーキテクチャの物語である。Atlasは単一のAIモデルではない——それはマルチモデル・エージェントシステムである。GPT-5.5 CyberやMythosが採用する単一モデル方式との違いは以下の通り。
Wizは、システムアーキテクチャは生のモデル能力よりも重要であると主張する——AtlasがGPT-5.5 CyberやMythosを凌駕したのは、より優れたベースモデルを持っていたからではなく、複数のモデルとエージェントを厳格な検証ループでインテリジェントに組み合わせたからである。
AIセキュリティ軍拡競争のタイムラインは、単一モデル優位からマルチエージェント優位への明確な軌跡を示している。
2026年前半~半ば:単一モデルのエスカレーション。 OpenAIは2026年6月、Daybreak防衛プログラムの一環として、完全版のGPT-5.5-Cyber(CyberGymで85.6%)をリリース。AnthropicのClaude Mythos Previewも高得点を記録し、英国AISI(AIセキュリティ研究所)とPalo Alto Networksの研究者らは、これらのモデルが"自律的なハッキングベンチマークを超えた"と警告した
。
2026年5月:マルチエージェントが可能性を証明。 MicrosoftのMDASHシステム(100以上の専門エージェント、CyberGymで88.45%)は、マルチエージェントシステムが単一モデルを凌駕できることを示した。
2026年7月:マルチエージェントの勝利。 WizのAtlas(90.9%)が両者を上回り、複数のフロンティアモデルの連携が単一モデルを凌駕することを証明した。
AIエージェントと体系的なファジング、静的解析、コードレビューの組み合わせは、前例のない規模でゼロデイを生み出している——Atlasだけで、徹底的に監査されたオープンソースコードから200件以上の脆弱性を発見した。このAIによるバグ発見の洪水は、脆弱性開示プログラムの経済学に圧力をかけている。GitHubは2026年7月27日、公開バグ報奨金の支払い額を少なくとも半減させた(重大な発見は2万~3万ドル以上から1万ドルの固定額に引き下げ)。ただし招待制のVIP層は依然として3万ドル以上の報酬を支払っている
。Atlasが発見したCVE-2026-3854を含むそれ以前に報告された案件は、従来の支払い条件が適用されている
。
WizのProject Atlasは、現時点におけるAI脆弱性研究の最先端である——その理由はより優れたモデルを使用しているからではなく、独立した検証を備えたマルチエージェント・マルチモデル・アーキテクチャが、単一モデルシステムを大きな差(90.9% vs 85.6% vs 83%)で凌駕しているからである。これは、AIセキュリティの状況における「どのモデルが最強か」から「モデルをいかに効果的に組織化するか」へのより広範なシフトを反映している。WizとGoogleの明確な立場が示すように、AIセキュリティ軍拡競争における勝利のアプローチは、単一のスーパーモデルではなく、モデル、人間の専門知識、そして厳格な検証パイプラインを組み合わせたシステムなのである。
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
WizのProject Atlasは、CyberGymベンチマークでスコア90.9%を記録し1位に。OpenAIのGPT 5.5 Cyber(85.6%)やAnthropicのMythos(83%)を上回った——ただし、より優れた単一モデルを使ったわけではなく、複数の専門特化型AIエージェントを組織的に連携させた成果である。
WizのProject Atlasは、CyberGymベンチマークでスコア90.9%を記録し1位に。OpenAIのGPT 5.5 Cyber(85.6%)やAnthropicのMythos(83%)を上回った——ただし、より優れた単一モデルを使ったわけではなく、複数の専門特化型AIエージェントを組織的に連携させた成果である。 この自律型システムは、長年にわたり徹底的に監査・ファズテストされてきたオープンソースプロジェクト(Linuxカーネル、Kubernetes、gVisor、containerd、dnsmasqなど)で、未発見の脆弱性200件以上を発見。また、GitHubの重大なRCE脆弱性(CVE 2026 3854、CVSS 8.8)を特定し、10万ドルのバグ報奨金を獲得した。
アーキテクチャが生のモデル能力よりも重要であることを証明:AtlasはClaude Opus 4.6とGPT 5.5を検証エージェントと組み合わせて活用。これは「どのAIモデルが最強か」から「AIチームをいかに効果的に組織するか」へのパラダイムシフトを象徴している。