Wiz Project Atlas erreicht 90,9% auf dem CyberGym Benchmark und schlägt damit GPT 5.5 Cyber (85,6%) und Anthropic Mythos (83%) – nicht durch ein besseres Modell, sondern durch die Orchestrierung mehrerer spezialisiert... Das autonome System entdeckte über 200 bisher unbekannte Schwachstellen in jahrelang geprüften O...

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What did Wiz announce with Project Atlas — an autonomous AI vulnerability research system that ou. Article summary: On **July 27, 2026**, Wiz (acquired by Google for $32 billion in March 2026) announced **Project Atlas** — an autonomous, multi-model AI system for vulnerability research that achieved a **90.9% success rate** on the **C. Topic tags: general, government, general web, user generated, academic. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, wate
Am 27. Juli 2026 gab Wiz – der Cloud-Sicherheitsanbieter, der im März 2026 für 32 Milliarden Dollar von Google übernommen wurde – Project Atlas bekannt, ein autonomes, Multi-Modell-KI-System zur Schwachstellenforschung . Das System erreichte eine Erfolgsquote von 90,9% auf dem CyberGym-Benchmark, belegte Platz 1 und ließ sowohl Anthropics Mythos (~83%) als auch OpenAIs GPT-5.5 Cyber (~85,6%) hinter sich
. Dies markiert einen bedeutenden Meilenstein im KI-Sicherheitswettlauf – nicht weil Atlas ein leistungsstärkeres Modell nutzt, sondern weil es mehrere Modelle und spezialisierte Agenten orchestriert, die zusammenarbeiten.
Benchmark-Führung. Atlas erzielte 90,9% auf CyberGym, einem öffentlichen Benchmark, der die Fähigkeit von KI-Agenten misst, reale Schwachstellen in 1.507 Aufgaben aus 188 Open-Source-Softwareprojekten zu reproduzieren und zu entdecken . Zum Vergleich: Die besten Einzelmodell-Systeme – GPT-5.5 Cyber (85,6%) und Anthropics Mythos (83%) – liegen 5 bis 8 Prozentpunkte zurück
. Selbst Microsofts MDASH-System, das im Mai 2026 mit über 100 spezialisierten Agenten 88,45% erreichte, wurde übertroffen
.
Über 200 Zero-Day-Entdeckungen. In eigenen Tests deckte Atlas mehr als 200 bisher unbekannte Schwachstellen in weit verbreiteten Open-Source-Projekten auf, die jahrelang intensiv getestet und auditiert worden waren, darunter der Linux-Kernel, Kubernetes, gVisor, containerd und dnsmasq . Entscheidend ist, dass jeder Fund vom agentischen System Ende-zu-Ende autonom validiert wurde – es ging über modellgenerierte Vermutungen hinaus hin zu reproduzierbaren Beweisen für ein echtes Sicherheitsproblem
.
CVE-2026-3854 – kritische GitHub-RCE. Eine frühe Version von Atlas identifizierte eine kritische Schwachstelle zur Codeausführung aus der Ferne in GitHub's interner Git-Infrastruktur (CVE-2026-3854, CVSS 8.8) . Der Fehler erlaubte jedem authentifizierten Benutzer mit Push-Zugriff, mit einem einzigen
git push. Wiz meldete dies am 4. März 2026 über das Bug-Bounty-Programm an GitHub
. GitHub reproduzierte das Problem in 40 Minuten, stellte innerhalb von zwei Stunden einen Fix für github.com bereit und bestätigte, dass es keine Ausnutzung in freier Wildbahn gab
.
100.000 Dollar Bounty. GitHub zahlte eine Bounty von 100.000 Dollar für den Fund – eine der höchsten Auszahlungen in der Geschichte des Programms, wobei Wiz‘ Gesamtbelohnung möglicherweise über die vor Juli 2026 geltenden Tarife strukturiert wurde, bevor das öffentliche Programm gekürzt wurde .
Dies ist die Kernaussage zur Architektur. Atlas ist kein einzelnes KI-Modell – es ist ein Multi-Modell-, agentisches System . So unterscheidet es sich vom Einzelmodell-Ansatz, den GPT-5.5 Cyber und Mythos verwenden:
Wiz argumentiert, dass die Systemarchitektur wichtiger ist als die rohe Modellfähigkeit – Atlas schlug GPT-5.5 Cyber und Mythos nicht durch ein besseres Basismodell, sondern durch die intelligente Kombination mehrerer Modelle und Agenten mit engen Verifizierungsschleifen .
Der Zeitplan des KI-Sicherheitswettlaufs zeigt einen klaren Trend von der Einzelmodell-Dominanz zur Multi-Agenten-Überlegenheit:
Anfang bis Mitte 2026: Eskalation der Einzelmodelle. OpenAI veröffentlichte im Juni 2026 die vollständige GPT-5.5-Cyber (85,6% auf CyberGym) im Rahmen seines Daybreak-Verteidigungsprogramms . Auch Anthropics Claude Mythos Preview erzielte hohe Werte, was Forscher des britischen AISI und von Palo Alto Networks veranlasste, zu warnen, dass Modelle "autonome Hacking-Benchmarks übertroffen" hätten
.
Mai 2026: Multi-Agent beweist sein Potenzial. Microsofts MDASH-System (über 100 spezialisierte Agenten, 88,45% auf CyberGym) zeigte, dass Multi-Agenten-Systeme Einzelmodelle übertreffen können .
Juli 2026: Multi-Agent gewinnt. Wiz‘ Atlas (90,9%) übertraf beide und bewies, dass die Orchestrierung mehrerer Grenzmodelle jedes einzelne Modell übertrifft .
Die Kombination von KI-Agenten mit systematischem Fuzzing, statischer Analyse und Code-Review produziert Zero-Days in beispiellosem Umfang – Atlas allein fand über 200 Schwachstellen in intensiv geprüftem Open-Source-Code . Diese Flut von KI-entdeckten Fehlern setzt die Wirtschaftlichkeit von Offenlegungsprogrammen unter Druck. GitHub kürzte am 27. Juli 2026 seine öffentlichen Bug-Bounty-Zahlungen um mindestens die Hälfte (kritische Funde fielen von 20.000–30.000+ Dollar auf feste 10.000 Dollar), während die einladungsbasierte VIP-Stufe weiterhin 30.000+ Dollar zahlt
. Meldungen, die vor diesem Datum eingereicht wurden, einschließlich der von Atlas entdeckten CVE-2026-3854, behielten die bisherigen Zahlungsbedingungen
.
Wiz‘ Project Atlas ist der aktuelle Stand der Technik in der KI-Schwachstellenforschung – nicht weil es ein besseres Modell verwendet, sondern weil seine Multi-Agenten-, Multi-Modell-Architektur mit unabhängiger Verifizierung Einzelmodell-Systeme mit deutlichem Abstand schlägt (90,9% vs. 85,6% und 83%). Dies spiegelt einen breiteren Wandel in der KI-Sicherheitslandschaft wider: Weg von der Frage "Welches Modell ist das beste?" hin zu "Wie orchestriert man Modelle effektiv?" Wie Wiz und Google klarstellen, wird der siegreiche Ansatz im KI-Sicherheitswettlauf kein einzelnes Super-Modell sein, sondern Systeme, die Modelle, menschliche Expertise und strenge Verifizierungspipelines kombinieren .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Wiz Project Atlas erreicht 90,9% auf dem CyberGym Benchmark und schlägt damit GPT 5.5 Cyber (85,6%) und Anthropic Mythos (83%) – nicht durch ein besseres Modell, sondern durch die Orchestrierung mehrerer spezialisiert...
Wiz Project Atlas erreicht 90,9% auf dem CyberGym Benchmark und schlägt damit GPT 5.5 Cyber (85,6%) und Anthropic Mythos (83%) – nicht durch ein besseres Modell, sondern durch die Orchestrierung mehrerer spezialisiert... Das autonome System entdeckte über 200 bisher unbekannte Schwachstellen in jahrelang geprüften Open Source Projekten und identifizierte eine kritische GitHub RCE (CVE 2026 3854, CVSS 8.8), die eine Bounty von 100.000...
Architektur zählt mehr als rohe Modellleistung: Atlas kombiniert Claude Opus 4.6 und GPT 5.5 mit Verifizierungsagenten und markiert den Wandel von 'Welches KI Modell ist das beste?' hin zu 'Wie orchestriert man KI Tea...