Wiz's Project Atlas scoorde 90,9% op de CyberGym benchmark en versloeg daarmee GPT 5.5 Cyber (85,6%) en Anthropic's Mythos (83%) – niet door een beter model, maar door meerdere gespecialiseerde AI agenten te orkestreren. Het autonome systeem ontdekte meer dan 200 voorheen onbekende kwetsbaarheden in zwaar gecontrole...

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What did Wiz announce with Project Atlas — an autonomous AI vulnerability research system that ou. Article summary: On **July 27, 2026**, Wiz (acquired by Google for $32 billion in March 2026) announced **Project Atlas** — an autonomous, multi-model AI system for vulnerability research that achieved a **90.9% success rate** on the **C. Topic tags: general, government, general web, user generated, academic. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, wate
Op 27 juli 2026 kondigde Wiz – de cloudbeveiligingsspecialist die in maart 2026 door Google werd overgenomen voor $32 miljard – Project Atlas aan: een autonoom, multi-model AI-systeem voor kwetsbaarheidsonderzoek . Het systeem behaalde een slagingspercentage van 90,9% op de CyberGym-benchmark, waarmee het de #1-positie veroverde en zowel Anthropic's Mythos (~83%) als OpenAI's GPT-5.5 Cyber (~85,6%) overtrof
. Dit is een belangrijke mijlpaal in de AI-wapenwedloop op het gebied van beveiliging, niet omdat Atlas een krachtiger model gebruikt, maar omdat het meerdere modellen en gespecialiseerde agenten in samenhang laat samenwerken.
Koploper in benchmarks. Atlas scoorde 90,9% op CyberGym, een openbare benchmark die meet hoe goed AI-agenten echte kwetsbaarheden kunnen reproduceren en ontdekken in 1.507 taken uit 188 open-sourceprojecten . Ter vergelijking: de beste systemen met één model – GPT-5.5 Cyber (85,6%) en Anthropic's Mythos (83%) – blijven 5 tot 8 procentpunten achter
. Zelfs Microsofts MDASH-systeem, dat in mei 2026 met meer dan 100 gespecialiseerde agenten een score van 88,45% behaalde, werd overtroffen
.
Meer dan 200 zero-days ontdekt. In eigen tests ontdekte Atlas meer dan 200 voorheen onbekende kwetsbaarheden in veelgebruikte open-sourceprojecten die jarenlang zwaar waren getest en gecontroleerd, waaronder de Linux-kernel, Kubernetes, gVisor, containerd en dnsmasq . Elk bewijsstuk werd autonoom van begin tot eind gevalideerd door het agentische systeem, waarmee het verder ging dan alleen een vermoeden van een model naar reproduceerbaar bewijs van een echt beveiligingsprobleem
.
CVE-2026-3854 – kritieke GitHub RCE. Een vroege versie van Atlas identificeerde een kritieke kwetsbaarheid voor het uitvoeren van externe code in de interne git-infrastructuur van GitHub (CVE-2026-3854, CVSS 8.8) . De fout stelde elke geverifieerde gebruiker met push-toegang in staat om willekeurige opdrachten uit te voeren op de back-endservers van GitHub met een enkele
git push. Wiz meldde dit op 4 maart 2026 aan GitHub via het bugbountyprogramma
. GitHub reproduceerde het probleem binnen 40 minuten, implementeerde binnen twee uur een oplossing op github.com en bevestigde dat er geen misbruik in het wild had plaatsgevonden
.
$100.000 bounty. GitHub kende een $100.000 bounty toe voor deze vondst – een van de hoogste uitbetalingen in de geschiedenis van het programma, hoewel Wiz's totale beloning mogelijk via tarieven van vóór juli 2026 was gestructureerd, voordat het openbare programma werd verlaagd .
Dit is het kerneverhaal op architectuurgebied. Atlas is geen enkel AI-model – het is een multi-model, agentisch systeem . Hier ziet u hoe het verschilt van de aanpak met één model die wordt gebruikt door GPT-5.5 Cyber en Mythos:
Wiz stelt dat systeemarchitectuur belangrijker is dan ruwe modelcapaciteit – Atlas versloeg GPT-5.5 Cyber en Mythos niet door een beter basismodel, maar door intelligent meerdere modellen en agenten te combineren met strakke verificatielussen .
De tijdlijn van de AI-wapenwedloop op het gebied van beveiliging laat een duidelijke ontwikkeling zien van dominantie van één model naar superioriteit van meerdere agenten:
Begin tot medio 2026: Escalatie van één model. OpenAI bracht in juni 2026 de volledige GPT-5.5-Cyber uit (85,6% op CyberGym) als onderdeel van zijn Daybreak-verdedigingsprogramma . Anthropic's Claude Mythos Preview scoorde ook hoog, waardoor onderzoekers van het UK AISI en Palo Alto Networks waarschuwden dat modellen "autonome hackbenchmarks hadden overtroffen"
.
Mei 2026: Multi-agent bewijst zijn potentieel. Microsofts MDASH-systeem (100+ gespecialiseerde agenten, 88,45% op CyberGym) toonde aan dat multi-agentsystemen beter kunnen presteren dan één model .
Juli 2026: Multi-agent wint. Wiz's Atlas (90,9%) overtrof beide en bewees dat de orkestratie van meerdere frontier-modellen beter presteert dan elk afzonderlijk model .
De combinatie van AI-agenten met systematische fuzzing, statische analyse en codebeoordeling levert zero-days op een ongekende schaal op – Atlas vond er alleen al 200+ in zwaar gecontroleerde open-sourcecode . Deze stroom aan AI-ontdekte bugs zet de economie van kwetsbaarheidsdiscloseprogramma's onder druk. GitHub verlaagde zijn openbare bugbounty-uitbetalingen op 27 juli 2026 met minstens de helft (kritieke vondsten daalden van $20k–$30k+ naar een vast bedrag van $10k), hoewel de exclusieve VIP-tier nog steeds $30k+ betaalt
. Meldingen die vóór die datum zijn ingediend, waaronder de door Atlas ontdekte CVE-2026-3854, behielden de vorige betalingsvoorwaarden
.
Wiz's Project Atlas is de huidige state-of-the-art op het gebied van AI-onderzoek naar kwetsbaarheden – niet omdat het een beter model gebruikt, maar omdat de multi-agent, multi-model architectuur met onafhankelijke verificatie systemen met één model met een aanzienlijke marge verslaat (90,9% versus 85,6% en 83%). Dit weerspiegelt een bredere verschuiving in het AI-beveiligingslandschap van "welk model is het beste" naar "hoe orkestreer je modellen effectief." Zoals Wiz en Google duidelijk stellen, zal de winnende aanpak in de AI-wapenwedloop op het gebied van beveiliging niet één supermodel zijn, maar systemen die modellen, menselijke expertise en rigoureuze verificatiepijplijnen combineren .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Wiz's Project Atlas scoorde 90,9% op de CyberGym benchmark en versloeg daarmee GPT 5.5 Cyber (85,6%) en Anthropic's Mythos (83%) – niet door een beter model, maar door meerdere gespecialiseerde AI agenten te orkestreren.
Wiz's Project Atlas scoorde 90,9% op de CyberGym benchmark en versloeg daarmee GPT 5.5 Cyber (85,6%) en Anthropic's Mythos (83%) – niet door een beter model, maar door meerdere gespecialiseerde AI agenten te orkestreren. Het autonome systeem ontdekte meer dan 200 voorheen onbekende kwetsbaarheden in zwaar gecontroleerde open sourceprojecten en identificeerde een kritieke GitHub RCE (CVE 2026 3854, CVSS 8.8) die een bugbounty van $100....
Architectuur is belangrijker dan ruwe modelkracht: Atlas combineert Claude Opus 4.6 en GPT 5.5 met verificatie agenten, wat een verschuiving markeert van 'welk AI model is het beste' naar 'hoe orkestreer je AI teams e...