Mais de 200 descobertas de zero-day. Em seus próprios testes, o Atlas descobriu mais de 200 vulnerabilidades anteriormente desconhecidas em projetos open-source amplamente utilizados, que já haviam sido intensamente testados (fuzzing) e auditados por anos, incluindo o kernel Linux, Kubernetes, gVisor, containerd e dnsmasq . Crucialmente, cada descoberta foi validada de forma autônoma de ponta a ponta pelo sistema agêntico, indo além de uma mera suspeita gerada pelo modelo para uma prova reproduzível de um problema de segurança real
.
CVE-2026-3854 — RCE crítica no GitHub. Uma versão inicial do Atlas identificou uma vulnerabilidade crítica de execução remota de código na infraestrutura interna de git do GitHub (CVE-2026-3854, CVSS 8.8) . A falha permitia que qualquer usuário autenticado com acesso de push executasse comandos arbitrários nos servidores backend do GitHub usando um único comando
git push. A Wiz reportou a falha ao GitHub em 4 de março de 2026 através do programa de bug bounty
. O GitHub reproduziu o problema em 40 minutos, implantou uma correção no github.com em menos de duas horas e confirmou que não houve exploração ativa na natureza
.
Bounty de US$ 100 mil. O GitHub emitiu um bounty de US$ 100 mil pela descoberta — um dos maiores pagamentos da história do programa, embora a recompensa total da Wiz possa ter sido estruturada com as taxas anteriores a julho de 2026, antes do programa público ser reduzido .
Esta é a história arquitetônica central. O Atlas não é um único modelo de IA — é um sistema agêntico e multimodelo . Veja como ele difere da abordagem de modelo único usada pelo GPT-5.5 Cyber e Mythos:
A Wiz argumenta que a arquitetura do sistema importa mais do que a capacidade bruta do modelo — o Atlas superou o GPT-5.5 Cyber e o Mythos não por ter um modelo base melhor, mas por combinar inteligentemente vários modelos e agentes com loops de verificação rigorosos .
A linha do tempo da corrida armamentista de segurança de IA mostra uma trajetória clara do domínio do modelo único para a superioridade multiagente:
Início a meados de 2026: Escalada de modelo único. A OpenAI lançou a versão completa do GPT-5.5-Cyber (85,6% no CyberGym) em junho de 2026 como parte de seu programa de defesa Daybreak . A Anthropic também alcançou uma pontuação alta com o Claude Mythos Preview, levando pesquisadores do UK AISI e da Palo Alto Networks a alertar que os modelos haviam "superado os benchmarks de hacking autônomo"
.
Maio de 2026: Multiagente prova seu potencial. O sistema MDASH, da Microsoft (mais de 100 agentes especializados, 88,45% no CyberGym), mostrou que sistemas multiagente poderiam superar modelos únicos .
Julho de 2026: Multiagente vence. O Atlas, da Wiz (90,9%), superou ambos, provando que a orquestração de múltiplos modelos de fronteira supera qualquer modelo único .
A combinação de agentes de IA com fuzzing sistemático, análise estática e revisão de código está produzindo zero-days em uma escala sem precedentes — só o Atlas encontrou mais de 200 em códigos open-source já intensamente auditados . Essa enxurrada de bugs descobertos por IA está pressionando a economia dos programas de divulgação de vulnerabilidades. O GitHub reduziu seus pagamentos públicos de bug bounty em pelo menos metade em 27 de julho de 2026 (descobertas críticas caindo de US$ 20 mil–US$ 30 mil+ para um valor fixo de US$ 10 mil), embora o nível VIP permanente, somente para convidados, ainda pague US$ 30 mil ou mais
. Relatórios arquivados antes dessa data, incluindo o CVE-2026-3854 descoberto pelo Atlas, mantiveram os termos de pagamento anteriores
.
O Project Atlas, da Wiz, é o estado-da-arte atual em pesquisa de vulnerabilidades com IA — não porque usa um modelo melhor, mas porque sua arquitetura multiagente e multimodelo com verificação independente supera os sistemas de modelo único por uma margem significativa (90,9% vs. 85,6% e 83%). Isso reflete uma mudança mais ampla no cenário de segurança de IA, de "qual modelo é melhor" para "como orquestrar modelos de forma eficaz". Como a Wiz e o Google deixam claro, a abordagem vencedora na corrida armamentista de segurança de IA não será um único supermodelo, mas sistemas que combinam modelos, expertise humana e pipelines de verificação rigorosos .