Een gelaagde aanpak is passend, aangezien het probleem dat in de rapportage wordt beschreven niet alleen een slechte trefwoordenlijst is, maar een mismatch tussen wat een veiligheidschecker ziet en wat de shell uiteindelijk uitvoert :
Rapportage uit juni 2026 beschreef meerdere gecoördineerde kwetsbaarheidsonthullingen die suggereerden dat veel AI-codeeragents vergelijkbare structurele zwakheden delen op het gebied van vertrouwen, commando-uitvoering en workspace-inhoud .
Belangrijke structurele zorgen die onderzoekers benadrukten: