Anthropic ने 9-10 जून, 2026 को Claude Fable 5 (एक सार्वजनिक रूप से उपलब्ध सामान्य मॉडल) और Claude Mythos 5 (साइबर सुरक्षा उपायों को हटाकर समान अंतर्निहित मॉडल, केवल सत्यापित रक्षकों के लिए प्रतिबंधित) जारी किया । 12 जून को शाम 5:21 बजे ET पर, अमेरिकी वाणिज्य विभाग ने एक आपातकालीन निर्यात नियंत्रण निर्देश जारी कर Anthropic को किसी भी विदेशी नागरिक, जिसमें स्वयं Anthropic के विदेशी कर्मचारी भी शामिल हैं, के लिए तुरंत दोनों मॉडलों को अक्षम करने का आदेश दिया
। Anthropic ने उसी दिन अनुपालन करते हुए वैश्विक पहुंच निलंबित कर दी
।
ट्रिगर: साइबर सुरक्षा शोधकर्ता केटी मुस्सौरी (Katie Moussouris) ने प्रदर्शित किया कि मॉडलों को केवल तीन शब्दों के निर्देश 'Fix this code' देकर स्वायत्त रूप से सॉफ्टवेयर कमजोरियों का रिवर्स-इंजीनियरिंग और हथियारीकरण करने के लिए प्रेरित किया जा सकता है, जिससे राष्ट्रीय सुरक्षा अलार्म बज गया । Anthropic में निवेशक Amazon ने अपनी स्वयं की सुरक्षा समीक्षा के बाद व्हाइट हाउस को सतर्क किया
।
अप्रैल 2026 में, Anthropic ने उन आरोपों की जांच की कि एक छोटे समूह ने Claude Mythos के एक पूर्वावलोकन मॉडल तक अनधिकृत पहुंच प्राप्त कर ली थी - एक ऐसी प्रणाली जिसे Anthropic ने स्वयं सार्वजनिक रिलीज के लिए बहुत शक्तिशाली बताया था । इस घटना ने प्रसार जोखिमों के बारे में व्यापक चिंताओं को जन्म दिया, जो बाद में Fable 5 बंद होने का कारण बनीं।
OpenAI ने 11 मई, 2026 को Daybreak लॉन्च किया, जो एक प्रमुख साइबर सुरक्षा पहल है - उसी दिन Google के थ्रेट इंटेलिजेंस ग्रुप ने हमलावरों द्वारा AI का उपयोग करके जीरो-डे एक्सप्लॉइट बनाने के पहले मामले का खुलासा किया । Daybreak GPT-5.5 मॉडल टियर (एक अनुमेय 'GPT-5.5-Cyber' रेड-टीमिंग वेरिएंट सहित) को Codex Security एजेंटों और 20 से अधिक सुरक्षा भागीदारों (Cloudflare, CrowdStrike, Palo Alto Networks, आदि) के साथ बंडल करता है ताकि कमजोरियों की खोज, पैच सत्यापन और सुधार को मशीन की गति से स्वचालित किया जा सके
। इसे Anthropic की पहले की Project Glasswing / Mythos पेशकशों के लिए OpenAI की सीधी प्रतिस्पर्धी प्रतिक्रिया के रूप में देखा गया
।
1 मई, 2026 को, फाइव आइज़ (CISA, NSA, ASD ACSC, CCCS, NZ NCSC, UK NCSC) की छह साइबर सुरक्षा एजेंसियों ने 'Careful Adoption of Agentic AI Services' प्रकाशित किया - विशेष रूप से स्वायत्त AI एजेंटों को लक्षित करने वाला पहला समन्वित बहु-सरकारी सुरक्षा मार्गदर्शन । सलाह ने पांच जोखिम श्रेणियों (विशेषाधिकार, डिजाइन/कॉन्फ़िगरेशन, व्यवहारिक, जवाबदेही, और डेटा/परिचालन जोखिम) की पहचान की और चेतावनी दी कि स्वायत्त एजेंट जो 'उन तरीकों से कार्य करते हैं, निर्णय लेते हैं और सिस्टम में बातचीत करते हैं जिनकी भविष्यवाणी, लेखापरीक्षा या नियंत्रण करना मुश्किल है' पहले से ही अपर्याप्त सुरक्षा उपायों के साथ महत्वपूर्ण बुनियादी ढांचे में काम कर रहे थे
। मई की इस सलाह ने नीतिगत आधार तैयार किया जिसे 22 जून के बयान ने कार्रवाई के लिए एक व्यापक, अधिक जरूरी आह्वान में बढ़ा दिया।
मई की एजेंटिक AI सलाह ने प्रणालीगत जोखिमों की पहचान की। Mythos पहुंच घटना और Fable 5 में 'Fix this code' कमजोरी ने साबित कर दिया कि वे जोखिम पहले से ही वास्तविक दुनिया के फ्रंटियर मॉडल में साकार हो रहे थे। OpenAI के Daybreak लॉन्च ने प्रतिस्पर्धी और सुरक्षा गतिशीलता को तेज कर दिया। 22 जून का बयान फाइव आइज़ के एकीकृत निष्कर्ष का प्रतिनिधित्व करता है कि रक्षात्मक कार्रवाई के लिए समय सीमा वर्षों से घटकर महीने रह गई है।