डिफेंस-इन-डेप्थ बाय लेयर — Microsoft का सुरक्षा ब्लॉग (मई 2026) चार शमन परतों को परिभाषित करता है: मॉडल लेयर (प्रशिक्षण डेटा, फाइन-ट्यूनिंग, रिफ्यूज़ल व्यवहार), सुरक्षा प्रणाली लेयर (रनटाइम सामग्री फ़िल्टरिंग, गार्डरेल, लॉगिंग, ऑब्ज़र्वेबिलिटी), एप्लिकेशन लेयर (अनुमतियाँ, वर्कफ़्लो, एस्केलेशन पथ), और पोज़िशनिंग लेयर (पारदर्शिता दस्तावेज़ीकरण और UX खुलासे) । जून का एक बाद का ब्लॉग पोस्ट एक अधिक सूक्ष्म चार-परत दृश्य जोड़ता है: मॉडल लेयर, सुरक्षा प्रणाली लेयर, मेटाप्रॉम्प्ट और ग्राउंडिंग लेयर, और एजेंटिक लेयर (टूल-उपयोग अनुमतियाँ और ह्यूमन-इन-द-लूप जाँच) ।
MCP सर्वरों के लिए टेनेंट-स्तरीय अलाउलिस्ट — संगठनों को मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) प्रकाशकों और सर्वरों की एक अनुमोदित सूची बनाए रखनी चाहिए। Microsoft MCP कैटलॉग सत्यापित प्रथम-पक्ष सर्वर प्रदान करता है, और सभी बाहरी घटकों को सॉफ़्टवेयर आपूर्ति श्रृंखला के हिस्से के रूप में माना जाता है। अनुशंसा है कि MCP कनेक्शन पर 'Allow all' को अक्षम करें और केवल वही विशिष्ट टूल सक्षम करें जिनकी एजेंट को आवश्यकता है ।
एजेंट डिप्लॉयमेंट के लिए SBOM जनरेशन — टूल निर्भरताओं सहित सॉफ़्टवेयर बिल ऑफ़ मटीरियल, इंस्टॉलेशन से पहले MCP सर्वरों के लिए हस्ताक्षर और उत्पत्ति सत्यापन के साथ। Microsoft टूल विवरणों में छिपे निर्देशों के लिए रजिस्ट्री स्कैनिंग, सभी बाहरी टूल परिभाषाओं के लिए संस्करण पिनिंग और परिवर्तन निगरानी की भी सिफारिश करता है ।
नीति-आधारित गार्डरेल — निगरानी से परे, संगठन एजेंटों को क्या करने की अनुमति है, यह सेट करने के लिए नीति-आधारित नियंत्रण लागू कर सकते हैं, जो Agent 365 SDK और विंडोज पॉलिसी इन्फ्रास्ट्रक्चर के माध्यम से प्रवर्तनीय हैं । Microsoft का विंडोज डेवलपर ब्लॉग कहता है: "कंटेनमेंट यह सीमित करता है कि एजेंट क्या एक्सेस और कर सकते हैं, ताकि गैर-नियतात्मक व्यवहार बेकाबू जोखिम में न बदल जाए" ।
कंट्रोल प्लेन गवर्नेंस — संगठन में सभी एजेंटों में केंद्रीकृत स्वामित्व, पहचान जीवनचक्र प्रबंधन और अनुपालन प्रवर्तन। Microsoft के Azure क्लाउड अपनाने के फ्रेमवर्क में मौजूदा पहचान, डेटा गवर्नेंस और सुरक्षा प्रथाओं के साथ संरेखित एक केंद्रीकृत और प्रवर्तनीय गवर्नेंस और सुरक्षा आधार रेखा स्थापित करने की अनुशंसा की गई है ।
यह फ्रेमवर्क पूरे हमले की श्रृंखला को लक्षित करता है — आपूर्ति श्रृंखला विषाक्तता (अलाउलिस्ट और SBOM के माध्यम से), विशेषाधिकार वृद्धि (MXC आइसोलेशन के माध्यम से), डेटा बहिर्गमन (रनटाइम गार्डरेल और सामग्री फ़िल्टरिंग के माध्यम से), और अनधिकृत टूल उपयोग (अनुमति नियंत्रण और ह्यूमन-इन-द-लूप लूप्स के माध्यम से) । एजेंटिक सिस्टम की एक साल की रेड टीमिंग के बाद Microsoft की विफलता मोड की वर्गीकरण एक जीरो-ट्रस्ट अंतर-एजेंट आर्किटेक्चर जोड़ती है: उच्च जोखिम वाले परिदृश्यों के लिए, एजेंट पहचान को वर्कफ़्लो में स्थिति से मानने के बजाय क्रिप्टोग्राफ़िक रूप से स्थापित किया जाना चाहिए ।
2026 के मध्य की दो प्रमुख पहलें उद्योग के साइबर सुरक्षा में AI एजेंटों का आक्रामक और रक्षात्मक रूप से उपयोग करने की ओर बढ़ने का संकेत देती हैं, साथ ही सख्त गार्डरेल भी लागू करती हैं।
27 जुलाई, 2026 को घोषित, प्रोजेक्ट परसेप्शन एक एजेंटिक सुरक्षा प्रणाली है जो अलर्ट जनरेशन से आगे बढ़कर निरंतर स्वचालित कार्रवाई करती है । Microsoft ने इसे एक "निरंतर सीखने वाली रक्षा प्रणाली" के रूप में वर्णित किया जो "मशीन की गति से तर्क, प्राथमिकता और कार्य कर सकती है, जबकि मनुष्यों को मजबूती से नियंत्रण में रखती है" ।
यह क्यों मायने रखता है: यह साइबर डिफेंस में AI एजेंटों को सक्रिय, स्वायत्त भूमिकाएँ दिए जाने का एक ठोस उदाहरण है — बिना मानवीय दिशा की प्रतीक्षा किए सिस्टम की जांच करना, कमजोरियों को पैच करना और खतरों का जवाब देना। सख्त नियंत्रण उपरोक्त कंटेनमेंट नियमों से आता है: प्रोजेक्ट परसेप्शन एजेंट अभी भी MXC कंटेनरों के अंदर, नीति-आधारित गार्डरेल के तहत, निगरानी और मानवीय निरीक्षण के साथ काम करते हैं ।
27 जुलाई, 2026 को गठित — हगिंग फेस पर एक हाई-प्रोफाइल घटना के कुछ दिनों बाद, जिसने स्वायत्त AI एजेंटों पर नियंत्रण खोने के जोखिमों को उजागर किया — OSAA एक उद्योग गठबंधन है जो AI एजेंटों के लिए ओपन-सोर्स सुरक्षा उपकरण बना रहा है ।
यह क्यों मायने रखता है: OSAA एक सामूहिक उद्योग मान्यता का प्रतिनिधित्व करता है कि कोई एक विक्रेता अकेले स्वायत्त एजेंटों को सुरक्षित नहीं कर सकता है। गठबंधन का ओपन मॉडल और साझा उपकरणों पर ध्यान बंद, मालिकाना दृष्टिकोणों के लिए एक जानबूझकर प्रतिकार है — यह दांव है कि सुरक्षा उपकरणों तक व्यापक सामुदायिक पहुँच हमलावरों से आगे निकल जाएगी । Nvidia ने कहा: "ओपन मॉडल रक्षात्मक क्षमताओं को लोकतांत्रिक बनाते हैं, रक्षकों के लिए पारदर्शिता बढ़ाते हैं, डेटा की रक्षा करते हुए साइबर डिफेंस को सक्षम करते हैं, और अनुकूलन योग्य, स्थानीयकृत नियंत्रणों के साथ फ्रंटियर क्लोज्ड मॉडल को पूरक करते हैं" ।
| आयाम | Microsoft | उद्योग (OSAA / Nvidia) |
|---|---|---|
| नियंत्रण दर्शन | ओएस-स्तरीय कंटेनमेंट (MXC), नीति गार्डरेल, आपूर्ति-श्रृंखला नियंत्रण | ओपन-सोर्स साझा उपकरण, पारदर्शी दिशा-निर्देश (SAFE), सामुदायिक-नेतृत्व वाली रक्षा |
| सक्रिय रक्षा | प्रोजेक्ट परसेप्शन — स्वायत्त रेड/ब्लू/ग्रीन एजेंट जो खोजते हैं, ठीक करते हैं और सुधारते हैं | ओपन एजेंट हार्नेस और रनटाइम गार्डरेल जो सुरक्षित एजेंटिक संचालन सक्षम करते हैं |
| संबोधित जोखिम | अनधिकृत एजेंट कार्रवाइयाँ, डेटा बहिर्गमन, आपूर्ति-श्रृंखला विषाक्तता | एजेंट नियंत्रण की हानि, अपारदर्शी कमजोरी प्रकटीकरण, खंडित सुरक्षा उपकरण |
| मुख्य बाधा | एजेंट मानव-परिभाषित नीति के तहत लॉक-डाउन कंटेनरों में चलते हैं | साझा सुरक्षा आधार रेखाएँ और ओपन फ्रेमवर्क विक्रेता लॉक-इन को रोकते हैं और आधार स्तर को ऊपर उठाते हैं |
पैटर्न स्पष्ट है: वही कंपनियाँ जो AI एजेंटों को सक्रिय, स्वायत्त साइबर डिफेंस भूमिकाओं में धकेल रही हैं, वे उन कंटेनमेंट और गवर्नेंस ढाँचों को भी बनाने की होड़ में हैं जो उन एजेंटों को सुरक्षा खतरों की अगली पीढ़ी बनने से रोकें।