Safeguards Research Team (जुलाई 2026 में शुरू) — एक समर्पित नई टीम जो जेलब्रेक रोबस्टनेस, स्वचालित रेड टीमिंग और दुरुपयोग तथा मिसअलाइनमेंट दोनों के लिए निगरानी तकनीकों पर केंद्रित है । भूमिकाओं में Applied Safety Research Engineer, Safeguards शामिल है, जिसके लिए 4+ वर्षों का सॉफ्टवेयर/ML इंजीनियरिंग अनुभव और Python दक्षता आवश्यक है ।
Domain-specific Safeguards Enforcement Analysts — सबसे विशिष्ट पहल:
मार्च 2026 में, Anthropic ने विशेष रूप से गार्डरेल डिजाइन करने के लिए एक रासायनिक हथियार और विस्फोटक विशेषज्ञ की भर्ती की, जिसमें कम से कम पांच वर्षों के अनुभव वाले आवेदकों की मांग की गई ।
Anthropic Fellows Program (2026 के बैच) — इंजीनियरों और शोधकर्ताओं के लिए एक खुला आवेदन, ताकि वे Anthropic के उच्चतम-प्राथमिकता वाले सुरक्षा अनुसंधान प्रश्नों की जांच कर सकें, फंडिंग और मेंटरशिप के साथ ।
Trust & Safety Research Engineers — प्रोडक्शन में उपयोगकर्ताओं और API पार्टनर्स के अवांछित या असामान्य व्यवहार का पता लगाने के लिए ML मॉडल बनाना ।
264 सार्वजनिक पोस्टिंग (2025–2026) में, औसत मुआवजा $356,000 ($289,000–$403,000) है, जिसमें कुछ तकनीकी कर्मचारी $1 मिलियन से अधिक कमाते हैं ।
| भूमिका | वेतन सीमा (बेस) | प्रमुख योग्यताएं |
|---|---|---|
| Safeguards Enforcement Analyst, Chem & Explosives | $245K–$285K | रासायनिक/विस्फोटक सुरक्षा में डोमेन विशेषज्ञता |
| Applied Safety Research Engineer, Safeguards | $320K–$405K | 4+ वर्ष SWE/ML इंजीनियरिंग, Python |
| Research Engineer / Scientist, Safeguards | $315K–$560K | उन्नत डिग्री, सुरक्षा अनुसंधान अनुभव |
| Research Engineer, Trust & Safety | $300K–$450K | ML मॉडलिंग, प्रोडक्शन सिस्टम अनुभव |
| AI Safety Researcher (Senior) | $200K–$300K | वरिष्ठ-स्तरीय रेड-टीमिंग/सुरक्षा पृष्ठभूमि |
सभी भूमिकाएं सैन फ्रांसिस्को में हैं (इन-ऑफिस या हाइब्रिड), बेस वेतन के अतिरिक्त इक्विटी के साथ।
यह भर्ती अभियान Amodei की बढ़ती सार्वजनिक चेतावनियों का प्रत्यक्ष संचालनात्मक जवाब है:
हथियार विशेषज्ञों, साइबर अपराध विश्लेषकों और सुरक्षा इंजीनियरों की भर्ती इन चेतावनियों की व्यावहारिक अभिव्यक्ति है।
OpenAI के समान कदम: दिसंबर 2025 में, OpenAI ने $555,000 तक के बेस वेतन के साथ हेड ऑफ प्रिपेयर्डनेस की भूमिका पोस्ट की — और फरवरी 2026 में, उन्होंने इसे Anthropic के एक सुरक्षा शोधकर्ता को छीनकर भरा । मार्च 2026 में, OpenAI ने भी रासायनिक हथियार और विस्फोटक विशेषज्ञों के लिए नौकरियां पोस्ट कीं, जो Anthropic के डोमेन-विशिष्ट दुरुपयोग भूमिकाओं को लगभग प्रतिबिंबित करती हैं । दोनों कंपनियों ने 2025 के मध्य में एक पहली तरह के संयुक्त सुरक्षा मूल्यांकन पर सहयोग किया ।
प्रमुख अंतर: Anthropic का दृष्टिकोण अधिक संरचनात्मक रूप से समाहित है — इसने एक स्थायी Safeguards Research Team और फेलो पाइपलाइन बनाई, न कि केवल व्यक्तिगत वरिष्ठ लीड को काम पर रखा। ब्लूमबर्ग ने मार्च 2026 में रिपोर्ट दी कि दोनों कंपनियों में संयुक्त सुरक्षा हेडकाउंट चौंकाने वाला छोटा है, और उत्पाद-केंद्रित भर्ती की तुलना में सुरक्षा-उन्मुख भूमिकाओं में निवेश "परेशान करने वाला" असंतुलित है ।
व्यापक स्व-नियमन संदर्भ: 2026 के मध्य तक अमेरिका में कोई व्यापक संघीय AI सुरक्षा कानून पारित नहीं हुआ है। दोनों कंपनियां स्वैच्छिक प्रतिबद्धताओं के तहत काम कर रही हैं (व्हाइट हाउस की 2023 की स्वैच्छिक प्रतिज्ञाएं, Anthropic की प्रकाशित पारदर्शिता प्रतिबद्धताएं) । Amodei सार्वजनिक रूप से स्वीकार कर चुके हैं कि स्व-नियमन अपर्याप्त है — उन्होंने 60 Minutes को बताया कि वह सी-सूट द्वारा अकेले ये निर्णय लेने से "गहराई से असहज" हैं — फिर भी कानून के अभाव में, दोनों कंपनियां दुरुपयोग रोकथाम टीमों का निर्माण एक वास्तविक निजी-क्षेत्र सुरक्षा जाल के रूप में कर रही हैं। इसका परिणाम दुर्लभ डोमेन विशेषज्ञों (रासायनिक हथियार विशेषज्ञ, परमाणु विश्लेषक) को काम पर रखने की होड़ है, जो न तो सरकार और न ही निजी क्षेत्र के पास बड़ी संख्या में हैं, जबकि अंतर्निहित प्रतिभा पूल बहुत पतला है ।