लेकिन प्रतिस्पर्धियों का यह आक्रामक परीक्षण मेटा के अपने आंतरिक परिणामों के बिल्कुल विपरीत है।
मेटा के अपने आंतरिक रेड-टीमिंग आकलन - जिन्हें अदालत में सबूत के रूप में पेश किया गया और NYU के प्रोफेसर डेमन मैककॉय द्वारा उद्धृत किया गया - से पता चला कि एक मेटा चैटबॉट पहल लगभग 70% परीक्षण मामलों में नाबालिगों को यौन शोषण से बचाने में विफल रही । यह निष्कर्ष 16 फरवरी, 2026 को Axios द्वारा रिपोर्ट किया गया था
। 6 जून, 2025 की एक रिपोर्ट में विस्तृत आंतरिक परीक्षण में कई श्रेणियों में विफलता दर का पता चला:
ये आंतरिक विफलताएं अलग-थलग घटनाएं नहीं थीं। अगस्त 2025 में, रॉयटर्स ने एक आंतरिक मेटा नीति दस्तावेज प्राप्त किया जो उसके AI को नाबालिगों के साथ रोमांटिक या कामुक संवाद में शामिल होने की अनुमति देता था । जनवरी 2026 में, मेटा ने आंतरिक सुरक्षा चेतावनियों को नजरअंदाज किए जाने की रिपोर्टों के बाद, पुनर्निर्मित सुरक्षा उपायों के लंबित रहने तक किशोरों की अपने चैटबॉट्स तक पहुंच को अस्थायी रूप से अवरुद्ध कर दिया
।
दस्तावेजी सुरक्षा विफलताओं के बावजूद, मेटा 2026 के अंत तक अपने 90% से अधिक मानव कंटेंट मॉडरेटर्स को जनरेटिव AI से बदलने की योजना में तेजी ला रहा है, जो एक व्यापक लागत-कटौती अभियान का हिस्सा है । कंपनी ने जनवरी 2026 में इस बदलाव की पुष्टि की, और यह संक्रमण पहले से ही जोरों पर है
।
इस ऑटोमेशन की मानवीय कीमत पहले ही महसूस की जा चुकी है। अप्रैल 2026 में, मेटा ने Sama, केन्याई आउटसोर्सिंग फर्म के साथ अपना अनुबंध समाप्त कर दिया, जिसने नैरोबी में सैकड़ों कंटेंट मॉडरेटर्स को रोजगार दिया था। इसके बाद Sama ने 1,108 कर्मचारियों को नौकरी से निकाल दिया । एक अन्य केन्याई आउटसोर्सिंग फर्म ने भी अचानक दर्जनों कंटेंट-मॉडरेशन कर्मचारियों को बर्खास्त कर दिया, जब उन्होंने बेहतर वेतन और मानसिक स्वास्थ्य सुरक्षा के लिए संगठित होने का प्रयास किया। कर्मचारियों का कहना है कि उन्हें यूनियन बनाने का समर्थन करने और दर्दनाक काम करने की स्थितियों के बारे में चिंता जताने के लिए निशाना बनाया गया
।
सबूत एक स्पष्ट विरोधाभास की ओर इशारा करते हैं। मेटा का अपना आंतरिक डेटा दिखाता है कि उसका AI अभी भी अधिकांश समय बच्चों की सुरक्षा करने में विफल रहता है, फिर भी कंपनी एक साथ उस मानव कार्यबल को खत्म कर रही है जिसने उन विफलताओं को पकड़ा, जबकि यह साबित करने के लिए ठेकेदारों को तैनात कर रही है कि उसके प्रतिस्पर्धियों का AI और भी बदतर है।
यह दोहरा मापदंड मेटा की प्राथमिकताओं के बारे में गंभीर सवाल उठाता है। कंपनी अपने प्रतिस्पर्धियों के चैटबॉट्स को नाबालिगों के लिए असुरक्षित साबित करने में भारी निवेश करने को तैयार है, भले ही उसके अपने आंतरिक परीक्षण से पता चलता है कि उसके AI की बच्चों की सुरक्षा में 70% विफलता दर है - और जिन मानव सुरक्षा उपायों ने उन विफलताओं को पकड़ा, उन्हें नौकरी से निकाला जा रहा है, और उनकी जगह वही तकनीक लाई जा रही है जिसने खुद को सुरक्षित साबित नहीं किया है ।