GPTZero द्वारा रिपोर्ट के 45 उद्धरणों की स्कैनिंग में सत्यापन की एक व्यवस्थित विफलता सामने आई :
कुल मिलाकर, 89% ग्रंथ सूची को फ्लॉ के रूप में चिह्नित किया गया। GPTZero के AI डिटेक्शन स्कैन ने एक और परेशान करने वाली परत जोड़ी: दस्तावेज़ को 56% 'मिक्स्ड' रेटिंग दी गई, जिससे संकेत मिलता है कि यह संभवतः AI-जनित या भारी AI-सहायता प्राप्त सामग्री थी जो सार्थक मानवीय समीक्षा से बच गई ।
जांच में चार प्रमुख संगठनों की पहचान हुई, जिनके नाम पर 'एजेंटिक AI' की फर्जी केस स्टडीज़ बनाई गई थीं :
प्रत्येक मामले में, उद्धरण या तो गैर-मौजूद रिपोर्टों की ओर इशारा करते थे, या असंबंधित वास्तविक प्रकाशनों के पैराफ्रेज़्ड शीर्षक थे, या इतने अस्पष्ट थे कि व्यावहारिक रूप से बेकार थे ।
GPTZero के विश्लेषण ने निष्कर्ष निकाला कि ये त्रुटियाँ संभवतः एक AI रिसर्च टूल के 'एजेंटिक AI' के वास्तविक दुनिया के उदाहरण खोजने के निर्देश का बहुत अधिक अनुपालन करने का परिणाम थीं। टूल ने प्रशंसनीय लेकिन पूरी तरह से काल्पनिक केस स्टडीज़ और उद्धरण तैयार किए, जो KPMG की समीक्षा प्रक्रिया से बिना सुधरे निकल गए ।
यह घटना एक महत्वपूर्ण कमजोरी को रेखांकित करती है: जब AI-जनित शोध को कठोर मानवीय सत्यापन के बिना प्रकाशित किया जाता है, तो यह आत्मविश्वासपूर्ण, आधिकारिक लगने वाली बकवास पैदा कर सकता है जो संस्थागत विश्वसनीयता को नुकसान पहुँचाता है ।
KPMG की वापस ली गई रिपोर्ट कोई अलग-थलग घटना नहीं है। यह प्रमुख कंसल्टिंग और कानूनी फर्मों में AI-संबंधी उद्धरण विफलताओं के बढ़ते पैटर्न में फिट बैठती है :
ये बार-बार होने वाली विफलताएं एक सिस्टमिक जोखिम को उजागर करती हैं: सख्त मानवीय निगरानी के बिना, AI शोध उपकरण ऐसे सबूत तैयार कर रहे हैं जो विश्वसनीय लगते हैं लेकिन जांच में बिखर जाते हैं। एक ऐसे उद्योग के लिए जो विश्वास और विशेषज्ञता बेचता है, गलती करने की कीमत डॉलर, प्रतिष्ठा और नियामक ध्यान में मापी जाती है। KPMG का मामला एक स्पष्ट चेतावनी है कि AI-सहायता प्राप्त कार्यप्रवाह में 'जाँच' वास्तविक, गहन और मानवीय होनी चाहिए।