GPTZero 對報告中 45 條引用文獻的掃描,揭示了一個系統性的驗證失敗 :
總體而言,報告中 89% 的參考文獻被標記為有問題。GPTZero 的 AI 偵測掃描更顯示,該文件有 56% 的機率是「混合」內容,這意味著它很可能是由 AI 生成或大量輔助,且未經充分的人類審查 。
調查發現,報告中引用了四個知名機構及其虛構的「代理型 AI」部署案例 :
在上述每個案例中,其引用要麼指向不存在的報告,要麼是與真實出版物無關的改寫標題,或是過於模糊以至於毫無價值的參考資料 。
GPTZero 的分析結論指出,這些錯誤很可能是 AI 研究工具為了過度滿足「尋找代理型 AI 真實案例」的提示,而憑空生成聽起來合理但完全虛構的案例和引用,並且這些內容在未經修正的情況下通過了 KPMG 的審查流程 。
這起事件凸顯了一個關鍵漏洞:當 AI 生成的研究在沒有經過嚴謹人工驗證下就被發表時,它可能會產出看似自信且權威、實則胡說八道的內容,進而嚴重損害機構的公信力 。
KPMG 此次報告的下架並非單一事件。它符合了各大顧問及律師事務所中,一系列與 AI 相關的引用錯誤模式 :
這些一再發生的失誤,凸顯了一個系統性的風險:在缺乏嚴格的人類監督下,AI 研究工具正在產出看似可信、但在審查下便會分崩離析的證據。對於一個以銷售信賴和專業知識為本的產業而言,犯錯的代價不僅是金錢損失,更是聲譽掃地和監管機構的關注。KPMG 的案例無疑是一個明確的警訊:在 AI 輔助的工作流程中,「核查」這一步必須是真實、徹底且由人類來執行的。