GPTZero掃描報告45條引述後,發現一個系統性嘅驗證失敗 :
整體而言,89%嘅參考文獻被標記為有問題。GPTZero嘅AI檢測掃描仲揭示另一個隱憂,將份文件評為 56%「混合」,意味好大機會係AI生成或重度AI輔助嘅內容,而人類根本冇認真審查過 。
調查發現有四間知名機構被引用虛構嘅「代理AI」案例 :
每個案例嘅引述都指向唔存在嘅報告,或者係唔相關嘅真實出版物嘅改版標題,又或者係一啲廢到冇用嘅模糊參考 。
GPTZero分析認為,錯誤好大機會係源自一個AI研究工具太聽話,為咗滿足「搵代理AI真實案例」嘅指令,結果生咗一堆聽落似層層但完全虛構嘅案例同引述,而呢啲嘢就咁通過咗KPMG嘅審查程序,冇人改正 。
呢單嘢揭示咗一個關鍵弱點:當AI生成嘅研究冇經嚴格人手核實就出版,可以產生自信滿滿但權威嘅廢話,嚴重損害機構嘅公信力 。
KPMG份被撤回嘅報告絕對唔係單一事件。佢係緊跟住一系列喺顧問同律師行出現嘅AI引用失誤 :
呢啲重複嘅失誤凸顯一個系統性風險:冇嚴格人手監督嘅AI研究工具,正喺度產生睇落可信但一查就散嘅證據。對於一個賣信任同專業知識嘅行業嚟講,搞錯嘅代價係用金錢、聲譽同監管關注去量度嘅。KPMG呢單嘢係一個清楚嘅警告:AI輔助工作流程入面嘅「檢查」環節,一定要係真實、徹底、同埋由人去做嘅。