GPTZero对报告45条引用的扫描揭示了系统性验证机制的失灵 :
总体而言,89%的参考文献被标记为有问题。GPTZero的AI检测扫描还揭示了另一个令人担忧的层面:整份文档被评级为 56%“混合”,这表明它很可能是AI生成或重度AI辅助撰写的内容,且未经过有效的人工审查 。
调查发现,报告引用了四家知名机构的所谓“自主AI”部署案例,但这些案例纯属虚构 :
在这些案例中,报告所附的引用要么指向不存在的报告,要么是无关真实出版物的改写标题,要么就是语焉不详到毫无用处 。
GPTZero的分析结论是,这些错误很可能是 AI研究工具为满足提示词中“寻找自主AI真实案例”的要求而“过度服从”的结果。该工具生成了听起来头头是道但实际上完全虚构的案例研究和引用,而KPMG的审查流程却未能拦截这些错误 。
这一事件暴露了一个关键漏洞:当AI生成的研究成果未经严格人工核实就被发表时,它会产生自信、权威但实则毫无意义的胡言乱语,最终严重损害机构公信力 。
KPMG报告的撤回远非个例。它反映了一个在各大咨询公司和律所中愈演愈烈的趋势——与AI相关的引用失败 :
这些重复发生的失误突显了一个系统性风险:在缺乏严格人工监督的情况下,AI研究工具生成的内容看似可信,但一经核查便漏洞百出。对于一个以“信任”和“专业”为产品的行业来说,犯错的代价不仅是金钱损失,更是声誉和监管风险。KPMG案例清楚地表明:在AI辅助的工作流程中,那个“核查”环节必须是真实的、彻底的,并且必须由人来完成。