GPTZeroによる45の引用文献のスキャンでは、検証プロセスの組織的な失敗が明らかになりました。
全体として、参考文献の89%に問題があるとフラグが立てられました。GPTZeroのAI検出スキャンはさらに厄介な層を追加し、文書を**56%「混合」**と評価しました。これは、意味のある人間によるレビューを経ずにAIが生成または大幅に支援したコンテンツである可能性が高いことを示唆しています。
調査により、4つの著名な組織が「エージェンティックAI」導入に関する捏造された事例研究とともに引用されていることが特定されました。
それぞれのケースで、引用は存在しない報告書、無関係な実在出版物の言い換えられたタイトル、または実質的に無価値なほど曖昧な参照を指し示していました。
GPTZeroの分析は、これらの誤りは**「エージェンティックAI」の実例を見つけるよう求めるプロンプトに過剰に従ったAIリサーチツール**の結果である可能性が高いと結論付けました。ツールはもっともらしく聞こえるが完全に架空の事例研究と引用を生成し、それがKPMGのレビュープロセスを訂正されないまま通過したのです。
この事件は、AIが生成したリサーチが厳格な人間による検証なしに公開された場合、自信に満ちた権威あるように聞こえるナンセンスを生み出し、組織の信用を損なう可能性があるという重大な脆弱性を浮き彫りにしています。
KPMGの撤回されたレポートは決して孤立した事件ではありません。これは、主要なコンサルティング会社や法律事務所におけるAI関連の引用ミスの拡大パターンに当てはまります。
これらの繰り返される失敗は、体系的なリスクを浮き彫りにしています。厳格な人間の監督なしには、AIリサーチツールは信頼できるように見えながらも精査の下で崩壊する証拠を生み出しているのです。信頼と専門知識を売り物にする業界にとって、間違いを犯す代償は金銭、評判、そして規制当局の監視という形で計られます。KPMGのケースは、AI支援ワークフローにおける「チェック」は、現実的で、徹底的で、人間によるものでなければならないという明確な警告となっています。