Перевірка 45 цитат у звіті виявила систематичні порушення верифікації джерел :
Загалом GPTZero позначила як проблемні 89% бібліографії. Окреме визначення ймовірного використання ШІ оцінило документ як 56% «змішаний» — це вказує на ймовірний AI-генерований або суттєво AI-асистований текст, який не пройшов достатньої людської перевірки .
У розслідуванні йдеться про чотири великі організації, яким приписали непідтверджені приклади впровадження агентного ШІ .
У кожному випадку посилання вели до неіснуючих звітів, змінених назв реальних, але нерелевантних публікацій або настільки нечітких джерел, що перевірити їх було фактично неможливо .
GPTZero дійшла висновку, що проблема, ймовірно, виникла через надмірне виконання завдання AI-інструментом для пошуку прикладів «агентного ШІ» у реальному світі. Система могла згенерувати переконливі на вигляд, але вигадані кейси та посилання, які згодом не виявилися під час внутрішньої перевірки KPMG .
Цей випадок показує ключову вразливість AI-асистованих досліджень: без перевірки першоджерел модель може створити впевнений і авторитетний текст, наповнений неправдою. Для консалтингової компанії, що продає експертизу та довіру, наслідки такої помилки виходять далеко за межі технічної неточності .
Відкликаний звіт вписується в ширшу серію провалів із цитуванням у консалтинговій та юридичній сферах .
Повторюваність таких випадків свідчить про системний ризик для професійних послуг. ШІ може швидко підготувати матеріал, але не гарантує, що наведені в ньому цифри, твердження й посилання існують насправді.
Головний урок історії KPMG простий: у робочому процесі з використанням ШІ слово «перевірка» має означати не формальне схвалення, а ретельну перевірку кожного важливого твердження людиною та за першоджерелом.