Проверка GPTZero 45 ссылок из отчёта выявила системный сбой верификации :
Итого: 89% библиографии было признано дефектной. Детектор ИИ от GPTZero добавил ещё один тревожный сигнал: документ был оценён на 56% как «смешанный» — это означает, что он, скорее всего, был сгенерирован или сильно доработан нейросетью, а затем опубликован без осмысленной проверки человеком .
Расследование выявило четыре крупные организации, которым приписали вымышленные кейсы внедрения «агентного ИИ» :
В каждом случае ссылки вели на несуществующие отчёты, перефразированные названия несвязанных реальных публикаций или были настолько расплывчаты, что не имели практической ценности .
Аналитики GPTZero пришли к выводу, что ошибки, скорее всего, возникли из-за того, что ИИ-инструмент для исследований «перестарался», выполняя запрос найти реальные примеры «агентного ИИ». Нейросеть сгенерировала правдоподобные, но полностью вымышленные кейсы и ссылки, которые не были отсеяны на этапе рецензирования .
Этот случай подчёркивает критическую уязвимость: когда результаты ИИ-генерации публикуются без тщательной проверки человеком, возникает уверенная, авторитетно звучащая бессмыслица, которая наносит удар по репутации любой организации .
Отозванный отчёт KPMG — далеко не единичный случай. Он вписывается в растущую череду ИИ-провалов в крупнейших консалтинговых и юридических фирмах :
Эти повторяющиеся сбои обнажают системный риск: без строгого контроля со стороны человека инструменты на базе ИИ генерируют «доказательства», которые выглядят убедительно, но рассыпаются при малейшей проверке. Для индустрии, которая продаёт доверие и экспертизу, цена ошибки измеряется не только деньгами, но и репутацией, а также пристальным вниманием регуляторов. История с KPMG — это чёткое предупреждение: «проверка» в рабочем процессе с использованием ИИ должна быть настоящей, тщательной и, главное, человеческой.