A varredura da GPTZero nas 45 citações do relatório revelou uma falha sistemática de verificação :
No total, 89% da bibliografia foi sinalizada como falha. A detecção de IA da GPTZero adicionou outra camada preocupante, classificando o documento como 56% "misto" , o que sugere que ele foi provavelmente gerado ou fortemente auxiliado por IA, sem passar por uma revisão humana significativa .
A investigação identificou quatro organizações proeminentes citadas com estudos de caso fabricados de implantação de 'IA agêntica' :
Em cada caso, as citações apontavam para relatórios inexistentes, títulos parafraseados de publicações reais não relacionadas ou referências tão vagas que eram funcionalmente inúteis .
A análise da GPTZero concluiu que os erros foram provavelmente o resultado de uma ferramenta de pesquisa de IA que exagerou no cumprimento de um pedido para encontrar exemplos reais de 'IA agêntica' . A ferramenta gerou estudos de caso e citações que soavam plausíveis, mas eram inteiramente fictícios, que passaram pelo processo de revisão da KPMG sem correção .
O incidente ressalta uma vulnerabilidade crítica: quando pesquisas geradas por IA são publicadas sem verificação humana rigorosa, elas podem produzir absurdos com tom de autoridade que prejudicam a credibilidade institucional .
O relatório retirado da KPMG está longe de ser um caso isolado. Ele se encaixa em um padrão crescente de falhas de citação relacionadas à IA em grandes firmas de consultoria e advocacia :
Essas falhas repetidas destacam um risco sistêmico: sem supervisão humana rigorosa, as ferramentas de pesquisa de IA estão produzindo evidências que parecem críveis, mas que se desfazem sob escrutínio. Para uma indústria que vende confiança e expertise, o custo de errar é medido em dinheiro, reputação e atenção regulatória. O caso da KPMG serve como um alerta claro de que a 'checagem' em um fluxo de trabalho assistido por IA deve ser real, completa e humana.