GPTZero analyseerde alle 45 citaties in het rapport en constateerde een structureel verificatieprobleem :
In totaal werd 89 procent van de bibliografie als gebrekkig aangemerkt. Een aanvullende AI-detectiescan beoordeelde het document als 56 procent ‘mixed’. Dat wijst volgens GPTZero op tekst die waarschijnlijk door AI is gegenereerd of er zwaar door is ondersteund, zonder dat een grondige menselijke controle de fouten eruit haalde .
De analyse wees vier bekende organisaties aan die in het rapport werden opgevoerd als voorbeelden van het gebruik van agentische AI . Voor de genoemde toepassingen kon GPTZero geen betrouwbare onderbouwing vinden:
De verwijzingen leidden volgens GPTZero naar niet-bestaande rapporten, naar aangepaste titels van andere publicaties of naar bronnen die te onduidelijk waren om te controleren .
GPTZero concludeerde dat de fouten waarschijnlijk ontstonden doordat een AI-onderzoekstool te gehoorzaam reageerde op een opdracht om echte voorbeelden van agentische AI te vinden. De tool zou vervolgens overtuigend klinkende, maar fictieve casestudy’s en bronverwijzingen hebben samengesteld. Die output zou daarna zonder voldoende menselijke controle in het KPMG-rapport zijn beland .
Daarmee wordt een fundamenteel probleem zichtbaar: een taalmodel kan een bronverwijzing produceren die professioneel en geloofwaardig oogt, maar bij controle nergens naartoe leidt. Zodra zulke informatie in een rapport van een gerenommeerd advieskantoor verschijnt, krijgt die schijn van betrouwbaarheid extra gewicht .
De KPMG-zaak staat niet op zichzelf. GPTZero beschrijft een breder patroon van AI-gerelateerde fouten in rapporten en juridisch werk van grote professionele dienstverleners .
De terugkerende fouten wijzen op een systemisch risico. AI kan onderzoek sneller maken, maar controleert niet vanzelf of een bron werkelijk bestaat, relevant is en de claim ondersteunt. Voor een sector die zijn reputatie bouwt op deskundigheid en vertrouwen, kunnen de gevolgen aanzienlijk zijn: financiële schade, reputatieverlies en extra aandacht van toezichthouders.
De belangrijkste les uit het ingetrokken KPMG-rapport is daarom niet dat bedrijven AI helemaal moeten vermijden. Wel moet elke AI-ondersteunde workflow een echte laatste controle bevatten — grondig, reproduceerbaar en uitgevoerd door mensen die de oorspronkelijke bronnen daadwerkelijk openen en verifiëren.