GPTZero gick igenom rapportens 45 hänvisningar och beskrev ett systematiskt kontrollmisslyckande :
Sammantaget markerades 89 procent av källförteckningen som bristfällig. GPTZeros AI-analys klassade dessutom dokumentet som 56 procent ”blandat”, vilket enligt verktyget tyder på att texten sannolikt var AI-genererad eller kraftigt AI-assisterad utan tillräcklig mänsklig granskning .
Granskningen identifierade fyra välkända organisationer som i rapporten användes som exempel på införande av agentisk AI, trots att uppgifterna inte kunde verifieras .
I fallen pekade hänvisningarna antingen på rapporter som inte existerade, på omskrivna titlar till verkliga men orelaterade publikationer eller på så vaga referenser att de i praktiken var oanvändbara .
GPTZero bedömde att felen sannolikt uppstod när ett AI-baserat researchverktyg överanpassade sig till en uppmaning att hitta verkliga exempel på ”agentisk AI”. Verktyget genererade fallstudier och källhänvisningar som lät trovärdiga men var påhittade. Därefter passerade materialet KPMG:s granskningsprocess utan att felaktigheterna rättades .
Händelsen visar en central risk med AI-assisterad research: språkmodeller kan formulera säkra och auktoritativa påståenden även när underlaget inte finns. Om ingen människa kontrollerar varje viktig uppgift mot originalkällan kan resultatet bli övertygande nonsens – med skadat förtroende som följd .
Den indragna KPMG-rapporten ingår i ett bredare mönster av AI-relaterade källhaverier inom konsult- och juristbranschen .
För konsultföretag som säljer expertis och förtroende är detta mer än ett tekniskt misstag. Kostnaden kan räknas i pengar, anseende och ökad granskning från myndigheter och kunder.
KPMG-fallet understryker därför en enkel men avgörande princip: kontrollsteget i ett AI-assisterat arbetsflöde måste vara verkligt, grundligt och utfört av människor.