Daarmee is PwC de laatste van de vier grote internationale accountants- en advieskantoren — de zogenoemde Big Four — die in onderzoeken van GPTZero met vergelijkbare problemen in verband wordt gebracht. Eerder kwamen Deloitte, Ernst & Young (EY) en KPMG aan de beurt .
GPTZero analyseerde de rapporten met zijn tools Hallucination Check en AI Detector . De onderzoekers zagen in alle vier de documenten aanwijzingen voor onzorgvuldig AI-gebruik:
De problemen gingen verder dan een paar slordige links. De rapporten bevatten volgens GPTZero foutieve bronvermeldingen, verkeerd toegeschreven beweringen, verzonnen bronnen en statistische gegevens die niet met de oorspronkelijke bronnen overeenkwamen .
Een opvallend spoor stond in een van de citaten: de URL bevatte de parameter ‘utm_source=chatgpt.com’. Dat wijst erop dat een ChatGPT-link mogelijk rechtstreeks in het rapport is beland, zonder dat iemand de bron handmatig controleerde . De onderzoekers meldden ook dat een vermeend praktijkvoorbeeld over het gebruik van agentic AI door J.P. Morgan was gebaseerd op een tienerblogger met 280 volgers op Medium .
De bevindingen volgen op eerdere onderzoeken van GPTZero naar de andere grote advieskantoren:
Volgens GPTZero is PwC daarmee het vierde en laatste Big Four-kantoor dat in deze reeks onderzoeken is getroffen .
PwC Middle East had op het moment van publicatie de specifieke bevindingen niet publiekelijk bevestigd. De vier rapporten bleven na het verschijnen van het onderzoek online beschikbaar . Het bredere PwC-netwerk trok de documenten evenmin direct in en publiceerde niet meteen correcties .
Dat betekent niet dat GPTZero’s AI-scores op zichzelf bewijzen dat elk onderdeel door een taalmodel is geschreven. De kritiek draait vooral om de combinatie van detectiescores met concrete, controleerbare fouten: niet-bestaande bronnen, foutieve verwijzingen en claims waarvoor geen bewijs kon worden gevonden.
De timing maakte de kwestie extra pijnlijk. Op dezelfde dag waarop het onderzoek verscheen, waarschuwde PwC’s Amerikaanse CEO Paul Griggs bedrijven in een interview met Business Insider voor twee misverstanden over AI .
Volgens Griggs is AI in de eerste plaats geen gewone technologische vernieuwing. Bedrijven die AI uitsluitend bij de CIO of CTO neerleggen, missen volgens hem de bredere kans. Hij pleitte ervoor AI te zien als een grootschalige bedrijfstransformatie waarbij alle medewerkers en processen betrokken zijn .
Zijn tweede waarschuwing: AI repareert geen gebrekkige organisatie. “If you're layering it on top of messy processes, all AI is going to do for you is tell you how bad your messy process really is,” zei Griggs . Vrij vertaald: wie AI boven op rommelige processen legt, krijgt vooral sneller te zien hoe rommelig die processen zijn.
Die boodschap stond haaks op de beschuldigingen aan het adres van PwC Middle East. Terwijl de Amerikaanse topman waarschuwde tegen het afdekken van slechte processen met AI, leek de regionale tak volgens GPTZero precies dat te hebben gedaan: AI-gegenereerde inhoud publiceren zonder voldoende menselijke redactie en broncontrole .
In maart 2026 had Griggs bovendien gezegd dat PwC-partners die AI niet omarmen “niet zo lang meer” bij de firma zouden blijven . De controverse roept daardoor een ongemakkelijke vraag op: hoe geloofwaardig is AI-expertise wanneer een adviesrapport over AI zelf aantoonbaar onbetrouwbare informatie bevat?
De zaak gaat niet alleen over vier PwC-documenten. Thought leadership is bedoeld om expertise uit te stralen en nieuwe adviesopdrachten binnen te halen . Als zulke rapporten verzonnen voetnoten of niet-bestaande casussen bevatten, raakt dat rechtstreeks aan het vertrouwen waarop professionele dienstverlening is gebaseerd.
GPTZero omschrijft de praktijk waarbij bronnen slechts losjes bij een onderwerp worden gezocht en niet daadwerkelijk worden gecontroleerd als ‘vibe citing’ . De Financial Times, die de bevindingen verifieerde, noemde de fouten niet subtiel . De terugkerende incidenten bij alle vier de Big Four laten daarmee vooral een probleem in kwaliteitscontrole zien: AI kan overtuigend klinkende tekst produceren, maar zonder menselijke verificatie kan die tekst ook fictieve feiten een professioneel uiterlijk geven.