Raporty miały wspierać działalność konsultingową PwC na Bliskim Wschodzie. Problem polegał jednak nie tylko na pojedynczych błędach redakcyjnych. GPTZero znalazło oznaki, że generatywna AI została wykorzystana bez odpowiedniej kontroli człowieka — także w dokumentach promujących kompetencje firmy właśnie w dziedzinie sztucznej inteligencji.
Zespół GPTZero wykorzystał narzędzia Hallucination Check i AI Detector do zbadania czterech publikacji PwC Middle East . Według analizy w każdym dokumencie występowały problemy z wiarygodnością źródeł lub prezentowanych informacji.
Szczególnie wymowny był jeden z adresów internetowych. W przypisie pozostał parametr „utm_source=chatgpt.com”, używany do śledzenia źródła ruchu. Jego obecność sugerowała, że adres skopiowano bezpośrednio z odpowiedzi ChatGPT, bez sprawdzenia go przez redaktora lub analityka .
GPTZero wskazało także na historię przedstawioną jako przykład rzeczywistego wykorzystania agentic AI przez J.P. Morgan. Według ustaleń badaczy źródłem tej historii był nastoletni bloger mający 280 obserwujących na platformie Medium .
PwC jest czwartą i ostatnią firmą z tak zwanej Wielkiej Czwórki — grupy największych globalnych firm audytorsko-konsultingowych — której raporty zostały objęte podobnym dochodzeniem GPTZero . Wcześniej analizowano publikacje:
W dniu publikacji dochodzenia PwC Middle East nie potwierdziło publicznie szczegółowych ustaleń dotyczących halucynacji. Raporty nadal były dostępne w internecie po opublikowaniu analizy . Szersza sieć PwC również nie zareagowała natychmiastowym wycofaniem ani korektą wszystkich czterech dokumentów .
Tego samego dnia, 29 lipca 2026 roku, prezes PwC US Paul Griggs udzielił wywiadu serwisowi Business Insider. Wskazał w nim dwa błędne założenia, które firmy często przyjmują w sprawie AI .
Po pierwsze, jego zdaniem AI nie jest wyłącznie transformacją technologiczną. Firmy, które ograniczają wdrażanie sztucznej inteligencji do kompetencji dyrektora IT lub CTO, będą nadal popełniać te same błędy. Griggs przekonywał, że AI należy traktować jako „transformację biznesową na dużą skalę”, obejmującą wszystkich pracowników i wszystkie procesy .
Po drugie, AI sama w sobie nie naprawi źle działającej organizacji. „Jeśli nałożysz ją na chaotyczne procesy, jedyne, co AI dla ciebie zrobi, to pokaże, jak złe są te chaotyczne procesy” — powiedział Griggs .
Zbieg okoliczności był trudny do przeoczenia. Prezes amerykańskiego PwC ostrzegał firmy przed nakładaniem AI na niesprawne procesy, podczas gdy dział PwC na Bliskim Wschodzie został oskarżony o publikowanie treści bez dostatecznej weryfikacji redakcyjnej .
W marcu 2026 roku Griggs mówił również „Financial Times”, że partnerzy PwC, którzy nie przyjmą AI, „nie będą tu długo” . Wypowiedzi te pokazywały skalę presji na wdrażanie podejścia AI-first w całej firmie — tym bardziej kłopotliwą w świetle zarzutów, że AI miała pomóc stworzyć nieistniejące produkty, klientów i źródła.
Dochodzenia GPTZero dotyczące wszystkich czterech firm z Wielkiej Czwórki podważają wiarygodność mechanizmów kontroli jakości w profesjonalnych usługach. Raporty „thought leadership” nie są zwykłymi wpisami na blogu: mają budować autorytet firmy i pomagać partnerom zdobywać zlecenia konsultingowe .
W branży pojawiło się określenie „vibe citing” — luźne dobieranie przypisów pasujących tematycznie do tekstu, ale bez sprawdzania, czy rzeczywiście potwierdzają dane twierdzenie . W tym przypadku błędy miały być na tyle wyraźne, że „Financial Times”, który zweryfikował ustalenia GPTZero, określił je jako „niedające się przeoczyć” .
Wniosek jest prosty: generowanie tekstu może przyspieszyć pracę, ale nie zastępuje sprawdzania źródeł. W raportach firm doradczych, które mają wpływać na decyzje zarządów i instytucji publicznych, jeden niezweryfikowany przypis może podważyć wiarygodność całego dokumentu.