הממצאים, שאומתו גם בדיווח של ה־Financial Times, מציבים את PwC כחברת ה־Big Four האחרונה — אחרי Deloitte, EY ו־KPMG — שנקשרה בפרסום חומר שנוצר או נערך בעזרת AI ללא בקרת איכות אנושית מספקת .
צוות GPTZero השתמש בכלי Hallucination Check ובכלי לזיהוי תוכן שנוצר ב־AI כדי לבחון ארבעה דוחות של PwC Middle East . לפי הבדיקה, בכל הדוחות הופיעו סימנים לשימוש בעייתי בבינה מלאכותית:
“Transforming Governance: Citizen Pulse” (2025): הדוח קיבל הסתברות של 84% לכך שנוצר כולו באמצעות AI, בעוד שהטקסט המרכזי שלו סווג כ־100% תוכן שנוצר ב־AI . הדוח הציג מתודולוגיה בשם Citizen Pulse, וטען שממשלות בדנמרק, בערב הסעודית, בארצות הברית ובאוסטרליה משתמשות בה. GPTZero לא מצאה ראיות ציבוריות רבות לכך שמדובר במוצר רשמי של PwC, והגיעה למסקנה שנראה כי הדוח “הז hallucinated” — כלומר המציא — גם מוצר שלם וגם קשרים עסקיים עם ארבע מדינות .
“Shaping the GCC Mobility Landscape” (2026): הדוח סווג כ־82% “מעורב” בבדיקת GPTZero, וכלל ציטוטים שנראו מומצאים וטענות שלא ניתן היה לאמת .
“Building a Cyber-Resilient eMobility Ecosystem” (2025): קיבל ציון של 60% תוכן שנוצר ב־AI או תוכן מעורב, וכלל הערות שוליים ומקורות שנראו מפוברקים .
“Agentic AI – The New Frontier in GenAI” (2024): קיבל ציון של 50% תוכן שנוצר ב־AI או תוכן מעורב, ובו נמצאו הפניות שנראו כמו מקורות שהומצאו .
בארבעת הדוחות נמצאו הערות שוליים מזויפות, טענות שיוחסו לגורמים הלא נכונים, מקורות מומצאים ונתונים סטטיסטיים שלא ניתן היה לאמת .
הפרט הבולט ביותר הופיע באחת ההפניות: כתובת האינטרנט כללה את הפרמטר “utm_source=chatgpt.com”. מדובר בפרמטר מעקב שמופיע בקישורים שנוצרים במסגרת שיתוף או הפניה מתוצרי ChatGPT, והימצאותו בציטוט הוצגה כראיה לכך שהקישור הועתק מפלט של ChatGPT בלי בדיקה אנושית מספקת .
החוקרים מצאו גם שסיפור הצלחה על השימוש של J.P. Morgan ב־AI סוכני (agentic AI) הסתמך על פוסט של בלוגר מתבגר בעל 280 עוקבים בלבד ב־Medium .
החקירה נגד PwC היא הרביעית בסדרת בדיקות של GPTZero נגד ארבע חברות הייעוץ והחשבונאות הגדולות בעולם:
כעת PwC היא החברה הרביעית והאחרונה ב־Big Four שנקשרה בחקירות GPTZero מסוג זה .
נכון למועד הפרסום, PwC Middle East לא אישרה בפומבי את הממצאים הספציפיים של GPTZero. הדוחות נותרו זמינים ברשת גם לאחר פרסום החקירה . גם תגובת רשת PwC הרחבה הייתה מוגבלת, והחברה לא הסירה או תיקנה מיד את ארבעת הדוחות .
באותו יום שבו פורסמה החקירה, 29 ביולי 2026, העניק מנכ״ל PwC בארצות הברית, פול גריגס, ראיון ל־Business Insider ובו הזהיר חברות מפני שתי תפיסות שגויות בנוגע ל־AI .
לדברי גריגס, הטעות הראשונה היא להתייחס ל־AI כאל פרויקט טכנולוגי בלבד. חברות שמגבילות את הטמעת הבינה המלאכותית לתחומי האחריות של מנהל מערכות המידע או מנהל הטכנולוגיות “ימשיכו להיתקל במכשולים”, במקום להתייחס ל־AI לשינוי עסקי רחב היקף שמערב את כלל העובדים והתהליכים .
הטעות השנייה, לדבריו, היא לחשוב ש־AI יכול לתקן לבדו עסק או תהליך מקולקל. “אם אתם מניחים אותו על גבי תהליכים מבולגנים, כל מה שה־AI יעשה עבורכם הוא להראות לכם עד כמה התהליך המבולגן שלכם גרוע”, אמר .
כאן נוצרה האירוניה: בכיר PwC הזהיר חברות שלא להדביק AI על תהליכים פגומים, בעוד שהחטיבה המזרח־תיכונית של אותה רשת הואשמה בפרסום דוחות שנוצרו באופן רשלני, בלי בדיקת מקורות ובלי פיקוח אנושי מספק .
במרץ 2026 אמר גריגס ל־Financial Times ששותפים ב־PwC שלא יאמצו גישה של “AI תחילה” “לא יישארו כאן זמן רב”, במסגרת מסר רחב שלפיו על אנשי החברה להסתגל לטכנולוגיה . המקרה הנוכחי מחדד את הפער בין הדרישה לאמץ AI במהירות לבין האחריות לבדוק את התוצרים שהוא מייצר.
הדוחות שנבדקו לא היו מסמכים פנימיים בלבד. מדובר בדוחות “מנהיגות רעיונית” שנועדו לחזק את המוניטין של PwC ולייצר עבודה עבור צוותי הייעוץ שלה במזרח התיכון . לכן, טעויות במקורות ובמקרי בוחן עלולות לפגוע לא רק באמינות הדוח, אלא גם באמון של לקוחות שמסתמכים על מומחיותן של חברות הייעוץ.
החקירה גם מצביעה על תופעה ש־GPTZero מכנה “Vibe Citing”: צירוף הפניות שנראות קשורות לנושא, בלי לוודא שהן אכן תומכות בטענה. לפי ה־Financial Times, השגיאות בדוחות לא היו עדינות או קשות במיוחד לזיהוי .
המסר הרחב יותר עבור ענף הייעוץ ברור: שימוש ב־AI יכול להאיץ כתיבה ומחקר, אך הוא אינו מחליף אימות מקורות, עריכה מקצועית ואחריות אנושית — במיוחד כאשר המסמך מוצג כמחקר של חברה שמוכרת ללקוחותיה מומחיות בתחום הבינה המלאכותית.