מערכת ההטעיה של r/poisonai בנתה שלוש שכבות של ראיות כוזבות שעוצבו להיראות כאירוע חדשותי לגיטימי:
תכונת AI Search Assist של DuckDuckGo (Duck.ai) סיפרה למשתמשים בביטחון שטראמפ מת מכלבת ב-7 ביוני 2026, וכי ואנס מת לפניו . היא הפיקה תיבת תשובה מלאה ובטוחה שציטטה את המאמרים המזויפים של WKNA News לצד מאמר אמיתי ולא קשור של ABC News על קורבן כלבת באוהיו כ"ראיה"
. גם מנוע החיפוש המופעל על ידי AI של Brave נפל לאותה מתיחה וחזר על הנרטיב המפוברק
.
שתי מערכות ה-AI בלעו את התוכן השתול מ-Reddit ומאתר החדשות המזויף, ואז הציגו אותו כאמת מכיוון שהנרטיב נראה מאומת על פני מספר מקורות ממופתחים .
מחקר מקדים מ-חוקרי Cornell Tech (Tingwei Zhang, Harold Trieu ועמיתיהם), שפורסם ב-arXiv במאי 2026, מסביר ישירות את הפגיעות שנוצלה על ידי r/poisonai . המאמר – שכותרתו "ניתן להרעיל סוכני מחקר עמוקים באמצעות תוכן גולשים" (Deep-Research Agents Can Be Poisoned via User-Generated Content) – הציג מתקפה בשם WARP (Web Agent Retrieval Poisoning)
.
ממצאים מרכזיים מהמחקר כוללים:
מסע הפרסום של r/poisonai הוא הדגמה בעולם האמיתי של הפגיעות המדויקת שמתאר המאמר של Cornell Tech. תת-הפורום ניצל את אותו מנגנון – סוכני חיפוש AI שבולעים באופן נרחב ובוטחים בתוכן גולשים מבלי להבחין בינו לבין מקורות סמכותיים . מכיוון שסוכני מחקר AI מגרדים את Reddit, אתרים בעלי אמינות נמוכה ופורומים כמקורות בכמחצית מכל השאילתות, קמפיין זריעה מתואם על פני מספר שרשורים יצר מראה של קונצנזוס, שה-AI התייחס אליו כאישוש
.
האירוע מוכיח שהממצא של Cornell Tech אינו תוצר מעבדה: אותה טכניקת הרעלה בת 13 מילים, שהוגברה עם שרשורים מרובים ואתר סליים ורוד, פגעה בהצלחה במערכות AI ייצוריות שבהן משתמשים מיליוני אנשים .
המתיחה הצליחה מכיוון שכלי חיפוש AI אינם יכולים להבחין באופן אמין בין דיון אמיתי של משתמשים לבין קמפיינים מתואמים של מידע כוזב, במיוחד כאשר תוכן שקרי מוצלב במספר מקורות שנראים בלתי תלויים . אתר WKNA News עדיין מארח את המאמרים המפוברקים, מה שמוכיח עד כמה תוכן מורעל זה מתמיד באינטרנט הממופתח
. גם DuckDuckGo וגם Brave הודו באירוע, אך הפגיעות הבסיסית – סוכני AI המתייחסים ל-UGC כאל סמכותי – נותרה ללא תיקון ברמה הארכיטקטונית
.