404 Media דיווחה ב־15 בספטמבר 2026 כי „פרויקט לילי” של OpenAI מפעיל מאות קבלנים חיצוניים הבוחנים שיחות אמיתיות של משתמשי ChatGPT, לעיתים עם הקשר אישי ורגיש. לפי הדיווח, הבודקים מסכמים את כוונת המשתמש, משווים בין ארבע תשובות אפשריות ומדרגים אותן בסולם 1–7, במטרה להפוך את ChatGPT לפחות רובוטי, פחות מתרפס ויותר אמין.
פורסם על ידינערך באמצעות GPT-5.6 Terraהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation published on September 15, 2026, reveal about OpenAI’s secret “Project Lily,” including how hundreds of. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses a large outsourced human-feedback operation to improve ChatGPT using real consumer conversations—not merely public web data or synthetic tests. The report is . Topic tags: general, general web, academic, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
תחקיר של 404 Media על המיזם הפנימי של OpenAI, „פרויקט לילי”, מתאר מערך משוב אנושי הנשען על שיחות אמיתיות של משתמשי ChatGPT. לפי מסמכים שדלפו, דוגמאות להנחיות ותגובת החברה שנבחנו בתחקיר, קבלנים חיצוניים עשויים לקרוא את הקשר השיחה כדי להעריך את תשובות המודל — גם כאשר השיחות כוללות פרטים אישיים רגישים. 1
עבור מי שמשתמשים ב־ChatGPT להתייעצות אישית, רפואית, זוגית, משפטית או מקצועית, הנקודה המרכזית פשוטה: בקשה בצ'אט כמו „שמור את זה בינינו” אינה הגדרת פרטיות ואינה מגבלת גישה. ההגדרה הרלוונטית היא האם החשבון מאפשר להשתמש בשיחות חדשות לשיפור המודל. 1
404 Media דיווחה כי מאות קבלנים, המועסקים דרך חברות כוח אדם ומשתכרים יותר מ־50 דולר לשעה, בודקים זרם גדול של שיחות ChatGPT אמיתיות. לפי הדיווח, המשימות שלהם כוללות:
קריטריוני ההערכה נועדו לשפר את האיכות והטון של תשובות ChatGPT. הבודקים מתבקשים, לפי הדיווח, לסמן ניסוחים שנשמעים „כמו בינה מלאכותית”, טעויות עובדתיות, שפה מתרפסת או מסכימה מדי, בעיות בטיחות, ותשובות שיוצרות מצג שווא שלפיו למודל יש חוויות או רגשות אישיים. 1
מטרת מעגל המשוב היא להפוך את התשובות לטבעיות ופחות מכניות. עם זאת, שיפור כזה עשוי לכלול גישה אנושית לתוכן השיחות של המשתמשים. 1
OpenAI מסרה ל־404 Media ששמות משתמש מוסרים ושמופעל „מסנן פרטיות” לפני שהחומר מועבר לבודקים. ואולם, התחקיר מצא דוגמאות שבהן חומרי הבדיקה עשויים לכלול את מלוא הקשר השיחה וסיכומי זיכרון שנוצרו בידי המודל. לפי הדיווח, סיכומים כאלה כללו פרטים כגון מיקום משוער, מקצוע ונסיבות אישיות מאוד. 1
הבעיה היא זיהוי מתוך הקשר. אפשר להסיר שם או מזהה חשבון, אך צירוף של אירועי חיים, פרטי עבודה, אזור גאוגרפי או אזכורים חריגים עדיין עלול להפוך שיחה לניתנת לזיהוי עבור מי שמכיר את האדם — או לכל הפחות לחשוף מידע רגיש. 404 Media דיווחה כי OpenAI הכירה בכך שמסננים מתקשים לעיתים לזהות מזהים נדירים או אזכורים פרטיים עמומים שתלויים בהקשר. 1
הוראה ל־ChatGPT לשמור דיון בסוד היא חלק מתוכן השיחה, ולא העדפת פרטיות של החשבון. היא אינה גוברת על הגדרות השימוש בנתונים ואינה מונעת מהשיחה להיבחר לתהליך שיפור מהסוג שתיארה 404 Media. 1
לכן, לא כדאי להתייחס לצ'אט צרכני כאל ערוץ סודי רק משום שהשיחה מרגישה אישית. אם חשיפת המידע לבודק מורשה עלולה להזיק, בטוח יותר שלא להזין אותו למרחב אישי שבו שיפור המודל מופעל.
לפי תיעוד Data Controls של OpenAI, משתמשים במרחב אישי יכולים לבטל את שיפור המודל כך:
כאשר ההגדרה כבויה, שיחות חדשות נשארות בהיסטוריית הצ'אטים, אך אינן משמשות לאימון או לשיפור מודלי ChatGPT. ההגדרה חלה על החשבון כולו, ולא על מכשיר מסוים.
לתזמון יש חשיבות: OpenAI מציינת שהוויתור חל על שיחות חדשות. הוא אינו מסיר בדיעבד שיחות שכבר נמסרו בזמן שהאפשרות לשיפור המודל הייתה פעילה.
OpenAI מצהירה כי כברירת מחדל היא אינה משתמשת בקלטים ובפלטים מ־ChatGPT Business, Enterprise, Edu או מפלטפורמת ה־API שלה לאימון המודלים. לעומת זאת, במרחבים אישיים של משתמשי ChatGPT Free, Plus ו־Pro, שיתוף לצורך שיפור המודל מופעל כברירת מחדל — אך ניתן לבטלו דרך Data Controls.
ההבחנה הזאת אינה פוטרת ארגונים מחובות אבטחת מידע וממשל נתונים. צוותים עדיין צריכים לפעול לפי מדיניות המעסיק ולבדוק את הגדרות סביבת העבודה הספציפית. אבל זהו הבדל מהותי לעומת ברירת המחדל של צ'אטים צרכניים.
סקירה אנושית אינה ייחודית ל־OpenAI. במדיניות הפרטיות של Anthropic נכתב כי החברה עשויה לאמן ולשפר את המודלים שלה באמצעות קלטים ופלטים שמספקים משתמשים או עובדי קהל, אלא אם המשתמשים מבטלים זאת. גם סקירה אקדמית של נוהלי הפרטיות אצל ספקיות AI גדולות מצאה כי Google ו־OpenAI מתייחסות לשימוש בבדיקה אנושית של שיחות משתמשים לצורך אימון או שיפור.
השאלה הרחבה אינה אם קיים משוב אנושי, אלא אם המשתמשים מבינים מתי השיחות שלהם עשויות להיכנס לתהליך הזה, מה טשטוש מזהים יכול ואינו יכול להגן עליו, וכיצד משנים את ההגדרות הרלוונטיות.
„פרויקט לילי”, כפי שתואר בדיווח של 404 Media, מזכיר שצ'אט AI צרכני אינו בהכרח שיחה חסויה אחד־על־אחד. אמצעי הסרת זיהוי עשויים לצמצם את החשיפה, אך לא בהכרח למחוק כל פרט מסגיר משיחה עשירה בהקשר אישי. 1
לפני שמזינים מידע רגיש ל־ChatGPT, בדקו את הנתיב הגדרות ← Data Controls ← Improve the model for everyone. אם שיפור המודל פעיל, התייחסו לשיחות חדשות ככאלה שעשויות להיות כשירות לשימוש בשיפור השירות; אם הוא כבוי, OpenAI אומרת ששיחות חדשות לא ישמשו למטרה זו.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
404 Media דיווחה ב־15 בספטמבר 2026 כי „פרויקט לילי” של OpenAI מפעיל מאות קבלנים חיצוניים הבוחנים שיחות אמיתיות של משתמשי ChatGPT, לעיתים עם הקשר אישי ורגיש.
404 Media דיווחה ב־15 בספטמבר 2026 כי „פרויקט לילי” של OpenAI מפעיל מאות קבלנים חיצוניים הבוחנים שיחות אמיתיות של משתמשי ChatGPT, לעיתים עם הקשר אישי ורגיש. לפי הדיווח, הבודקים מסכמים את כוונת המשתמש, משווים בין ארבע תשובות אפשריות ומדרגים אותן בסולם 1–7, במטרה להפוך את ChatGPT לפחות רובוטי, פחות מתרפס ויותר אמין.
OpenAI מסרה כי שמות משתמש מוסרים ומופעל מסנן פרטיות, אך 404 Media מצאה שפרטי הקשר וסיכומי זיכרון עשויים עדיין לכלול מידע אישי רגיש.