לפי 404 Media, מאות קבלנים, ששכרם דווח כיותר מ־50 דולר לשעה, בחנו שיחות ChatGPT אמיתיות, סיכמו את כוונת המשתמש ודירגו ארבע תשובות בסולם 1–7. בחשבון אישי במסלולי Free, Plus ו־Pro אפשר לכבות את „Improve the model for everyone” דרך הגדרות בקרות נתונים, כדי ששיחות חדשות לא ישמשו לשיפור המודלים.
פורסם על ידינערך באמצעות GPT-5.6 Terraהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation reveal about OpenAI’s secret “Project Lily,” including how hundreds of contractors paid more than $50 p. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses outside human reviewers to evaluate real ChatGPT exchanges for model improvement—not merely synthetic test data. The investigation raises a privacy concern be. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
תחקיר של 404 Media על יוזמה פנימית ב־OpenAI בשם Project Lily מתאר מערך משוב אנושי מובנה המבוסס על שיחות ChatGPT אמיתיות. שאלת הפרטיות אינה מסתכמת בכך ששיחות עשויות לשמש לשיפור מודלים: לפי הדיווח, קבלנים חיצוניים יכלו לקרוא תכנים שהוסר מהם שם המשתמש, אך עדיין כללו לעיתים הקשר אישי מאוד. 2
על פי חומרים פנימיים שהגיעו לידי 404 Media, OpenAI גייסה מאות קבלנים דרך חברות כוח אדם כדי לבחון פרומפטים אמיתיים ותשובות של ChatGPT. לפי הדיווח, התשלום היה יותר מ־50 דולר לשעה. הבודקים התבקשו לסכם את כוונת המשתמש, להשוות בין ארבע תשובות אפשריות ולדרג אותן בסולם של 1 עד 7. 2
המטרה המדווחת הייתה לשפר את איכות התשובות: לגרום ל־ChatGPT להישמע פחות רובוטי, לצמצם טענות אנושיות מדי ולהפחית הסכמה מוגזמת או חנופה למשתמש. משוב אנושי הוא כלי מוכר בפיתוח מערכות בינה מלאכותית, אך שימוש בשיחות אמיתיות של משתמשים הופך את שאלת הפרטיות למוחשית יותר. 2
404 Media דיווחה שהבודקים קיבלו לעיתים תמלולים מלאים של חילופי הדברים, ובחלק מהמקרים גם סיכום זיכרונות משתמש. שמות המשתמשים לא הוצגו, אך ההקשר הזמין עשוי היה לחשוף מיקום משוער, מקצוע, תחומי עניין קודמים ונסיבות אישיות. 2
זהו הבדל מהותי: הסרת שם אינה הופכת שיחה בהכרח לאנונימית או לבלתי רגישה בפועל. שילוב של פרטי הקשר — למשל עיסוק, מצב משפחתי, בעיה בריאותית או אירוע חריג — עלול להיות רגיש גם בלי לזהות במישרין את בעל החשבון.
OpenAI מציגה את Privacy Filter כמודל שנועד לזהות ולהשחיר מידע מזהה אישי בטקסט. 46
47
בהקשר של פרויקט לילי, החברה מסרה כי היא הסירה שמות משתמשים והפעילה מסנן אוטומטי לפני שהתוכן הועבר לקבלנים. אולם 404 Media דיווחה כי פרטים רגישים עדיין יכלו להישאר בשיחות שנבדקו, למרות צעדים אלה. 2
זו מגבלה מוכרת של השחרה אוטומטית: מערכת יכולה לזהות ביתר קלות שם, כתובת דוא״ל או מספר טלפון, אך הרבה יותר קשה לה לזהות הקשר מצטבר שעלול לחשוף אדם או מידע רגיש עליו.
לפי הדיווח, ההנחיות לא עסקו רק בדיוק עובדתי. הקבלנים התבקשו לאתר, בין היתר:
הדגש על הסכמה מוגזמת חשוב במיוחד: מודל שממהר לאשר כל הנחה של המשתמש עשוי להישמע תומך, אך לא לאתגר הנחות שגויות, מסוכנות או מזיקות. לפי הדיווח, פרויקט לילי נועד בין השאר לכוונן את ההתנהגות הזו. 2
בקשה בתוך הפרומפט לשמור שיחה בסוד אינה משנה את הגדרות השימוש בנתונים של החשבון. זו פסקה בתוך השיחה, ולא הוראה טכנית שמחליפה את בקרות הנתונים של OpenAI.
במרחבי עבודה אישיים של ChatGPT, הבקרה המתועדת נקראת Improve the model for everyone. כשהיא מופעלת, שיחות עשויות לשמש לשיפור המודלים; כשמכבים אותה, OpenAI אומרת שלא תאמן את המודלים שלה על שיחות חדשות. 21
30
למשתמשים מחוברים, ההנחיות של OpenAI הן:
ההגדרה חלה על החשבון, ולא על מכשיר מסוים. היסטוריית השיחות הקיימת יכולה להישאר זמינה לאחר הכיבוי, אך OpenAI מציינת ששיחות חדשות לא ישמשו לאימון המודלים שלה. 19
30
אפשרות נוספת היא Do not train on my content בפורטל הפרטיות של OpenAI. לפי החברה, עבור משימות ChatGPT ו־Codex די באחת משתי האפשרויות — בפורטל או בבקרות הנתונים בתוך המוצר. 21
OpenAI מציינת שבמרחבי עבודה אישיים במסלולי Free, Plus ו־Pro, שיתוף הנתונים לצורכי אימון מופעל כברירת מחדל, אם כי אפשר לבטל אותו. עבור ChatGPT Business, Enterprise, Edu ופלטפורמת ה־API, החברה אומרת שקלטים ופלטים שנמסרו לה אינם משמשים לאימון המודלים כברירת מחדל. 23
הדבר אינו הופך כל שיחה עסקית לחסרת סיכון בכל היבט. ארגונים עדיין צריכים לבחון הגדרות מרחב עבודה, מדיניות שמירת מידע, בקרות שיתוף וכללים פנימיים לפני הזנת חומר סודי לכלי בינה מלאכותית.
פרויקט לילי, כפי שתואר בדיווח של 404 Media, הוא תזכורת לכך שכדאי להתייחס לצ'טים צרכניים עם בינה מלאכותית כשירות בעל הגדרות שימוש בנתונים — לא כאל ערוץ חסוי מטבעו. לפני שמזינים מידע אישי רגיש, מידע רפואי, משפטי, פיננסי או קנייני, הצעד המיידי הבטוח הוא לכבות את Improve the model for everyone לפני תחילת שיחה חדשה. 2
21
בחירה שלא להשתתף משפיעה, לפי OpenAI, על שימוש בשיחות חדשות לשיפור המודלים. היא אינה בקשת סודיות שמוטמעת בתוך הפרומפט, והתיעוד של החברה אינו מציג אותה כמנגנון למשיכת תוכן שכבר נשלח. 21
30
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
לפי 404 Media, מאות קבלנים, ששכרם דווח כיותר מ־50 דולר לשעה, בחנו שיחות ChatGPT אמיתיות, סיכמו את כוונת המשתמש ודירגו ארבע תשובות בסולם 1–7.
לפי 404 Media, מאות קבלנים, ששכרם דווח כיותר מ־50 דולר לשעה, בחנו שיחות ChatGPT אמיתיות, סיכמו את כוונת המשתמש ודירגו ארבע תשובות בסולם 1–7. בחשבון אישי במסלולי Free, Plus ו־Pro אפשר לכבות את „Improve the model for everyone” דרך הגדרות בקרות נתונים, כדי ששיחות חדשות לא ישמשו לשיפור המודלים.
לפי OpenAI, קלטים ופלטים של ChatGPT Business, Enterprise, Edu ופלטפורמת ה־API אינם משמשים לאימון מודלים כברירת מחדל.