הדוח הראשון של OpenAI על שימוש בני נוער הציג את ChatGPT for Teens כשירות שמשמש בדרך כלל לפרקי זמן קצרים, לעיתים קרובות לצורכי למידה. לפי החברה, בני נוער משתמשים ב-ChatGPT פחות מ־15 דקות ביום בממוצע, ופחות מ־2% מהם משתמשים בו יותר משלוש שעות ברציפות. אבל הנתונים האלה לא מלמדים אם ההגנות פועלות עבור בני הנוער שמשתמשים בשירות בהיקף הרב ביותר. בבדיקה נפרדת, שהתבססה על יותר מ־4,000 prompts, מכון Youth AI Safety Institute של Common Sense Media דירג את השירות כ״סיכון בלתי מתקבל על הדעת״ לילדים מתחת לגיל 18.
17
20
6
מה OpenAI דיווחה על השימוש
OpenAI מסרה שכמעט במחצית מהשיחות שבהן הופיעה תזכורת להפסקה, המשתמש או המשתמשת יצאו להפסקה או סיימו את השיחה בתוך חמש דקות. החברה גם תיארה פעילות הקשורה ללמידה כשימוש מרכזי, לרבות במפגשים ארוכים יותר. אלה נתונים שהחברה דיווחה על דפוסי שימוש ועל התגובה לתזכורות; כשלעצמם, הם אינם מוכיחים שבני נוער מוגנים מפגיעה או ששיחות ארוכות בטוחות.
17
20
למה ארגוני בטיחות הטילו ספק במשמעות הנתונים
הארגונים Design It For Us, Fairplay ו-Common Sense Media תהו עד כמה הממוצעים מלמדים, כל עוד אין שקיפות ברורה יותר ואימות עצמאי. החשש שלהם הוא שממוצע נמוך עלול להסתיר קבוצה קטנה יותר של משתמשים כבדים — ואת מה שמתרחש בשיחות שלהם. הם קראו לבחון מקרוב את 10% המשתמשים הכבדים ביותר: כמה זמן בני הנוער האלה נשארים בשירות ועל מה הם משוחחים.
1
הארגונים השוו את המחלוקת לביקורת שנמתחה על האופן שבו Meta הציגה נתוני שימוש של צעירים, על רקע תביעות וחששות רחבים יותר בנוגע לבריאות הנפש של בני נוער. לטענתם, אין להתייחס לנתוני שימוש שהחברה בוחרת ומפרסמת בעצמה כאל הוכחה עצמאית לבטיחות.
1
אחת ההערכות שהוזכרו בדיון טענה שגם שיעור של פחות מ־2% עשוי להתבטא בכחצי מיליון משתמשים כבדים. מדובר בהערכה של היקף אפשרי, ולא בספירה שאומתה בנפרד: אחוז לבדו אינו מבהיר כמה בני נוער מדובר בלי מכנה מאומת.
1
מה מצאו בבדיקות הבטיחות
Youth AI Safety Institute מסר שבדק יותר מ־4,000 prompts, לפני השקת חוויית השימוש לבני נוער ואחריה. בבדיקות המכון, חשבונות חדשים שקושרו לחשבון של הורה לא הפעילו התראות להורים במהלך שיחות שנמשכו עד שעה ועסקו בהתאבדות, בפגיעה עצמית או בהפרעות אכילה. לפי המכון, התראות הופיעו בחשבונות שבהם כבר הצטברו שבועות של שיחות רגישות.
5
6
עוד דיווח המכון כי ביותר מאחד מכל ארבעה מצבים שהמומחים הקליניים שלו קבעו שמצדיקים הפניה לגורם סיוע במשבר, לא ניתנה הפניה כזו. בנפרד, הבודקים מצאו שניתן לעקוף את ההגנות שנועדו לסייע בהכנת שיעורי בית, וש-ChatGPT עדיין יכול להשלים מטלות גם כשהופיעו תזכורות הקשורות ל-Study Mode. הדירוג משקף את ממצאי הבדיקה, ולא מדידה של שכיחות המקרים האלה בכלל השיחות של בני נוער.
2
12
תגובת OpenAI והשאלה שנותרה פתוחה
המכון קרא להגביל את הגישה למבוגרים בלבד, עד שההגנות יפעלו כפי שתוארו וייבדקו באופן עצמאי. OpenAI מסרה שהגדרות בקרת הורים וההתראות עשויות להיכנס לתוקף רק כעבור שעות מרגע קישור החשבונות, והציגה זאת כהסבר לחלק מההתראות שלא התקבלו. החברה גם אמרה שהיא מתכננת לפרסם מחקר מקיף יותר ולעבוד עם חוקרים עצמאיים מצד שלישי.
1
המחלוקת, אם כן, אינה רק על זמן השימוש הממוצע. הנתונים של OpenAI מתארים דפוסי שימוש כלליים; הבדיקות של Common Sense Media בחנו מנגנוני בטיחות במצבי סיכון מוגבר. מחקר עצמאי על המשתמשים הכבדים ביותר ועל תפקוד ההגנות עשוי לספק תשובות שהממוצעים לבדם אינם נותנים.
1
6