OpenAI首次公布的青少年使用数据,呈现出一幅“每天用时不长、主要用于学习”的图景:青少年平均每天使用 ChatGPT 不到15分钟,连续使用超过3小时的比例不到2%。但平均用时并不能回答另一个关键问题:对那些用得最频繁的青少年来说,产品的安全保护是否真的有效?
17
20
同日,Common Sense Media旗下的Youth AI Safety Institute表示,在对4000多条提示进行测试后,将ChatGPT青少年版评为未满18岁用户的“不可接受的风险”。
6
OpenAI公布了哪些使用数据?
OpenAI称,在出现休息提醒的青少年对话中,近半数用户会在5分钟内暂停或结束聊天。公司还表示,学习相关活动在较长的使用时段中也很常见。
17
20
这些数字反映的是OpenAI报告的使用情况,以及用户对提醒的反应;它们本身并不能证明青少年已免受伤害,也无法说明长时间对话一定安全。
倡议组织为何质疑这些数字?
Design It For Us、Fairplay和Common Sense Media认为,如果缺少更透明的数据披露和独立核验,仅看整体平均值很难了解真实情况。低平均值可能掩盖少数高频用户的使用经历,因此他们主张重点审视使用最频繁的10%青少年:他们使用多久,又在对话中谈些什么。
1
这些组织还将此事与外界对Meta如何呈现青少年使用数据的质疑相提并论,并指出,在围绕青少年心理健康的担忧和诉讼持续受到关注之际,企业自行挑选和公布的使用数据,不应被当作独立的安全证明。
1
相关讨论中提到的一项估算称,不到2%的高频用户仍可能约有50万人。不过,这只是对潜在规模的估算,并非经过独立核实的用户人数;没有确认总体人数,仅凭百分比无法确定实际涉及多少青少年。
1
4000多条提示的测试发现了什么?
Youth AI Safety Institute称,测试覆盖了青少年版上线前后,共计4000多条提示。测试人员在新建且已关联家长账户的账号上,围绕自杀、自残或饮食失调等话题进行了最长一小时的对话,却没有收到家长提醒。该机构表示,收到提醒的情况出现在已有数周敏感话题对话记录的账号上。
5
6
该机构还报告称,临床审查人员判定需要提供危机转介的情境中,超过四分之一没有得到转介。另有测试发现,作业保护措施可以被绕过;即使出现与学习模式有关的提醒,ChatGPT仍可能直接完成作业。
2
12
需要区分的是,这些结果来自该机构设计的测试,并不代表上述情况在所有青少年对话中发生的频率。其“不可接受的风险”评级,是基于测试发现作出的评估,而非对所有用户实际经历的统计。
6
OpenAI如何回应?争议焦点在哪里?
Youth AI Safety Institute呼吁,在相关保护措施能够按所述方式运行并通过独立核验之前,应将使用范围限制在成年人。OpenAI则表示,家长关联账户后,家长控制和提醒功能可能需要数小时才会启用,并以此解释部分提醒未能触发的情况。公司还称,计划公布更完整的研究,并与独立第三方研究人员合作。
1
因此,争论不只是青少年平均每天使用多久。OpenAI公布的数据描述的是整体使用模式;Common Sense Media的测试则针对高风险情境,检验具体安全功能是否奏效。对高频用户开展独立研究,并核实安全措施的实际表现,才能补上平均值无法回答的部分。
1
6