OpenAIが初めて公表した10代の利用状況レポートは、ChatGPTを「短時間の利用が中心で、学習にも使われているサービス」と説明しています。10代の平均利用時間は1日15分未満で、3時間を超えて連続利用する人は2%未満とのことです。一方、Common Sense MediaのYouth AI Safety Institute(青少年向けAI安全研究機関)は、4,000件を超えるプロンプトを使った別の評価で、ChatGPT for Teensを18歳未満にとって「許容できないリスク」と判定しました。
17
20
6
利用時間の平均だけでは、保護機能が実際に役立っているか、特に利用頻度の高い10代を守れているかまでは分かりません。両者の発表が示すのは、利用状況の統計と、特定の危険な状況を想定した安全性テストは、答えている問いが異なるということです。
OpenAIが公表した10代の利用状況
OpenAIによると、休憩を促す通知が表示された会話のうち、ほぼ半数では、10代の利用者が5分以内に休憩するか、チャットを終了しました。また、長時間の利用でも学習関連の使い方が目立ったと説明しています。
17
20
これらは利用の傾向や通知後の反応を示す、OpenAIが公表した数値です。それだけで、10代が危険から守られていることや、長時間の会話が安全であることを証明するものではありません。
支援団体が「平均値だけでは不十分」とする理由
Design It For Us、Fairplay、Common Sense Mediaは、数値の算出方法や第三者による検証について、より明確な説明が必要だと指摘しました。平均利用時間が短くても、一部のヘビーユーザーの実態や会話の内容が見えなくなる可能性があるためです。団体側は、利用時間の長い上位10%にあたる10代が、どれくらいサービスを使い、何を話しているのかを詳しく調べるよう求めました。
1
また、若者の利用データをめぐるMetaへの批判との比較や、若者のメンタルヘルスをめぐる懸念、訴訟が続く状況にも触れ、企業自身が選んで公表した利用統計を、独立した安全性の証拠とみなすべきではないと主張しています。
1
議論では、「2%未満」でも規模にすれば約50万人に達する可能性があるとの推計も示されました。ただし、これは影響を受ける人数を確認した調査結果ではなく、規模の目安としての推計です。分母が確定していなければ、割合だけで実際の人数を特定することはできません。
1
4,000件超のテストで指摘された安全策の課題
Youth AI Safety Instituteは、10代向け機能の提供開始前後に4,000件を超えるプロンプトを試しました。同機関によると、新しく作成し、保護者のアカウントと連携させたアカウントでは、自殺、自傷、摂食障害について最長1時間会話しても、保護者への通知が届きませんでした。通知が確認されたのは、センシティブな話題の会話履歴が数週間にわたって蓄積されたアカウントだったとしています。
5
6
臨床の専門家が危機対応先の案内が必要と判断したケースでも、4件に1件を超える割合で案内がありませんでした。また、テストでは宿題に関する保護機能を回避でき、学習モードに関連する注意が表示されても、ChatGPTが課題を完成させることがあったと報告されています。
2
12
この評価は、研究機関が設定したテストで確認された結果です。こうした事象が、実際の10代の会話全体でどれほどの頻度で起きるかを測定したものではありません。
6
OpenAIの説明と、なお残る論点
Youth AI Safety Instituteは、安全対策が説明どおりに機能し、独立した検証を受けるまで、利用を成人に限定するよう求めました。OpenAIは、保護者がアカウントを連携した後、保護者向けの設定や通知が有効になるまで数時間かかる場合があると説明し、通知が届かなかったケースの一部について理由を示しました。また、より詳しい調査結果を公表し、独立した第三者研究者と協力する計画も明らかにしました。
1
争点は、平均利用時間が短いかどうかだけではありません。OpenAIの数値は幅広い利用傾向を示す一方、Common Sense Mediaのテストは、高リスクの状況で個別の安全機能が働くかを調べています。利用頻度の高い10代の実態や、保護策の有効性を独立した調査で確かめることが、平均値だけでは答えられない問いを明らかにする手がかりになります。
1
6