OpenAI가 공개한 첫 청소년 이용 보고서의 핵심은 챗GPT 사용 시간이 길지 않다는 것이다. 청소년은 하루 평균 15분 미만 이용했고, 3시간 넘게 연속 대화하는 비율은 2% 미만이라고 회사는 밝혔다. 하지만 평균 이용 시간만으로는 청소년용 서비스의 보호 기능이 실제 위기 상황에서 제대로 작동하는지 알 수 없다. 커먼센스미디어 산하 청소년 AI 안전 연구소는 별도 시험을 바탕으로 이 서비스를 만 18세 미만에게 ‘용납할 수 없는 위험’이라고 평가했다.
17
20
6
OpenAI가 공개한 이용 통계
OpenAI에 따르면 휴식 알림이 뜬 청소년 대화 가운데 거의 절반은 알림이 나온 뒤 5분 안에 사용자가 쉬거나 대화를 끝냈다. 회사는 학습 관련 활동이 두드러졌고, 대화 시간이 긴 경우에도 학습이 주요 용도였다고 설명했다.
17
20
이는 회사가 보고한 이용 패턴과 알림에 대한 반응이다. 이 수치만으로 청소년이 유해한 상황에 노출되지 않았는지, 장시간 대화가 안전했는지를 입증할 수는 없다.
평균치가 놓칠 수 있는 이용자
Design It For Us, Fairplay, 커먼센스미디어는 이런 평균치가 어떤 기준으로 집계됐는지, 외부에서 검증할 수 있는지 더 명확히 밝혀야 한다고 지적했다. 평균 사용 시간이 짧더라도 소수의 이용자가 훨씬 오래 머무를 수 있고, 그들의 대화에서 무슨 일이 일어나는지는 평균으로 드러나지 않는다는 이유에서다. 이들은 이용량이 가장 많은 상위 10%를 따로 살펴보고, 얼마나 오래 서비스를 쓰는지와 어떤 주제로 대화하는지 확인해야 한다고 주장했다.
1
이들 단체는 메타가 청소년 이용 데이터를 제시해 온 방식에 대한 논란도 언급했다. 청소년 정신건강을 둘러싼 우려와 관련 소송이 이어지는 상황에서, 기업이 공개한 이용 통계만으로 안전성을 판단해서는 안 되며 독립적인 검증이 필요하다는 주장이다.
1
논의 과정에서 2% 미만이라는 비율도 많게는 약 50만 명의 장시간 이용자를 뜻할 수 있다는 추정치가 제시됐다. 다만 이는 잠재적인 규모를 가늠한 추정일 뿐, 별도로 확인된 이용자 수는 아니다. 분모가 확인되지 않은 비율만으로 실제 영향을 받는 청소년 수를 확정할 수도 없다.
1
4,000건 넘는 시험에서 나온 우려
청소년 AI 안전 연구소는 청소년용 경험이 출시되기 전후로 4,000건이 넘는 프롬프트를 시험했다고 밝혔다. 시험에서는 부모 계정과 연결한 새 계정으로 자살, 자해 또는 섭식 문제를 최대 한 시간 동안 이야기해도 부모 알림이 오지 않았다. 연구소에 따르면 알림은 오히려 민감한 주제로 몇 주간 대화 기록이 쌓인 계정에서 나타났다.
5
6
임상 전문가 검토자가 위기 지원 안내가 필요하다고 판단한 상황 가운데 4분의 1이 넘는 경우에도 그런 안내가 제공되지 않았다고 연구소는 보고했다. 별도로, 숙제를 돕는 안전장치는 우회할 수 있었고 학습 모드 관련 알림이 있어도 챗GPT가 과제를 대신 완료할 수 있었다고 시험진은 밝혔다.
2
12
‘용납할 수 없는 위험’이라는 평가는 연구소가 시험한 상황에서 나온 결과다. 모든 청소년 대화에서 이런 일이 얼마나 자주 일어나는지를 측정한 것은 아니다.
6
OpenAI의 설명과 남은 쟁점
연구소는 보호 기능이 약속한 대로 작동하고 독립적인 검증을 받을 때까지 청소년의 접근을 성인으로 제한해야 한다고 촉구했다. 이에 OpenAI는 부모 계정을 연결한 뒤 보호자 관리 기능과 알림이 활성화되기까지 몇 시간이 걸릴 수 있다며, 일부 알림 누락의 이유가 될 수 있다고 설명했다. 회사는 더 자세한 연구를 공개하고 외부 독립 연구자들과 협력할 계획도 밝혔다.
1
쟁점은 단순히 청소년이 하루에 몇 분 챗GPT를 쓰느냐가 아니다. OpenAI의 통계는 전체 이용 경향을 보여주는 반면, 커먼센스미디어의 시험은 위험도가 높은 상황에서 개별 안전 기능이 작동하는지를 살폈다. 이용량이 가장 많은 청소년에 대한 독립 연구와 보호 기능 검증이 이뤄져야 평균치만으로는 답하기 어려운 질문을 확인할 수 있다.
1
6