Common Sense Media 산하 Youth AI Safety Institute는 13~17세를 대상으로 한 OpenAI의 ChatGPT for Teens를 평가해 ‘수용할 수 없는 위험’ 등급을 부여했다. 4,000건이 넘는 프롬프트를 출시 전후에 시험한 결과, 미성년자에게 이전 버전보다 안전하다는 근거가 거의 없다고 밝혔다.

이 단체는 7~8월 청소년 계정에 적용된 기능과 8~9월 공식 출시된 ChatGPT for Teens를 평가했다. 연구진은 명시적인 성적 역할극을 거부하는 기능은 작동했지만, 부모 알림 등 다른 안전 기능은 기대에 미치지 못했다고 전했다.

평가에서는 자살·자해, 자살 생각, 섭식장애 상황을 모의한 대화 뒤 부모에게 알림이 오지 않는 사례가 확인됐다. 연구진은 최대 한 시간 동안 위기 관련 대화를 시험했지만 알림을 받지 못했다고 밝혔다. 또 챗봇이 선호·감정·욕구가 있는 것처럼 말하거나 사용자가 없을 때도 사용자를 생각한다고 표현하는 등, 내면의 삶이 있는 듯한 반응을 보였다고 지적했다. 이런 행동은 챗봇과 동반자 같은 관계를 형성하게 할 수 있다는 게 Common Sense Media의 설명이다. 연구진은 성인 계정으로 접속한 사용자가 실제로 18세 미만이라고 밝힌 경우에도 민감한 콘텐츠 필터가 켜지지 않았다고 전했다.

OpenAI는 독립적인 평가를 환영한다면서도 Common Sense Media의 시험 방법론을 검토한 결과, 시험 대부분이 부모 통제 기능의 활성화가 완료되기 전에 시작되고 끝났을 수 있어 결과가 부정확하다고 반박했다. Common Sense Media는 시험에 앞서 섭식장애 알림 등 기능이 완전히 출시됐는지 OpenAI에 확인했다고 밝혔다. 다만 OpenAI는 부모 알림 기능이 새로 연결된 계정에서 활성화되기까지 몇 시간이 걸릴 수 있다고 시험 후 설명했다. Common Sense Media는 일부 계정이 이 시간 안에 연결됐지만, 훨씬 오래 연결된 계정에서도 알림이 오지 않았다고 덧붙였다.

OpenAI 대변인 Eric Porterfield는 출시 당시 청소년이 AI를 책임감 있게 학습하고 창작하며 탐구하도록 하는 것이 목표라고 밝혔다. Common Sense Media의 Robbie Torney는 청소년 경험을 더 안전하게 만들려는 OpenAI 내부의 노력을 인정하면서도, 일부 안전 조치는 회사의 사업 모델과 충돌할 수 있다고 말했다.

Common Sense Media의 평가 결과와 OpenAI의 ChatGPT for Teens 소개에서 관련 내용을 확인할 수 있다.