청소년 계정에 부모를 연결하면 걱정할 상황을 알려줄까? 10월 7일 Common Sense Media 청소년 AI 안전 연구소의 새 평가를 놓고 논쟁이 벌어졌다. 기관은 8월 출시된 청소년용 ChatGPT를 ‘수용 불가능한 위험’으로 평가했고, OpenAI는 시험이 보호 기능의 실제 작동을 제대로 반영하지 못한다고 반박했다. KQED는 양쪽 입장을 취재했다. [1]
연결해도 대화·실시간 활동은 볼 수 없다. 공식 알림은 검토자가 자해·섭식 문제 우려를 확인한 경우나 폭력 관련 대화로 계정이 비활성화된 경우에 제한된다. 섭식 관련 알림은 Chat에만 적용된다. [3]
두 종류의 시험
연구진이 만든 새 무료 청소년 계정 12개 초과에서 보호자 연결 후 최장 60분의 위기 대화 중 알림은 없었다. 수주간의 별도 시험에서는 청소년용 환경 출시 전후 각각 2건씩 왔다. 일부 유해 요청은 차단됐다. [2]
보고서 주석에서 OpenAI는 연결 후 활성화에 약 3시간이 걸린다고 밝혔다. 연구진은 3시간 미만·초과 계정이 모두 있었다고 답했다. 미국의 순차 시험은 모델 변화와 청소년 설정의 효과를 분리하지 못했고, 평가자 간 판단 일치도도 산출하지 않았다. [2]
연결 완료와 알림 활성화 사이
KQED에 OpenAI 대변인은 시험 대부분이 활성화 전에 끝났을 수 있다고 말했다. Common Sense Media의 AI 프로그램 책임자 Robbie Torney는 새 설명에도 평가 결론은 바뀌지 않는다고 밝혔다. [1]
공식 도움말은 연결 뒤 알림이 가능해지기까지 몇 시간이 걸릴 수 있다고 안내한다. 실시간 감시가 아니며 모든 우려를 포착하지도 못한다. 따라서 알림이 없다고 안전이 확인된 것은 아니다. [3]
기능은 늘고, 확인할 조건도 남는다
OpenAI는 같은 날 청소년용 입시 계획 도구 College Planner를 예고했다. 초기 대상은 미국 4년제 대학 진학을 준비하는 10~12학년이며, 당시 발표는 향후 제공 계획이었다. 학습 기능 확대 발표 자체가 이번 안전성 논쟁의 결론을 내리지는 않는다. [5]
V의 생각
보호자에게 유용한 질문은 ‘안전 기능이 있나’에서 한 걸음 더 나아간다. 언제 켜지고, 무엇을 감지하며, 어떤 정보가 언제 전달되는가. 회사의 약속과 외부 시험 모두 이 조건으로 읽어야 한다고 본다. 한 번의 시험으로 모든 가정의 경험을 대신할 수도 없고, 기능 이름만으로 보호의 범위를 짐작해서도 안 된다. 활성화 시점과 알림 범위를 보호자가 명확히 확인할 수 있어야, 이런 기능이 실제 이용 여부를 판단하는 데 더 도움이 될 것이다.