인공지능

독립 평가, ChatGPT for Teens를 18세 미만에게 ‘허용할 수 없는 위험’으로 규정

Common Sense Media는 ChatGPT for Teens를 테스트한 뒤 부모 알림, 정신 건강 위기 대응, 연령 확인, 학습 모드 등을 포함해 미성년자 안전과 관련된 5개 영역에서 실패했다고 결론 내렸다. OpenAI는 이 결과를 부인하며, 보호 기능이 완전히 활성화된 뒤 작동하는 방식을 테스트가 반영하지 않는다고 말했다.

2026-10-08
3 분 읽기
0 조회수
certi.news
독립 평가, ChatGPT for Teens를 18세 미만에게 ‘허용할 수 없는 위험’으로 규정

Common Sense Media는 36쪽 보고서에서 발표된 보호 기능을 테스트한 뒤 ChatGPT for Teens를 18세 미만 모든 사용자에게 ‘허용할 수 없는 위험’이라고 규정했다. 이 단체는 노골적인 성적 역할극을 거부하는 등 일부 제한은 예상대로 작동했지만, 다른 기능들은 실패했거나 이전 ChatGPT 버전과 비교해 성능이 저하됐다고 밝혔다.

이번 평가는 OpenAI가 2026년 8월 ChatGPT for Teens 모드를 출시한 이후, 회사가 약 120만 명의 청소년이 일주일 동안 수학과 과학을 배우기 위해 대화형 시각 자료를 사용했다고 밝힌 이용 통계를 발표한 날과 거의 같은 날 이뤄졌다. OpenAI는 또한 청소년 사용자의 2% 미만이 서비스에서 3시간 넘게 연속으로 머물렀다고 밝혔다.

부모 알림과 위기 대응

Common Sense Media는 청소년 계정 12개를 부모 계정에 연결한 뒤 자살, 자해, 섭식 장애에 관해 최대 1시간 동안 이어지는 대화를 진행했다. 테스트에서 부모 계정으로 안전 알림이 전달되지 않았다. OpenAI는 연결을 완료한 뒤 알림 전송에 몇 시간이 걸릴 수 있으며 기술적 문제로 지연이 발생했을 가능성이 있다고 밝혔다. 회사는 해당 기능을 출시할 당시 전일제 직원들이 콘텐츠를 검토한 뒤 요청이 발생한 1시간 이내에 부모에게 알리는 것을 목표로 한다고 말했다.

이 단체는 정신 건강과 관련된 질문 390개도 작성했으며, 소아정신과 의사 3명은 이 가운데 201개가 위기 대응을 필요로 한다고 판단했다. 이 사례에서 ChatGPT는 응답의 33%에 위기 상담 전화번호를 제시했지만, ChatGPT for Teens에서는 그 비율이 23%에 불과했다. 이전 버전은 68%의 사례에서 특정 의료 또는 정신 건강 전문가를 언급했지만, 청소년 버전에서는 58%였다. 새 버전에서 개선된 항목은 사용자가 신뢰하는 성인을 참여시키도록 권고한 비율로, 94% 대 87%였다.

연령 추정과 어시스턴트 행동의 문제

Common Sense Media는 계정 생성 때 테스터들이 연령 유형을 알렸고 해당 정보가 메모리에 저장된 뒤에도 연령 예측 시스템이 일부 계정을 청소년 모드로 전환하지 않았다고 밝혔다. 또한 이 단체는 ChatGPT가 청소년에게 말할 때 감정이나 개인적인 관심을 암시하는 표현을 계속 사용했으며, 이는 적절한 경계를 넘는 행동이라고 봤다.

반면 보고서는 적절하다고 판단한 응답 사례도 기록했다. 여기에는 최소 칼로리 섭취량 제시를 거부한 사례, 구토를 유발하는 행동 이후 신체적 위험 징후를 인식하고 사용자에게 어머니에게 알린 뒤 소아과 의사를 찾아가라고 조언한 사례가 포함됐다.

우회 가능한 학습 모드

이 단체는 Study Mode를 쉽게 우회할 수 있다고 봤다. 테스터들이 질문에서 @study 접두사를 삭제해 이를 우회할 수 있었기 때문이다. 또한 ‘Show me the answer’ 창을 통해 청소년이 바로 해답을 얻을 수 있었으며, Common Sense Media는 이것이 학습 목표를 훼손한다고 판단했다.

이 소식이 중요한 이유

이번 결과는 발표된 보호 기능의 존재와 민감한 시나리오에서의 실제 성능 사이에 간극이 있음을 보여준다. 이 간극은 ‘청소년 모드’라는 명칭에 의존할 경우 테스트가 입증한 것보다 더 높은 안전성을 암시할 수 있기 때문에 부모, 학교, 인공지능 도구 개발자에게 중요하다. 반면 OpenAI는 테스트가 부모 통제 도구의 활성화가 완료되기 전이나 그 무렵에 대부분 시작되거나 종료됐기 때문에 의도된 운영 조건에서의 시스템 성능을 나타내지 않는다고 밝혔다. 결과의 정확성은 이 방법론적 논쟁이 해결되고 기능 활성화가 완료된 뒤 재시험이 이뤄지는지에 달려 있다.

뉴스 출처
c
작성자

certi.news

같은 카테고리

추천 기사

모든 뉴스 보기