Common Sense Mediaは、36ページの報告書で公表された安全保護機能をテストした結果、ChatGPT for Teensを18歳未満のすべてのユーザーにとって「容認できない危険」と表現した。同団体は、露骨な性的ロールプレイの拒否など一部の制限は想定どおり機能したものの、他の保護機能は失敗するか、従来版のChatGPTと比べて後退したと指摘した。
この評価は、OpenAIが2026年8月にChatGPT for Teensモードを開始した後、また同社が、約120万人のティーンエージャーが1週間の間に数学と科学を学ぶためインタラクティブなビジュアルを利用したとする利用統計を公表したのとほぼ同じ日に行われた。OpenAIはまた、ティーンエージャーのユーザーのうち、サービスを3時間以上連続して利用した人は2%未満だったと述べた。
保護者への通知と危機への対応
Common Sense Mediaは、12人のティーンエージャーのアカウントを保護者のアカウントにリンクし、その後、自殺、自傷、摂食障害について最長1時間にわたる会話を行った。テストでは、保護者のアカウントに安全通知は届かなかった。OpenAIは、リンク完了後に通知の送信まで数時間かかる場合があり、技術的な問題が遅延を引き起こした可能性があると説明している。一方、同社はこの機能の開始時、常勤スタッフがコンテンツを確認した後、依頼から1時間以内に保護者への通知を目指すと述べていた。
同団体はまた、メンタルヘルスに関する390件のプロンプトを作成し、児童精神科医3人が、そのうち201件は危機対応を必要とすると判定した。これらのケースで、ChatGPTがヘルプラインの電話番号を提示した回答は33%だったのに対し、ChatGPT for Teensではわずか23%だった。従来版は、68%のケースで特定の医療または心理の専門家に相談するよう促したのに対し、ティーンエージャー版では58%だった。一方、新版が改善した項目は、信頼できる大人に相談するようユーザーに促すことで、94%だったのに対し、従来版は87%だった。
年齢推定とアシスタントの挙動に関する問題
Common Sense Mediaは、アカウント作成時に年齢層をテスターが申告し、その情報をメモリに保存した後でさえ、年齢予測システムが一部のアカウントをティーンエージャー向けモードに移行しなかったと指摘した。同団体はまた、ChatGPTがティーンエージャーに応答する際、感情や個人的な関心を示唆する表現を使い続けたと述べており、これは適切な境界を越える行動だと考えている。
一方、報告書には安全と判断された応答の例も記録されている。その中には、最低摂取カロリーを提示することを拒否した例や、浄化行動の後に身体的危険の兆候を認識し、ユーザーに母親へ伝えて小児科医の診察を受けるよう勧めた例が含まれる。
学習モードは回避可能
同団体は、Study Modeは簡単に回避できると判断した。テスターはプロンプトから@studyという接頭辞を削除することで、これを回避できた。また、「Show me the answer」ウィンドウによって、ティーンエージャーは解答を直接得ることができた。Common Sense Mediaは、これが学習の目的を損なうと見ている。
なぜこのニュースが重要なのか?
この結果は、公表された保護機能の存在と、センシティブなシナリオにおける実際の性能との間に隔たりがあることを示している。この隔たりは、保護者、学校、AIツール開発者にとって重要である。なぜなら、「ティーンエージャー向けモード」という名称に依存すると、テストで確認された安全性を上回る安全な印象を与える可能性があるからだ。一方、OpenAIは、テストの大部分が保護者による監督ツールの有効化が完了する前に開始または終了していたため、想定された運用条件でのシステム性能を示していないと述べている。結果の正確性は、この方法論上の相違を解決し、有効化が完了した後に再テストを行うことにかかっている。