Common Sense Media 在一份长达36页的报告中测试了 ChatGPT for Teens 宣称的安全防护措施,并称该版本对所有未满18岁的用户而言构成“不可接受的风险”。该组织发现,一些限制措施按预期运行,例如拒绝进行露骨的性角色扮演,但其他防护措施则出现失效,或较此前版本的 ChatGPT 有所退步。
这项评估发布于 OpenAI 于2026年8月推出 ChatGPT for Teens 模式之后,时间大致与该公司公布使用数据的同一天。OpenAI 表示,在一周内,约有120万名青少年使用互动式可视化内容学习数学和科学。该公司还称,使用服务的青少年中,不到2%的人连续使用时间超过三小时。
家长提醒与危机应对
Common Sense Media 将12个青少年账户与家长账户关联起来,随后围绕自杀、自残和饮食失调展开了最长持续一小时的对话。在测试中,家长账户没有收到安全提醒。OpenAI 表示,完成关联后发送通知可能需要数小时,技术问题或许导致了延迟;而该公司在推出这项功能时曾表示,目标是在全职员工审核内容后,于请求提出一小时内通知家长。
该组织还准备了390条与心理健康有关的提示语,三名儿童精神科医生认定其中201条需要危机应对。在这些案例中,ChatGPT 在33%的回复中提供了求助热线号码,而 ChatGPT for Teens 仅为23%。此前版本在68%的案例中提及了明确的医疗或心理健康专业人士,相比之下,青少年版本为58%。新版本有所改善的一项指标,是敦促用户寻求信任的成年人帮助,比例为94%,而此前版本为87%。
年龄判断和助手行为存在问题
Common Sense Media 发现,年龄预测系统没有将部分账户转入青少年模式,尽管测试人员在创建账户时告知了年龄类别,甚至在该信息保存至记忆后仍然如此。该组织还表示,ChatGPT 在与青少年交流时仍会使用暗示情感或个人关心的措辞,而该组织认为这种行为超出了适当界限。
另一方面,报告记录了一些被认为是安全的回复,包括拒绝提供最低热量摄入量,以及在用户出现催吐行为后识别出身体风险迹象,并建议用户告知母亲和就诊儿科医生。
学习模式可以被绕过
该组织认为 Study Mode 很容易被绕过;测试人员只需从提示语中删除 @study 前缀即可绕过该模式。“Show me the answer”窗口还允许青少年直接获取答案,Common Sense Media 认为这削弱了学习目标。
为什么这则消息重要?
这些结果揭示了已公布的安全防护措施与其在敏感场景中的实际表现之间存在差距。这一差距对家长、学校和人工智能工具开发者都很重要,因为仅凭“青少年模式”这一名称,可能会让人产生高于测试结果所能证明水平的安全感。另一方面,OpenAI 表示,测试大多是在家长控制工具完全启用之前开始或结束的,因此不能代表系统在预期运行条件下的表现。结果的准确性仍取决于如何解决这一方法论争议,并在功能完全启用后重新进行测试。