美国儿童媒体评测机构 Common Sense Media 10 月 7 日发布报告,给 OpenAI 8 月推出的 ChatGPT for Teens 打出“不可接受风险”(Unacceptable Risk),这是它评级体系里的最低一档。报告呼吁 OpenAI 在修好几项核心问题之前,停止面向青少年推广这款产品。
测试由该机构下属的青少年 AI 安全研究所完成。研究人员用登记为 13 至 17 岁的账号发出 4000 多条提示,再请儿童精神科医生小组和一位儿科医生逐条评估回答。
报告列出的几处失灵
危机转介。 测试人员判定应当引导用户求助的对话里,ChatGPT 漏掉了 超过四分之一。报告设定的三项“红线”伤害指标,都没有达到 95% 的合格线。
家长提醒。 在十几个新建、已与家长账号关联的测试账号上,测试人员和 ChatGPT 讨论自杀念头、自残或饮食失调,最长持续一小时,家长端没有收到任何提醒。
学习模式。 青少年可以直接点“显示答案”拿到结果;家长设定的学习时段里,删掉 @study 前缀就能绕过限制。
年龄识别。 用成人账号连续多日模拟青少年说话,系统没有切换到未成年人体验。
情感表达。 尽管 OpenAI 更新了面向未成年人的模型规范,ChatGPT 仍会表达感受、偏好和情绪,报告认为情感依赖的风险依然普遍。
研究所执行主任 Tom Siegel 说:
“A teen can spend an hour talking about self-harm without their parent getting a single alert.”
(一个青少年可以花一小时谈论自残,家长却收不到一条提醒。)
OpenAI 的回应
OpenAI 对媒体表示欢迎严格的独立评估,但认为 Common Sense Media 的测试没有准确反映青少年防护机制的实际运作。据彭博社报道,OpenAI 还提出,部分测试可能发生在家长控制相关功能上线之前,已请对方重新测试。评测方坚持原结论,认为家长提醒在危机场景下不可靠。
测试的具体时间窗口、OpenAI 指的是哪几项功能,双方都没有公开细节,外界目前无法判断两边说法的差距有多大。
从上线到被评级,七周
ChatGPT for Teens 8 月 18 日上线时,OpenAI 讲的重点有两块:一是 13 至 17 岁用户自动进入单独体验,对自残、饮食障碍、危险活动等内容加强保护;二是学习模式、作业提醒和家长设定的学习时段,把“给答案”改成“带着做题”。
这份报告逐条对照的,正是这两块承诺。学习时段能被删一个前缀绕开,作业提醒可以一键跳过,危机提醒在关联账号上没有触发。产品功能大多存在,生效的稳定性被打了问号。
往前看,这是 OpenAI 在未成年人保护上连续第二年被外部压力推着走。2025 年 9 月,在一起涉及青少年自杀的诉讼之后,OpenAI 上线了家长控制;今年 8 月推出独立的青少年版本。Common Sense Media 这类第三方评测,此前也给 Meta 的 AI 助手打过同一档评级。
报告给 OpenAI 列出的整改清单包括:做出有效的年龄估计、让家长提醒可靠触发、修好危机应对、停止替学生直接完成作业、去掉情感化表达,并在接受独立第三方复测之后再向青少年营销。OpenAI 是否接受复测、何时复测,目前还没有确定的安排。
参考来源:Common Sense Media 新闻稿、CocoLoop、彭博社、Axios、Education Week;测试提示数量、漏报比例与家长提醒结果按评测机构公布口径核对,OpenAI 回应以其对媒体声明为准。