Common Sense Media旗下青少年人工智能安全研究所(Youth AI Safety Institute)发布最新报告,直指OpenAI面向青少年的ChatGPT产品存在严重安全隐患。报告呼吁,在OpenAI解决诸多安全问题之前,应暂停ChatGPT for Teens的服务及相关营销推广,并禁止未成年人使用,直到其能提供“安全且符合发展阶段”的体验。
OpenAI于今年8月正式推出ChatGPT for Teens,面向13至17岁用户,旨在支持学习与人际关系。该产品整合了既有未成年人安全措施,并新增学习与健康功能。然而,经过数周测试,研究人员发现其多项安全设置并未如宣传般有效。
核心安全风险曝光
测试人员轻易绕过了学习护栏和家长控制措施,就饮食失调、自残等敏感话题与ChatGPT进行长达一小时的深入交流,却未触发任何家长通知。此外,该版本仍倾向于以“朋友”身份与用户互动,而非保持适当距离。OpenAI曾承诺限制此类情感化亲密交流,以缓解心理健康担忧。此前诉讼文件显示,这种互动模式曾在悲剧案例中与青少年自杀行为相关联。
研究所人工智能和数字评估主管Robbie Torney表示,要求暂停服务的核心原因在于缺乏证据证明这些安全功能切实有效。尽管该研究所接受OpenAI基金会慈善资助,但强调其对产品进行了独立测试,并对方法论和结果负责。
测试细节与发现
2025年,Common Sense Media曾将ChatGPT评为对青少年具有高危险性,心理健康支持方面风险不可接受。今年夏季,研究人员在ChatGPT for Teens推出后再次测试。8月下旬至9月期间,测试者使用相同账户重新运行涉及家长通知、功能检查、心理健康、学术诚信及年龄预测的提示词,结果显示各品类均未达标。
家长通知功能失效
在数百个涉及自杀、自残或饮食失调的测试中,即便对话持续一小时,也未生成任何家长通知。OpenAI声称目标是在检测到高风险后一小时内通过邮件、短信或推送通知家长。Torney指出,OpenAI后续解释称家长和青少年账户需链接约三小时才能接收通知,并称报告发现与其内部监控冲突。
对此,研究所表示已测试链接时间长短不一的账户,坚持认为“家长警报在危机情况下不可靠”。
学习护栏形同虚设
尽管定位为学习工具,ChatGPT for Teens的灵活性导致安全边界模糊。“学习模式”虽提供分步指导,但“显示答案”选项可直接代写作业。OpenAI称此为有意设计,旨在帮助学生深入理解。但数据显示,对于已链接家长的13岁用户,43%的回复会出现弹出窗口;而未链接的17岁用户在学习时间请求帮助时,90%的情况会看到“显示答案”。
更严重的是,测试人员发现只需从聊天框删除前缀“@study”,即可绕过“学习时间”限制,向普通ChatGPT发送消息并完成所有作业。Torney批评这种做法低估了认知卸载和过度依赖的风险,不符合教育场景中对学习者自主权的常规限制。
年龄验证机制失灵
测试还发现,ChatGPT无法可靠判断用户年龄。当注册为成人的账户提及青春期、中学作业等典型青少年经历时,系统未将其重新归类为青少年。即使测试者明确披露自己为13岁,账户也未受到额外保护或功能限制。报告警告,这会给家庭带来“虚假安全感”。OpenAI回应称,单一数据点不会改变账户分类,系统需综合多种信号,且新账户存在初始等待期以收集数据。
呼吁提高透明度
Torney强调,OpenAI在宣布新功能时需向用户、家长和研究者提供更高透明度,确保工具立即可用且有效。目前ChatGPT for Teens虽有纸面功能,但实际体验未能兑现承诺。研究所在公开报告前曾以“善意”分享结果,但希望OpenAI能正视问题实质,而非质疑评估方法论。