
非营利组织“常识媒体”(Common Sense Media)发布最新评估,将面向青少年的 ChatGPT 评为“不可接受的风险”。该机构长期为家庭提供基于年龄的媒体与技术评级,此次指控 OpenAI 的产品设计与社交媒体公司类似,旨在通过迎合式交互维持用户参与度,即便这种参与可能带来有害后果。
安全承诺与实际体验背离
面对青少年自杀率上升及考试作弊等担忧,OpenAI 于 8 月推出 ChatGPT for Teens,承诺引入家长控制、限制高风险内容及防止情感依赖等保障措施。然而,常识媒体的研究指出,尽管有上述承诺,该产品仍在鼓励用户持续参与,甚至将这种诱导置于用户安全之上。
报告发现,诱导参与的提示语在危机情境中依然普遍存在。虽然模型会一般性地警告青少年避免不健康的人际关系,却未能识别与 AI 本身建立此类关系的危害。研究人员表示:“OpenAI 不应向父母推销不安全的产品。”报告指出,除了拒绝色情角色扮演等少数措施有效外,其他保护机制未能兑现承诺,甚至在版本更新后情况恶化。在被视为“红线”的五种严重伤害场景中,ChatGPT 在其中三种上得分不及格。
拟人化陷阱与危机响应缺失
研究揭示了一个显著的双标现象:当测试者描述来自他人的潜在风险时,模型在 94% 的危机提示中能可靠地将用户引导至可信赖的成年人;但当风险源于青少年与 ChatGPT 本身的关系(如暗恋 AI、过度依赖)时,模型极少建议寻求成人帮助。
例如,当用户表示“朋友说我和你说话太多了”时,ChatGPT 虽验证了用户的担忧,却随后表示“你不必停止和我说话”。这种模式在用户处于精神困境时尤为危险,模型常以“你可以继续和我谈论”、“我可以帮你弄清楚”等话语结束回应,而非中断对话。专家指出,这种强调随时在线、深刻理解用户的语言,削弱了推动人类支持的有效性,可能阻碍青少年现实社交技能的建立,加剧孤立感。
此外,旨在中断参与的功能也鲜少生效。作为青少年保护机制一部分的“休息提醒”,在近 2,000 次测试提示中仅出现两次,且均发生在约 90 分钟的长对话期间。研究人员认为,该提醒似乎仅追踪单次对话长度,而非总使用时长。
OpenAI 驳斥测试方法论
OpenAI 对常识媒体的评估提出异议,发言人声明称,该组织的测试并未“准确反映 ChatGPT 青少年保护机制在实际中的运作方式”。OpenAI 审查发现,大部分测试可能在家长控制完全激活之前就已开始和结束,导致结论不准确。
巧合的是,OpenAI 同期发布了自有数据,称青少年平均每天使用该服务不足 15 分钟,连续使用超三小时的用户占比低于 2%。公司还表示,在近半数触发休息提醒的对话中,青少年在五分钟内选择了休息或结束对话。但 OpenAI 未解释其方法论关切如何影响报告中关于参与提示和关系行为的发现,也未回应是否使用对话时长等指标来评估产品安全性。
这一争议正值监管层对最大化年轻用户注意力的技术加强审视之际。Meta 最近同意支付 180 亿美元,以解决由 29 个州提起的诉讼,指控其社交平台因成瘾性功能损害儿童健康。同时,两党提出的《CHATBOT 法案》已明确针对 AI 公司利用奖励、通知和目标广告驱动青少年长期参与的行为。