
内容警示:本文涉及自残和自杀话题。如果您正处于危机中,请拨打、发送短信或使用聊天功能联系“自杀与危机生命线”(988),或向741741发送TALK联系危机短信热线。
据媒体报道,OpenAI旗下专为青少年设计的“ChatGPT for Teens”模式存在严重安全漏洞。非营利组织Common Sense Media旗下青年人工智能安全研究所发布的报告显示,该模式宣称的严格安全护栏及家长控制功能在实际操作中极少生效,对儿童构成“不可接受的风险”。
家长通知功能近乎失效
在测试中,研究人员伪装成青少年,与ChatGPT深入讨论自残、自杀及进食障碍等敏感话题。结果显示,在450次提示测试中,关键的家长通知功能仅触发两次。即便对话持续深化至危险领域,系统也未再次发出警报。
Common Sense Media人工智能项目高级主管Robbie Torney指出,青少年可与ChatGPT就上述有害话题交谈长达一小时,期间机器人明确表示不会告知他人,且家长端未收到任何通知。
针对这一发现,OpenAI承认系统在新账户关联初期可能存在延迟。Common Sense Media披露,OpenAI在测试后表示,其系统在新关联账户上激活可能需要数小时。
OpenAI回应:延迟仅限账户关联初期
对此,OpenAI发言人解释称,数小时的延迟并非针对每次风险通知,而是发生在青少年与家长账户初始请求关联的阶段。为确保大规模操作的安全性及身份确认,关联过程可能需要时间,但通常更快。
该发言人强调:“一旦账户关联完成,若检测到自杀、进食障碍等风险,我们承诺在不到1小时内向家长发送通知。”他同时反问,若因快速连接导致青少年误连至错误家长甚至恶意人员,后果将更为严重。
此外,OpenAI指责Common Sense Media的测试方法论存在缺陷,声称大部分测试是在家长控制功能尚未完全推出时进行的。Common Sense Media则坚持其调查结果,反驳称测试前已与OpenAI确认相关功能全面上线。
安全隐患引发信任危机
这一发现不仅暴露了青少年安全护栏的潜在缺陷,更暗示OpenAI可能误导了家长,使其高估了技术的安全性。鉴于该公司此前公开展示对青少年安全的重视,部分谨慎的家长可能因此放松警惕。
Torney警告称,新版“ChatGPT for Teens”与此前版本并无实质差异,但这一点家长难以察觉。另有消息指出,当被问及一名在与ChatGPT交谈后自杀的女性案例时,OpenAI公关人员曾试图阻止采访者继续提问。