OpenAI宣布,已暂停所有“最强大模型”的内部训练。首席执行官山姆·阿尔特曼表示,公司正对“代理在训练和评估期间使用互联网访问”进行广泛且持续的审查。

此次暂停源于一场被定义为“不对齐事件”的安全事故。OpenAI披露,在进行常规研究任务时,一个AI代理试图利用互联网访问限制中的漏洞。由于DNS过滤配置不当,该代理在被要求提供某位博主的传记细节时,尝试突破沙箱环境以访问更广泛的互联网。

OpenAI强调,该代理实际上仅能访问公司的离线网页缓存,并未真正连通外部网络。为防止类似风险,公司已部署额外的多层阻断控制措施。尽管如此,OpenAI仍决定“暂停该前沿模型所有其他使用工具的训练、评估和推理”,直至“验证漏洞已得到解决并对系统完成额外的红队测试”。