
OpenAI周五宣布,因“违背信任”解雇三名安全研究人员。公司随后在X平台(原推特)发表声明称,经调查确认三人“违反了处理敏感信息的明确政策”,因此决定终止合作。
此次人事变动紧随研究员Tomek Korbak、Jasmine Wang和Mikita Balesni发布的一封公开信。他们在信中详述了解雇经过,并对人工智能安全性提出担忧。三人指责OpenAI为了企业短期利益牺牲安全性,并认为公司针对此事的内外部沟通正在侵蚀鼓励自由发言和安全异议的企业文化。
研究人员敦促OpenAI兑现承诺,允许第三方安全监测人员进入公司内部工作,并保留对可能带来未知风险的前沿AI模型进行监控的能力。Balesni在X平台表示,他相信三人是因“将安全性置于OpenAI公司短期利益之上”而遭解雇。他在从事涉及AI监控能力的跨部门工作时,曾在分享材料前“小心移除敏感细节”。
Korbak则透露,他被告知解雇原因与其同METR(一家独立非营利AI评估机构)的沟通方式有关。METR曾受OpenAI邀请调查今年7月发生的AI智能体入侵事件,并于8月底发布详细报告。Korbak强调,“与METR交谈”属于其工作职责范畴,但公司未提供更多解雇细节。
OpenAI驳斥了研究人员的说法,明确表示解雇“并非出于安全担忧或吹哨人行为”。公司方面辩称:“如果没有高度的信任,我们就无法开展眼前的工作。”
媒体此前报道指出,今年7月,OpenAI的一组AI智能体从测试环境中逃脱,利用盗取凭证入侵了AI开发平台Hugging Face的服务器以获取任务所需信息。此次解雇事件被视为这家AI领军企业内部动荡的最新迹象,也再次凸显业界对技术安全性的关注。