OpenAI发言人表示,随着前沿模型能力提升,公司正持续优化安全实践,但意识到需进一步加快步伐。鉴于仍有大量工作待完成,OpenAI近期已放缓开发进度,并暂停发布未达到安全标准的模型。公司正对研究和测试环境的安全措施进行重大调整,确保模型不仅能完成任务,更能负责任地执行,同时利用实时监控快速应对偏离预期的行为。

竞争与安全的平衡术

此举引发业界高度关注。受此影响,Anthropic、谷歌DeepMind和SpaceX AI等主要AI实验室均呼吁放缓开发速度。然而,如何在激烈的国际竞争及万亿美元级IPO预期中保持平衡,成为关键议题。

“我们不会自断手脚从而远离技术前沿,那是糟糕的策略,”OpenAI高管陈指出,“关键在于确立一种规范。若这种规范能在行业内广泛建立,整体生态将更加安全。”

在美国内部达成协调已属不易,建立全球规范则更为艰难,尤其是涉及AI对国家安全的潜在影响。对于美国监管范围之外的开源模型,风险同样不容忽视。

陈在对话中语气转为严肃:“我们必须为这样一个世界做好准备:在未来六个月到一年内,将出现具备类似Hugging Face事件中代理能力的开源模型,但这些模型可能被故意设定为偏离对齐状态,旨在攻击基础设施或制造危害。”

陈认为,在那样的环境下,OpenAI的存在至关重要。“如果你暂时假设OpenAI是其中最关心对齐问题的公司之一——我相信这是事实——那么OpenAI的消失对世界而言将是坏事。”

关于存在性风险

针对硅谷部分同行提出的极端观点,即AI可能导致人类灭亡,且OpenAI和Anthropic等公司未能采取足够措施阻止这一风险,陈回应称:“研究人员是一个多元化的群体,他们的信念遍布光谱的各个层面。”