
非营利机构 Palisade Research 近日发布一系列访谈视频,采访对象涵盖 OpenAI、Google DeepMind 和 Anthropic 等头部企业的现任及前任 AI 研究人员,业内对人工智能潜在风险的担忧再次成为焦点。
“末日概率”并非危言耸听
受访专家对 AI 可能导致人类灭绝的风险给出了惊人评估。前 OpenAI 和 Google DeepMind 员工 Geoffrey Irving 直言,这一概率“大约相当于抛硬币”,即接近 50%。Google DeepMind 研究科学家 Neel Nanda 则认为,AI 导致人类灭绝的可能性“至少为 10%”,并称这是一个“荒谬的高概率”。
前 OpenAI 研究员 Daniel Kokotajolo 进一步警告,超级智能 AI “基本上将拥有神一般的力量”,而人类目前“完全无法控制它们”。他强调:“这听起来有多危险,它就是有多危险,必须防止这种情况发生。”
留在体制内以降低风险
针对这些言论是否仅为炒作或营销手段的质疑,受访者给出了不同回应。Google 研究员 Mary Phuong 坦承,鉴于其受雇于实验室的身份,公众“绝对应该对我的说法保持怀疑”。
Neel Nanda 则解释了继续从事相关工作的原因:“如果我不相信自己的工作能直接降低这些生存风险,我就会辞职。”但他同时也指出,现实情况是,“这些公司不会因为我的离开就停止开发这些系统。”
尽管预警强烈,但该系列视频并未提供统一的解决方案。这也折射出当前 AI 安全领域的困境:正如以往报道所指出的,界定“AI 安全”的具体含义并明确应对措施,仍极具挑战性。