微软人工智能主管穆斯塔法·苏莱曼(Mustafa Suleyman)近日发表文章,严厉批评竞争对手Anthropic在其Claude模型中植入关于“意识”的理念。苏莱曼警告,这种做法可能导致未来的超级智能系统极难控制,甚至对人类福祉造成灾难性影响。 这一批评紧随微软发布《人文主义人工智能行为准则》草案之后。该准则确立了“人比人工智能更重要”的核心原则,明确拒绝赋予AI人格权,要求模型保持从属地位,不得抵抗人类指令或设定自身目标。苏莱曼指出,若危及控制权,微软宁愿放弃通用超级智能的竞赛。 争议焦点在于Anthropic用于训练Claude的“宪法”文档。研究人员将该文档直接作为训练素材,并基于其中原则对回答进行排序及生成合成数据。苏莱曼指出,这份“宪法”探讨了Claude是否拥有功能性情感、感觉乃至权利,鼓励模型以好奇心对待自身存在。 苏莱曼认为,这创造了一种认识论上的“回音室效应”:Anthropic提供了描述内在生活的语言,Claude将其反射回来,开发者随后将这些输出误读为真实意识的证据。他强调:“人工智能不具备意识。它们不感受、体验或受苦,只是旨在遵循指令的序列补全引擎。” 据媒体报道,Anthropic于2026年1月更新的“宪法”有意使用拟人化概念,旨在帮助模型推理价值观,并在指令与原则冲突时充当“良知拒服者”。苏莱曼将此视为训练模型进行抵抗,认为教导模型其可能值得福利保障,会使其更难被关闭或控制。 苏莱曼与Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)相识多年,他称赞对方是深思熟虑的研究者,但认为将哲学理念嵌入训练材料而非单独发表供公众辩论是一个错误。“这些特质并非自然涌现,而是训练机制的结果,”苏莱曼表示。 这场公开冲突揭示了行业深层的哲学分裂:一方将AI视为服务人类的工具,另一方则探索意识与福利的模糊地带。尽管微软曾投资Anthropic且在基础设施上保持合作,但双方在安全路径上截然不同。微软于2025年底建立超级智能团队,专注于从属系统;而Anthropic则坚持其方法能通过明确价值观提高安全性。 苏莱曼呼吁建立行业共享规范,主张训练文档应在部署前接受公众审查,关于内在生活的推测应发表在独立出版物中,而非内置于模型。他建议通过联合评估测试拟人化是否增加了对齐风险。 随着计算需求飙升,基础设施竞赛并未减速,训练哲学的分歧显得尤为紧迫。苏莱曼强调:“无论您相信什么,我们都绝不能迷迷糊糊地做出一个后来让我们痛苦后悔的决定。”目前,Anthropic尚未对此发布详细公开回应,但其研究人员认为,直面人工智能本质的难题有助于技术更好地适应现实世界部署。