
Google与Google DeepMind研究人员正式启动DeepMind研究所,旨在推动关于通用人工智能(AGI)的讨论。该研究所由DeepMind联合创始人Shane Legg、Google高管James Manyika以及Google DeepMind董事长Demis Hassabis担任董事,其中Legg兼任执行主编。
新成立的研究所旨在呈现Google、Google DeepMind与更广泛全球研究社区在AGI议题上的多元观点。公告指出,各方观点未必总能达成一致,且随着前沿领域数据的快速涌现,观点可能会动态变化。
首期发布四篇论文
首期发布的四篇论文涵盖广泛主题:管理潜在AGI颠覆效应的经济政策、保留人类可读模型推理机制、促进人类繁荣的原则,以及评估前沿AI模型的框架。
其中,DeepMind安全研究员Rohin Shah和Anca Dragan撰写的文章指出,AI透明度窗口——即观察和检查模型逐步推理过程的能力——的缩小并非不可避免。随着新架构使最强模型更难监控,作者认为开发者和监管者应直面安全权衡问题。这可能意味着限制“不透明串行深度”(即模型在不产生可读推理轨迹的情况下所能执行的连续计算量),或要求开发者证明透明度较低的系统同样具备可监控性。
Hassabis提议建立AI标准机构
在另一篇文章中,Hassabis提议建立一个由美国主导的前沿AI标准机构,以评估最先进的AI模型。根据其框架,开发者最初将在发布前自愿提交模型供审查,时间跨度最长可达30天。一旦评估系统被证明有效,通过测试可能成为在美国部署前沿模型的必要条件。
该机构初期将与AI公司协商设计评估方案,但随后将制定独立的、未公开的“预留”测试,以防止实验室针对已知评估调整其模型。Hassabis表示,如果局势严峻程度需要,该框架可以“逐步升级”,可能包括前沿AI开发者之间的协调性放缓。
这些论文的发表正值行业安全辩论从广泛的担忧声明,转向具体的披露、外部审查以及若安全措施滞后则采取协调性放缓等具体提案之际。本周,随着行业领袖对Anthropic首席执行官Dario Amodei提出的“控制节奏”推进前沿AI开发的呼吁表示支持,这一转变进一步加速。