Google与Google DeepMind于2026年9月17日推出“DeepMind Institute”,旨在拓展围绕通用人工智能(AGI)的讨论,并凸显Google、Google DeepMind以及世界各地研究人员之间立场的差异。该研究院由DeepMind联合创始人Shane Legg、Google高管James Manyika和Google DeepMind负责人Demis Hassabis共同领导,Legg还担任执行编辑。
该研究院将自身定位为一个展示不同观点的空间,这些观点不一定始终一致,也可能会随着这一快速发展领域出现新的数据和信息而发生变化。在这一举措推出之际,人工智能安全讨论正从公开声明转向更具体的提案,涉及信息披露、外部审计,以及在没有相应保障措施配套的情况下放缓先进模型开发。
讨论的四个角度
该研究院的首批内容包括四篇文章,分别讨论应对通用人工智能可能造成的经济动荡的政策、保持人类理解模型推理的能力、支持人类繁荣的原则,以及评估前沿人工智能模型的框架。
在其中一篇文章中,DeepMind安全研究员Rohin Shah和Anca Dragan警告称,研究人员观察和验证模型推理步骤的能力下降并非必然结果。随着模型架构发展,使得更强大的模型越来越难以监控,两位研究人员呼吁开发者和监管机构直接处理与安全相关的权衡问题。
他们提出的选项包括限制“非透明串行深度”(opaque serial depth),即模型能够在不生成可读推理路径的情况下执行的连续计算量;或者要求开发者证明,透明度较低的系统仍然能够以同等水平接受监控。
美国评估模型框架
在另一篇文章中,Hassabis提议成立一个由美国主导的先进人工智能标准机构,用于评估最先进的模型。按照提出的设想,开发者在发布前最多提前30天自愿提交模型接受审查;如果评估体系证明有效,之后通过测试将成为在美国境内发布前沿模型的条件。
该机构最初将与人工智能公司协商设计评估测试,随后转向独立且不提前公布的测试,即该框架所称的“留出测试”(held-out tests),以防止实验室根据已知测试预先优化模型。提案还提到,可以逐步加强措施;如果形势的危险程度需要,最终可由先进模型开发者进行协调放缓。
为什么这条消息重要?
这项倡议的实际意义不只在于创建一个新的发布平台,还在于汇集Google和Google DeepMind围绕可能影响模型开发与评估方式的议题展开的讨论。这些文章将透明度、可监控性和独立审计置于操作层面的问题上,而不仅仅是一般性原则。
不过,该研究院并不是独立的监管机构,拟议的评估框架也从自愿参与开始,尚未转变为生效政策。机构的独立性、未公开测试的性质,以及确定何时需要放缓开发的标准等问题,在本文所述范围内仍未有定论。