产品TechCrunch AI·原文 2026年9月18日

Google DeepMind成立研究所,把AGI争论摆到台面上

新研究所由Shane Legg、James Manyika和Demis Hassabis担任董事,首批四篇文章讨论经济政策、模型推理可读性、人类繁荣原则与前沿模型评估框架;Hassabis另提议设立美国主导的前沿AI标准机构。

AI解读:Google和Google DeepMind的研究者周三成立了DeepMind Institute,目的不是给出AGI的官方答案,而是把Google、DeepMind和外部研究社群之间不一致的看法公开摆出来。公告自己就说,这些人不会总是一致,随着新数据出现也可能改变主意。

对关注AI治理的人来说,这个研究所的价值在于首批四篇文章里有具体提案:比如安全研究员Rohin Shah和Anca Dragan认为模型推理越来越难被看懂并非必然,可以通过限制“不透明串行深度”或要求开发者证明低透明度系统同样可监控来应对。

Hassabis的提议更接近监管设计:由美国主导成立前沿AI标准机构,开发者起初在发布前最多 30 天自愿提交模型审查,等评估体系被证明有效后,通过测试可能成为在美国部署前沿模型的必要条件。

这些文章出现的时机是行业安全讨论从泛泛担忧转向披露、外部审查和必要时协调减速等具体方案,本周一些行业领袖还支持了Anthropic CEO Dario Amodei关于“放慢”前沿AI开发的呼吁。普通读者暂时不需要行动;真正相关的是前沿模型开发者和政策制定者,因为提案里的自愿审查、 held-out测试和潜在减速都直接改变他们的发布流程与合规选项。

Google和Google DeepMind的研究者周三成立了DeepMind Institute,目的是推进围绕通用人工智能(AGI)的讨论。

该研究所列出DeepMind联合创始人Shane Legg、Google高管James Manyika和Google DeepMind主席Demis Hassabis担任董事,Legg兼任managing editor。

研究所的目标是呈现Google、Google DeepMind与更广泛的全球研究社群之间围绕AGI的不同观点。公告写道:“他们不会总是一致,随着快速变化的前沿出现更多数据与信息,他们也可能改变想法。”

首批收录四篇文章,主题包括管理潜在AGI颠覆的经济政策、保留人类可读的模型推理、人类繁荣原则,以及评估前沿AI模型的框架。

DeepMind安全研究员Rohin Shah和Anca Dragan在一篇文章中认为,AI透明度窗口缩小——即查看并核对模型逐步推理的能力——并非不可避免。随着新架构让最强模型更难被监控,作者称开发者和监管者应直接面对安全权衡。

另一篇文章中,Hassabis提议设立一个美国主导的前沿AI标准机构,用于评估最先进的AI模型。按照他的框架,开发者起初将在发布前最多 30 天自愿提交模型接受审查;一旦评估体系被证明有效,通过其测试可能成为在美国部署前沿模型的要求。

安全研究员:透明度缩小不是必然,可限制“不透明串行深度”

Shah和Dragan的文章指出,随着新架构让最强大的模型更难被监控,开发者和监管者应该直面安全权衡。

他们提出的可能做法包括限制“不透明串行深度”,即模型在不产生可读推理轨迹的情况下所能执行的顺序计算量;或者要求开发者证明透明度较低的系统仍然同样可监控。

Hassabis提议美国主导的前沿AI标准机构

该机构最初与AI公司协商设计评估,但最终会开发独立、不公开的评估,文章称之为“held-out”测试,目的是防止实验室针对已知评估来调整模型。

Hassabis表示,如果情况的严重性需要,这个框架可以“逐步加码”,可能包括前沿AI开发者之间的协调减速。

文章发布之际,行业安全讨论转向具体提案

这些文章出现之际,行业的安全辩论正从宽泛的担忧声明转向关于披露、外部审查以及保障措施落后时协调减速的具体提案。

本周这一转向加速,因为行业领袖支持了Anthropic CEO Dario Amodei呼吁“放慢”前沿AI开发的部分内容。

信息来源

TechCrunch AI原始来源