谷歌与 Google DeepMind 的研究人员于周三宣布成立 DeepMind 研究所,旨在推进围绕通用人工智能(AGI)的讨论。该研究所将 DeepMind 联合创始人 Shane Legg、谷歌高管 James Manyika 以及 Google DeepMind 主席 Demis Hassabis 列为董事,其中 Legg 担任执行主编。
这家新研究所的目标是呈现谷歌、Google DeepMind 与更广泛的全球研究社群在 AGI 问题上的不同观点。公告写道:“他们不会始终意见一致,而且随着这一快速演进的前沿领域涌现更多数据与信息,他们的看法也可能发生改变。”
首批发布的四篇文章涵盖多个议题:应对潜在 AGI 冲击的经济政策、保留人类可读的模型推理过程、促进人类繁荣的原则,以及评估前沿 AI 模型的框架。
其中一篇文章由 DeepMind 安全研究员 Rohin Shah 和 Anca Dragan 撰写,认为 AI 透明度窗口不断收窄——即查看并核验模型逐步推理过程的能力——并非不可避免。随着新架构使最强大的模型更难被监控,作者表示,开发者和监管机构应直面其中的安全权衡。这可能意味着限制“不透明串行深度”,即模型在不产生可读推理轨迹的情况下所能执行的顺序计算量,或者要求开发者证明透明度较低的系统仍同样可被监控。
在另一篇文章中,Hassabis 提议建立一个由美国主导的前沿 AI 标准机构,用以评估最先进的 AI 模型。按照他的框架,开发者最初将在发布前最多 30 天自愿提交模型接受审查。一旦评估体系被证明有效,通过其测试可能成为在美国部署前沿模型的必要条件。
该机构起初将与 AI 公司协商设计评估方案,但最终会制定独立且不公开的评估——文章称之为“留存”测试——以防止实验室针对已知评估调整其模型。Hassabis 表示,这一框架可以“在形势的严峻程度需要时逐步加码”,其中可能包括前沿 AI 开发者之间的协同放缓。
这些文章的发布正值行业安全讨论从宽泛的担忧表述转向更具体的披露建议、外部审查,以及在保障措施落后时协同放缓。这一转变本周加速,因为多位行业领袖支持 Anthropic CEO Dario Amodei 关于“调节”前沿 AI 发展节奏的呼吁中的部分内容。