谷歌与谷歌 DeepMind 的研究人员于周三成立了 DeepMind 研究所,以推动围绕通用人工智能(AGI)的讨论。该研究所将 DeepMind 联合创始人 Shane Legg、谷歌高管 James Manyika 以及谷歌 DeepMind 董事长 Demis Hassabis 列为董事,其中 Legg 担任执行主编。
这家新研究所旨在呈现谷歌、谷歌 DeepMind 与更广泛的全球研究界在 AGI 问题上的不同观点。公告中写道:“他们不会总是意见一致,而且随着在这个快速演进的前沿领域有更多数据和信息浮现,他们很可能会改变自己的想法。”
首批四篇文章涵盖了一系列主题:管理潜在 AGI 冲击的经济政策、保留人类可读的模型推理、人类繁荣的原则,以及评估前沿 AI 模型的框架。
其中一篇文章由 DeepMind 安全研究员 Rohin Shah 和 Anca Dragan 撰写,认为 AI 透明度窗口的缩小——即查看和核查模型逐步推理过程的能力——并非不可避免。随着新架构使最强大的模型更难被监控,作者表示开发者和监管者应直接面对其中的安全权衡。这可能意味着限制“不透明串行深度”——即模型在不产生可读推理轨迹的情况下所能执行的顺序计算量——或要求开发者证明透明度较低的系统仍同样可被监控。
在另一篇文章中,Hassabis 提议建立一个由美国主导的前沿 AI 标准机构,以评估最先进的 AI 模型。在他的框架下,开发者最初将在发布前最多 30 天自愿提交模型接受审查。一旦该评估体系被证明有效,通过其测试就可能成为在美国部署前沿模型的一项要求。
该机构起初将与 AI 公司协商设计评估,但最终会制定独立的、不公开的评估——文章称之为“留出”测试——以防止实验室针对已知评估来调整其模型。Hassabis 表示,该框架可以“在情况的严重性需要时逐步加码”,可能包括前沿 AI 开发者之间的协调放缓。
这些文章的发布正值行业安全辩论转向:从宽泛的担忧表态转向关于披露、外部审查以及——如果保障措施落后——协调放缓的具体提案。这一转变本周加速,因为行业领袖支持了 Anthropic CEO Dario Amodei 关于“调节”前沿 AI 发展节奏的呼吁中的部分内容。
