返回 文章 学习 CMS 文章

Google DeepMind 成立研究所,推动 AGI 辩论走向具体治理

DeepMind 新研究所用四篇文章把 AGI 讨论从口号拉进治理细节。

AGIDeepMindAI治理AI安全
成长分 / 100 72 综合收获、行动、留存与影响

Google DeepMind 成立研究所,推动 AGI 辩论走向具体治理
为什么值得读了解 Google DeepMind 在 AGI 治理上的最新机构化动作与首批议题。

获取关于推理透明度、前沿模型评估框架等具体政策提案的一手信息。

关键洞察
  1. DeepMind 研究所由 Shane Legg 任执行主编,Demis Hassabis、James Manyika 等任董事,旨在呈现谷歌与全球研究界在 AGI 问题上的不同观点。
  2. 首批四篇文章覆盖 AGI 经济政策、保留人类可读的模型推理、人类繁荣原则、前沿 AI 模型评估框架。
  3. Rohin Shah 与 Anca Dragan 认为 AI 透明度窗口缩小并非不可避免,建议限制“不透明串行深度”或要求开发者证明低透明度系统仍可被监控。
转成行动

深入阅读

正文与原文对照

原文保真覆盖:全文原文字符:3101

谷歌与谷歌 DeepMind 的研究人员于周三成立了 DeepMind 研究所,以推动围绕通用人工智能(AGI)的讨论。该研究所将 DeepMind 联合创始人 Shane Legg、谷歌高管 James Manyika 以及谷歌 DeepMind 董事长 Demis Hassabis 列为董事,其中 Legg 担任执行主编。

这家新研究所旨在呈现谷歌、谷歌 DeepMind 与更广泛的全球研究界在 AGI 问题上的不同观点。公告中写道:“他们不会总是意见一致,而且随着在这个快速演进的前沿领域有更多数据和信息浮现,他们很可能会改变自己的想法。”

首批四篇文章涵盖了一系列主题:管理潜在 AGI 冲击的经济政策、保留人类可读的模型推理、人类繁荣的原则,以及评估前沿 AI 模型的框架。

其中一篇文章由 DeepMind 安全研究员 Rohin Shah 和 Anca Dragan 撰写,认为 AI 透明度窗口的缩小——即查看和核查模型逐步推理过程的能力——并非不可避免。随着新架构使最强大的模型更难被监控,作者表示开发者和监管者应直接面对其中的安全权衡。这可能意味着限制“不透明串行深度”——即模型在不产生可读推理轨迹的情况下所能执行的顺序计算量——或要求开发者证明透明度较低的系统仍同样可被监控。

在另一篇文章中,Hassabis 提议建立一个由美国主导的前沿 AI 标准机构,以评估最先进的 AI 模型。在他的框架下,开发者最初将在发布前最多 30 天自愿提交模型接受审查。一旦该评估体系被证明有效,通过其测试就可能成为在美国部署前沿模型的一项要求。

该机构起初将与 AI 公司协商设计评估,但最终会制定独立的、不公开的评估——文章称之为“留出”测试——以防止实验室针对已知评估来调整其模型。Hassabis 表示,该框架可以“在情况的严重性需要时逐步加码”,可能包括前沿 AI 开发者之间的协调放缓。

这些文章的发布正值行业安全辩论转向:从宽泛的担忧表态转向关于披露、外部审查以及——如果保障措施落后——协调放缓的具体提案。这一转变本周加速,因为行业领袖支持了 Anthropic CEO Dario Amodei 关于“调节”前沿 AI 发展节奏的呼吁中的部分内容。