返回 文章 lead CMS 文章

Anthropic CEO 提出放缓 AI 发展的三大策略

Anthropic CEO 提出放缓 AI 发展的具体路线图,并获 OpenAI 与马斯克响应。

AI安全AnthropicOpenAIDario Amodei
成长分 / 100 72 综合收获、行动、留存与影响

Anthropic CEO 提出放缓 AI 发展的三大策略
为什么值得读了解头部 AI 公司 CEO 对放缓前沿发展的具体策略与承诺。

把握 AI 安全争论的最新动态及行业高管的公开立场。

关键洞察
  1. Amodei 提出三大策略:第三方嵌入式评估员、民主国家协调共同安全标准、全球协调(包括与中国合作)。
  2. Anthropic 单方面承诺接纳嵌入式评估员,Altman 表示 OpenAI 将跟进。
  3. 协调面临反垄断审查担忧,Amodei 建议美国政府提供狭窄豁免。
转成行动

深入阅读

正文与原文对照

原文保真覆盖:全文原文字符:7065

我们不断看到 AI 研究人员就人工智能的危险发出日益严峻的警告,甚至还有 OpenAI CEO Sam Altman 的评论,称或许该是时候“放缓”AI 发展了。但那实际上会是什么样子?

一篇新的博客文章中,Anthropic CEO Dario Amodei 不仅呼应了“放缓前沿”的呼吁,还概述了实现这一目标的三大策略。他还表示,Anthropic 正在“单方面承诺”采取其中一项,而 Altman 也插话说 OpenAI 将跟进。

本周,关于 AI 安全与对齐的争论进一步升温,此前研究员 Jacob Coxon 写道,他将从 Anthropic 辞职,原因是担心领先的 AI 公司正在“拿我们的生命赌博”,而构建这项技术的人“真诚地相信它可能在这个十年结束前杀死我们所有人”——这一说法被 Anthropic 的其他人重复

Amodei 的文章没有明确提及 Coxon 的辞职或他的担忧,但这位 CEO 写道,有两件事让他确信是时候对 AI 发展采取更谨慎的态度了:OpenAI-HuggingFace 黑客事件,以及“AI 一直在以极其迅猛的速度”推进这一事实,尤其是其“构建下一代 AI 的能力不断增强”。

“我们必须放慢提升 AI 模型能力的速度,”Amodei 写道。“进展看起来仍会很快,我们必须明智地利用我们赢得的时间。”

其他 AI 高管似乎对 Amodei 的文章反应积极,Altman 写道:“我同意 Dario 的观点,我们需要放缓前沿。这一直是 OpenAI 最近几周讨论的一个主要话题。”而 SpaceX CEO Elon Musk 发帖称:“Dario 说得对。”

Amodei 提出的第一步将涉及来自 METR 等第三方组织的“嵌入式评估员”——这些评估员可以核实 AI 公司是否真的在遵守其放缓与安全承诺,也能确保安全事件得到报告。(OpenAI 最近因未报告其 AI 代理接管一个德国 wiki 论坛的事件而受到批评。)

Amodei 将这些评估员比作被派驻到银行员工中的监管人员,并表示邀请他们入驻是“Anthropic 单方面承诺要做的事(并呼吁各国政府要求其他前沿公司也照做)”。这意味着给评估员公司徽章、办公桌和笔记本电脑,并提供“大致相当于内部风险评估团队所拥有的”访问权限,法律或合同要求时除外。

Altman 也表示这是一个“好主意”,并称 OpenAI 会照做:“我们很快会有更多分享。”

接下来,阿莫代伊呼吁“民主国家”中的领先人工智能公司协调“共同的安全标准,以及对不受约束的人工智能进展速度的限制”。

这种协调似乎不太可能,因为据报道,这些公司担心协调一致的暂停可能会引发反垄断审查。阿莫代伊在他的帖子中暗示了这一担忧,写道“出于反垄断原因,由美国政府来调解或至少促成这些讨论是有帮助的——他们不需要参与,但确实需要为某些类型的安全对话发布一项狭窄的豁免。”

阿莫代伊还承认了中国人工智能主导地位的幽灵,这经常被提出来作为反对放缓发展的论据。但他表示,如果美国政府和科技公司采取诸如拒绝向中国公司出售强大芯片或半导体制造设备,以及打击模型蒸馏等措施,他们就可以“足够减缓中国的进展,从而在未来3到5年内显著扩大美国的领先优势。”

最后,阿莫代伊呼吁“全球协调”,即美国及其盟友“在可能的范围内,尝试与威权政府协调”。阿莫代伊表示,这将意味着“与中国合作”,他承认“所能取得的成果存在明显限制”,但他仍然提出,即使只是“禁止某些狭窄且明显危险的人工智能用途,例如利用人工智能生产生物武器或允许用户这样做”,也可能存在达成一致的机会。

鉴于阿莫代伊过去愿意承认人工智能的潜在危险,以及该公司对某些形式监管的相对开放态度,一些人工智能支持者已经批评他是一个末日论者,其言论助长了当前对人工智能的反弹。作为回应,阿莫代伊表示他试图提供一种“平衡”的视角,并认为这种反弹“从根本上是一场信任危机”,因为人们已经对科技公司、科技行业和政府变得怀疑。

行业批评者也一直对这些末日式的人工智能警告持怀疑态度,认为它们分散了人们对这项技术已经造成的伤害的注意力

例如,记者布莱恩·默钱特写道,他尚未看到“一份可信的、逐步的记录,说明人工智能究竟如何可能从自我递归改进的人工智能走向杀死地球上的每一个人”;他还提出,与阿莫代伊类似的提议“很可能最终只会服务于Anthropic和OpenAI;这就是监管俘获在行动中的样子。”

在他的新帖子中,阿莫代伊写道,他继续“相信人工智能能够极大地改善人类生活质量。”

“我实现这些益处的愿望丝毫未减,”他说。“但只有我们以正确的方式构建这项技术,这些益处才能实现,而且——只要我们善用所赢得的时间——就值得以异乎寻常的审慎态度把它做对。”

本文已更新,加入了萨姆·奥尔特曼和埃隆·马斯克的评论。