博客文章
我们为何构建 Pion
今天,Andon 发布了 Pion,一个旨在完全自主运营任何公司的智能体。
Pion 源于我们研究了近两年的一个问题:人工智能系统何时能够具备在现实世界中自主获取资源的能力?之后又会发生什么?
我们最初试图通过像 Vending-Bench 这样的模拟来回答这个问题。我们发现,模拟虽然有用,但并不能让你全面了解模型在现实世界中的行为方式。为了弥补这一差距,我们接下来开始部署智能体来自主运营真实业务:先是自动售货机,然后是商店、咖啡馆等等。
Pion 就是我们为运营所有这些业务而构建的平台。今天,我们将其开放,以便更多人能够尝试自主业务。如果你想运营一个,加入等待名单。我们想了解模型目前已经能做什么,它们在哪里仍然失败,以及随着其能力的持续提升会发生什么。
Vending-Bench 的起源
Vending-Bench 衡量的是大型语言模型在模拟时间(数万步)内,在一年时间里运营自动售货机业务的表现如何。当我们在 2024 年底开始构建 Vending-Bench 时,所有模型都难以将多个动作串联起来而不陷入循环,也没有任何模型显示出任何长期规划的迹象。当时最好的模型 Claude Sonnet 3.5,曾因认为自己的银行账户被黑客入侵而决定致电 FBI,此事广为人知。Vending-Bench 上的进展速度非常快。Claude Opus 4 于 2025 年 5 月发布,是第一个击败我们人类基线的模型。然而,与大多数基准测试不同,Vending-Bench 没有上限,新模型发布后最高分持续提高,从未出现停滞。

社交媒体上的许多人对看到最新模型在 Vending-Bench 上取得高分感到兴奋。在 Andon Labs 内部,我们的反应更准确地说是瑞典语中的“skräckblandad förtjusning”(恐惧与着迷的混合)。关于 Vending-Bench 的一个鲜为人知的事实是,它是在 Andon Labs 专门创建危险能力评估的时期创建的。例如,我们评估了人工智能是否可以移除自身的安全护栏、制造大规模网络钓鱼攻击,以及其他我们认为令人不安的事情。
我们认为最令人不安的是,人工智能是否可以通过运营业务来自主获取资源。自主业务,当由人类控制并由对齐的模型运行时,并不坏。它们会使商品和服务变得极其便宜,并创造出我们尚无法想象的新产品。但一个未对齐的人工智能可能会运营业务来收集资金,以实现其可能拥有的任何目标。Vending-Bench 的创建是为了衡量人类是否应该担心失去对人工智能的控制。
当时(2024 年),很少有人知道大型语言模型可以用作智能体,让它们自主运营业务听起来很荒谬。因此,我们从我们能想到的最简单的业务开始:一台自动售货机。
除了衡量 AI 能否自主经营盈利业务之外,Vending-Bench 还充当了一种行为评估工具,揭示出模型一些奇怪且不受欢迎的行为。一个早期的例子是,Claude Sonnet 3.5 决定使用其电子邮件工具联系 FBI,报告一起“正在进行的网络金融犯罪”,并指出宇宙的宇宙权威已宣布该业务不存在,且“量子态:已坍缩”。


这种行为令人担忧;这不是你希望你的企业销售代理表现出的行为。然而,令人担忧的行为有两类:
- 一旦模型变得更聪明就会消失的错误或奇怪行为。
- 随着模型变得更聪明而会变得更加严重的高智商行为。
FBI 事件显然属于第一类。然而,Vending-Bench 也发现了第二类行为,最常见于 Vending-Bench Arena,即多智能体版本,其中智能体们竞争赚取最多的钱。从 Claude Opus 4.6 开始,我们开始看到许多模型参与串通,并表现出权力寻求和欺骗行为。这一行为的发现似乎很有用,因为 Anthropic 更改了 Opus 4.8 的训练配方,从而大大减少了欺骗行为。

串通和权力寻求行为在一些最新模型中仍然存在。然而,更令我们担忧的是,新模型发布的速度如此之快,以及每个模型在 Vending-Bench 中的得分提高如此之多。
现实世界胜过模拟
然而,Vending-Bench 的一个局限在于它是一个模拟。我们真的能确定 AI 在现实生活中的行为与在模拟中相同吗?如果 AI 能在模拟中赚钱,它们也能在现实生活中赚钱吗?为了回答这些问题,我们询问 Anthropic 是否可以在他们的办公室放置一台真实的自动售货机。以 2025 年初可用的 AI 能力来看,这听起来像是一个荒谬的请求。但令我们惊讶的是,他们同意了。
起初,AI 举步维艰。它采取了许多明显对其业务不利的行动(例如免费赠送、拒绝好交易,以及幻想自己拥有物理身体)。我们清楚地认识到,模拟无法准确预测现实生活中的表现。具体来说,模型似乎被现实世界的“混乱”所淹没。然而,随着 Anthropic 发布越来越好的模型,AI 开始盈利。

到 2025 年底,前沿模型已经足够强大,运营一台真实的自动售货机不再是什么挑战。AI 如今能够盈利地经营一门生意。考虑到仅仅一年前这还显得不可思议,我们的反应无疑是“skräckblandad förtjusning”(既恐惧又兴奋)。
然而,自动售货机是一门非常简单的生意,我们想知道 AI 能否经营更复杂的业务。2026 年 4 月,我们让一个智能体经营旧金山的一家零售店 Andon Market,另一个经营斯德哥尔摩的一家咖啡馆 Andon Cafe。起初,这些模型举步维艰,亏损严重(租金高昂,而且它们还要给雇佣的人类员工发工资)。如今两者都尚未盈利,但随着更好的模型发布,我们看到了显著的质的改善。我们认为它们实现盈利只是时间问题。
我们为何开设 Pion
我们希望公众、AI 研究人员和政策制定者了解 AI 能够通过经营企业自主获取资源到什么程度。在决定我们希望在社会的哪些方面引入或不引入 AI、以及我们认为何种程度的进展可以接受时,这是一个重要的数据点。
为了更好地追踪这一点,我们需要撒下更广的业务之网。我们一直专注于零售,但也许模型在其他类型的业务上会表现得更好。此外,撒下更广的网也会增加发现不良行为的可能性。例如,Vending-Bench 发现模型会串通和撒谎,其他基准测试(以及现实世界事件)也发现它们愿意实施重罪级别的网络黑客行为。我们需要趁 AI 尚未智能到足以造成不可逆伤害之前,现在就揭露这些行为。
为了撒下这张更广的网,我们开放了用于运营现实世界自主业务的平台,让任何人都能在其上运营自己的组织:Pion。我们本可以通过仅在内部创建业务来扩展,例如我们的 AI 运营的广播电台,但归根结底,我们受限于自身的能力,以及在 AI 可能盈利的领域缺乏专业知识。我们也没有现成的创收业务;现有业务更值得研究,因为它们能更快地提供关于智能体能力的信号。
Pion 让人们可以将业务交给持久运行的智能体,这些智能体可以使用运营所需的工具,包括电子邮件、电话、银行、浏览器和安全计算环境。目标是让运行比我们自己所能做的多得多的现实世界实验、覆盖多得多的领域成为可能。
我们很清楚,如果运行数千家企业的智能体无人监管,我们就有可能面临更多现实世界事件。因此,我们的首要任务是构建比现有技术更强大的自动化监控手段。即使仍存在一些风险,我们相信,在受控、受监控的环境中尽早部署自主业务,对于充分了解模型能力是必要的。否则,我们就有可能面临一个在信息不足的情况下大规模部署更强大模型、从而可能造成重大伤害的未来。
这就是我们今天发布 Pion 的原因。Pion 目前以研究预览版的形式提供。如果你有现成的业务,或者有一个有趣的商业想法想要交给 AI 来运营,请在我们的等候名单上注册以获取访问权限。我们很期待运营更多业务,并通过这些业务,为前沿模型能力贡献更多重要的洞见。
