随着我们将 Codex 和 ChatGPT for Work 扩展到全球数百万用户,我们了解到了让长时间运行的智能体在实践中良好运作所需的条件。有用的智能体需要一个强大的执行框架,能够管理上下文、高效使用工具并协调子智能体。它们还需要能够使其可靠运行数天的基础设施,以及可以处理文件、运行代码并保存中间结果的环境。
今天,我们推出 Agents API(在新窗口中打开) 公测版,通过一个简单、灵活的 API,将驱动 Codex 的同一套执行框架和基础设施带给开发者。
借助 Agents API,你只需指定任务、模型、工具和环境,即可通过一次 API 调用创建生产就绪的智能体:
OpenAI 托管并维护执行框架。你可以选择智能体的计算环境:在 OpenAI 管理的沙箱中、在你自己的基础设施上,或使用我们的沙箱合作伙伴之一。Agents API 为你提供了在我们优化的智能体执行框架和基础设施之上构建智能体的坚实基础,让你可以专注于让你的智能体独一无二的工具、知识和工作流。

Agents API 以驱动 Codex 的同一套执行框架和基础设施为你的智能体提供支持。
不同的工作负载需要不同的计算、存储和部署选项。Agents API 让你选择适合你应用的沙箱。
我们正在与生态系统提供商合作(在新窗口中打开),包括 Blaxel、Cloudflare、Daytona、DigitalOcean、E2B、Modal、Oracle、Runloop 和 Vercel,为一系列需求提供一流的集成:
- 完全托管的环境或部署在你的 VPC 内
- 特定的文件和密钥存储机制
- 不同的 CPU、GPU 和内存配置,具有与贵公司工作流相匹配的性能、冷启动和成本特征。

Agents API 提供与流行生态系统提供商的一流集成。
对于希望快速上手并高效扩展的开发者,我们还推出了 OpenAI 托管沙箱(在新窗口中打开)。它利用了驱动 Codex 和 ChatGPT 的同一套沙箱基础设施。
OpenAI 配置并管理沙箱,为你的智能体提供一个安全且高性能的环境,用于运行代码、处理文件并生成产物。这些沙箱可以灵活配置你的文件、包、技能和插件,为智能体提供完成任务所需的一切。
利用新模型能力往往意味着要改造你的运行框架,这会占用本可用于改进应用的宝贵时间。Agents API 随每次模型发布提供对这些能力的版本化访问。我们与模型同步维护并持续改进该运行框架,帮助你的智能体在每次升级中获得更好性能。例如,近期对运行框架的改进包括:
为支持模型连续工作数小时,我们构建了上下文管理,帮助智能体在更长的会话中携带相关信息。当会话接近其上下文上限时,Agents API 会自动压缩(在新窗口中打开)较早的上下文,保留智能体继续所需的信息。开发者可以构建跨越多个上下文窗口的工作流,而无需自行实现压缩逻辑。
Agents API 帮助智能体找到合适的工具并高效使用它们。工具搜索(在新窗口中打开)按需加载相关工具定义,有助于减少 token 用量和成本,同时保留模型的缓存。工具可用后,让智能体并行运行调用、串联相关操作,并在代码中过滤或合并结果,从而能够处理大量数据,同时只将相关结果带回上下文。Agents API 支持 MCP、自定义函数以及网页搜索等内置工具。
程序化工具调用(在新窗口中打开)借助多智能体支持(在新窗口中打开),Agents API 可以将复杂任务拆分为独立的部分,并委派给并行工作的子智能体。每个子智能体维护自己的上下文,有助于它专注于自己的任务,而主智能体协调它们的工作并汇总结果。这可以加速受益于并行工作的研究、分析和编码任务,而无需你自行构建编排。
Agents API 由开源 Codex 运行框架驱动,让开发者能够了解协调模型调用、工具和上下文的核心逻辑。借助 Agents API,OpenAI 负责运营和维护该运行框架,而开发者可以查看其公开代码库(在新窗口中打开)并从中学习。
Agents API 今日面向所有开发者开放公开测试版。使用 Agents API 无需额外费用——你只需为智能体使用的 token 和工具付费,具体如我们的定价页面(在新窗口中打开)所述。
浏览Agents API 概览(在新窗口中打开)以了解更多,或按照
开始使用,将 Codex 背后的运行框架引入你自己的智能体。
快速开始(在新窗口中打开)在公开测试版期间,我们将根据你的反馈快速迭代,朝着正式可用版本推进。请告诉我们哪些方面运作良好、你在哪里遇到阻碍,以及你在生产环境中构建和运行智能体需要什么。
