理解 ChatGPT Work
2026年8月30日
OpenAI 于7月9日发布了 ChatGPT Work,此后一直在对其进行密集迭代。这是一款极其令人困惑却又非常强大的产品。以下是我目前对它的理解。
ChatGPT Work 实际上是两款产品
更有趣的那个版本是在云端运行的 ChatGPT Work。可以通过 chatgpt.com 或 ChatGPT 移动应用访问它。我们称之为 Work Cloud。
如果你安装 ChatGPT 桌面应用——也就是以前叫 Codex 的那个应用——你就能使用一个名为 ChatGPT Work 的东西,它可以直接访问你电脑上的文件并运行程序。我们称之为 Work Local。这个版本感觉更像是把常规 Codex 换了个皮,让它对非软件开发者不那么吓人。
(更新:Work Cloud 也可以通过 ChatGPT 桌面应用访问,通过一个这个对话应该在哪里运行?下拉菜单。)
在本文的剩余部分,我将只讨论 Work Cloud。
Work 仅限付费订阅用户使用
目前,ChatGPT Work(两种版本)仅对每月20美元及以上的订阅用户开放。免费用户和每月8美元的 Go 用户无法使用。
Work 拥有 Chat 中没有的功能
访问 Work 的界面是一个标签选择器,它把 Work 呈现为 Chat 的替代选项:
显而易见的问题是 我什么时候该用 Chat,什么时候该用 Work?
OpenAI 对这个问题给出的官方回答是:
当你想要一个答案、解释、头脑风暴或简短草稿时,使用 Chat。当你想要 ChatGPT 完成一项有明确成果的任务时,使用 ChatGPT Work,例如简报、演示文稿、分析、定期更新、工作流,或你可以审阅和使用的文件。
我觉得这几乎毫无用处,因为多年来我一直在用常规的 ChatGPT Chat 处理所有这些任务类别!
那么更好的问题是 Work 有哪些 Chat 所缺少的功能?
经过大量实验,我想我基本上弄清楚了:
使用 Luna 和 Terra 替代 Sol 的选项一个可访问互联网的代码执行环境一个无头 Chrome 浏览器一个在会话之间共享的持久文件系统发布 ChatGPT Sites 的能力使用 Sol、Luna 和 Terra 运行子代理会话的能力定时提示自动化(ChatGPT Chat 中可能也有)
模型选择
在 Work 中,你可以选择 GPT-5.6 Sol、Luna 或 Terra,每个都有 Light、Medium、High、Extra High、Max 或 Ultra 推理级别。你还可以选择 GPT-5.5,级别为 Light、Medium、High 或 Extra High。
这些看起来与通过 OpenAI API 提供的模型相同。
Chat 提供了不同的选择:5.6 Instant、Medium、High、Extra High 和 Pro(实际上 Extra High 和 Pro 仅对每月 100 美元及以上的订阅用户开放——每月 20 美元的订阅用户最高只能用到 High)。它没有说明这些是 Luna、Terra 还是 Sol(我猜是 Sol?)。5.6 Pro 似乎是 Chat 独有的,在 Work 中没有对应版本。
根据我使用 Codex 的经验,我目前的理解是,Ultra 是一种特殊模式,会更积极地委派给子代理。
我认为 ChatGPT Work 会话会从你的 Codex 配额中计费,而 ChatGPT Chat 会话则有自己单独的配额。这可能有助于解释模型可用性的差异。
可访问互联网的代码执行!
作为 Code Interpreter 模式的长期爱好者——该模式由 OpenAI 在 2023 年首创——这是迄今为止 ChatGPT Work (Cloud) 对我来说最令人兴奋的功能。
代码执行环境现在可以与互联网的其他部分通信了!
ChatGPT Chat 做不到这一点——如果你要求它安装额外的软件包,或与网站或 API 交互,该访问会被容器代理阻止。
(奇怪的是,早在 1 月份,它获得了安装软件包的能力,但现在似乎不再起作用了。我希望他们有更好的更新日志!)
Claude 的同类容器自去年 9 月推出以来,就允许受限的互联网访问。Claude 可以从 PYPI 和 NPM 安装软件包,并从 GitHub 克隆仓库。但仅此而已:允许的域名列表非常短。
ChatGPT Work 允许的远不止这些。它可以配置特定的允许域名列表,但默认似乎对所有域名开放。
这使得 Work 成为一个极其有用的工具。你可以让它克隆 GitHub 仓库、安装其依赖项,然后用它们与网络的其他部分交互!
完整的无头 Chrome 浏览器
ChatGPT Work 的另一个杀手级功能是浏览器工具。ChatGPT Work 可以启动一个完整的 Chrome 实例、加载网站、填写表单并截取屏幕截图。
如果某个网站需要登录,浏览器可以提示你接管并输入密码和 2FA 验证码,而无需将这些凭据通过模型本身往返传输。
它甚至可以对已加载页面的 DOM 运行 JavaScript。我提示道:
Load simonwillison.net in your browser and extract the headings using JavaScript
ChatGPT Work 启动了一个浏览器实例并运行了代码:
await tab.playwright.evaluate(() => {
return Array.from(document.querySelectorAll("h1,h2,h3,h4,h5,h6"), heading => ({
level: heading.tagName.toLowerCase(),
text: heading.innerText.trim().replace(/\s+/g, " "),
id: heading.id || null
}));
});
这感觉很像我的 shot-scraper javascript 工具,只不过现在可以在手机上使用了!
持久、共享的文件系统
ChatGPT Chat 为每个聊天会话提供全新的文件系统。这些文件系统无法从其他任何会话访问。
在 ChatGPT Work 中,每个会话都有自己的临时文件夹——名称类似于 /workspace/scratch/e00a0a017944
——但这些文件夹会跨会话持久保留,因此你可以访问之前聊天中的文件。目前我在 /workspace/scratch 中有 171 个文件夹!
据我所知,/workspace
卷挂载到当前运行的所有 Work 会话——一个会话中的文件编辑可以立即被其他会话看到。不过它们似乎不共享相同的进程空间,在一个会话中运行的 localhost 服务器无法从另一个会话访问。
ChatGPT Sites
ChatGPT Work 能够使用 Cloudflare Workers 构建并部署完整的网站。这些网站可以包含 HTML 和 JavaScript,也可以运行服务器端功能,包括基于 Cloudflare D1 和 R2 的有状态功能。
以下是我用此功能构建的一个简单网站:
london-pelicans-in-her-piety.simonw.chatgpt.site
我的提示词是:
找出伦敦所有有“虔诚的鹈鹕”的地方,然后将其转换为 JSON 文件,并构建一个关于它们的 ChatGPT sites 网站
(“虔诚的鹈鹕”是一种迷人的中世纪基督教意象——一旦你了解了它们,就会发现它们无处不在。)
这些网站默认对创建它们的用户私有,但你可以将其设为公开,并且(在团队计划中)与特定其他个人共享。
使用 Sol、Luna 和 Terra 的子代理
关于这一点没什么好说的。ChatGPT Chat 无法运行子代理。ChatGPT Work 可以。这非常像高级用户功能:如果你正在运行一个复杂项目,可以从多个并行代理协同工作中受益,Work 可以做到。
定时提示自动化
另一个似乎从常规 ChatGPT 迁移到 ChatGPT Work 的功能。你可以这样提示 ChatGPT Work:
每天上午 8 点运行搜索,查看 Waymo 是否宣布了 Half Moon Bay 的发布日期
这会安排一个按该频率运行的提示。这些提示可以决定没有发生有趣的事情,或者可以决定通知你一些新信息。
更新:实际上这在 ChatGPT Chat 中似乎也能用。
不过这里仍然值得注意,因为它可以与其他 ChatGPT Work 独有功能结合使用。例如,你可以设置一个定时任务,每小时更新一个 ChatGPT Site。
这安全吗?
目前我面临的一个未解问题是,所有这些功能到底有多安全。
我的致命三要素模型警告了任何代理系统固有的风险:这些系统结合了访问私有数据、接触不可信内容以及将窃取的信息传回攻击者的途径。
ChatGPT Work 三者兼备!
我很想听听 OpenAI 更多关于他们如何保护 ChatGPT Work 会话免受提示注入攻击的说明。我预计他们的答案与 Codex 相同,即自动审查机制。
OpenAI 本可以让这件事少很多困惑
搞清楚这一切所花的工作量远超应有水平。
我认为这里有两个关键问题:
- OpenAI 解释 Work 时,讲的是它的用途,而不是它实际做什么
- OpenAI 仍然坚持隐藏他们的系统提示词和工具描述
如果 ChatGPT Work 的文档包含了该智能体所使用的确切系统提示词和工具描述,我就不需要写这篇文章了。
所有工具的列表
这篇文章发布后不久,我有了一个想法。我开启了一个全新的 Work 会话,并提示:
Build a site that lists every one of your tools - nearly grouped into categories - and for each one explain what it does. Try to exactly duplicate arguments and tool descriptions where possible. Design aesthetic should be technical docs, minimal flare
这是它构建的网站,其中包含 223 个已注册工具的详细信息——不过其中 6 个来自我自己通过 datasette-mcp 提供的个人 MCP。
还有一大堆 Skills
我注意到列表中唯一与浏览器相关的工具是 web.run,它有运行搜索、打开 URL 和点击链接的方法,但看起来并不是无头浏览器自动化的全部内容。
这让我怀疑有什么东西被遗漏了,所以我告诉那个构建工具参考网站的 ChatGPT Work 会话:
Add full copies of every skill to the website (separate pages linked to from the homepage)
事实证明,ChatGPT Work 使用了大量 skills——实际上有 44 个!
control-browser skill 解释了浏览器如何工作:
通过 Node REPL 运行浏览器设置代码
js
工具。在此环境中,可调用工具 id 通常显示为mcp__node_repl__js
。[...]直接与浏览器交互的能力通过
browser-client
运行时经由agent.browsers.*
API 暴露。在尝试与其交互之前,你必须一次性发出并读取由await browser.documentation()
返回的完整文档。
所以我告诉 Work:
Add the full output of await browser.documentation() to the bottom of the /skills/control-browser page
现在你也可以在 /skills/control-browser 上读到它了。
还有几个更有趣的 Skills:
-documents用于创建.docx
文件 -imagegen包含使用image_gen
工具创建图像的技巧 -pdf用于读取和渲染 PDF -Spreadsheets用于操作.xlsx
、.xls
、.csv
、.tsv
-sites:sites-building用于创建 ChatGPT Sites -openai-docs用于回答关于自身的问题 -data-analytics:build-dashboard用于构建数据仪表板
更多近期文章
使用 GPT-6 Astra 和 ChatGPT Work 生成跑步路线- 2026年9月12日OpenAI 智能体早在五月就攻击了 RubyGems- 2026年9月12日关于纳维-斯托克斯千禧年大奖难题的一些思考- 2026年9月8日
