理解 ChatGPT Work:它到底是什么,以及它和 Chat 有何不同
Understanding ChatGPT Work
OpenAI 于 7 月 9 日发布 ChatGPT Work,实际包含云端版(Work Cloud)和桌面应用版(Work Local)两个产品,仅向 $20/月及以上订阅用户开放。
作者实测梳理了 Work 与 Chat 的功能差异,列出联网代码执行、无头浏览器等独有能力,读者可据此判断适用场景。
OpenAI 于 7 月 9 日发布了 ChatGPT Work,此后一直在对它进行快速迭代。这是一个极其令人困惑但又非常强大的产品。以下是我目前对它的了解。
ChatGPT Work 实际上是两个产品
ChatGPT Work 更有意思的版本是运行在云端的那一个。可以通过 chatgpt.com 或 ChatGPT 移动应用访问。我们姑且称之为 Work Cloud。
如果你安装 ChatGPT 桌面应用——也就是之前叫 Codex 的那个应用——你就可以使用一个名为 ChatGPT Work 的功能,它可以直接访问你电脑上的文件并运行程序。我们姑且称之为 Work Local。这个版本感觉更像是普通 Codex 换了一层皮,让非软件开发人员不那么望而生畏。
在本文的其余部分,我将只讨论 Work Cloud。
Work 仅对付费订阅用户开放
目前,ChatGPT Work(两种形态)仅向每月 20 美元及以上的订阅用户开放。免费用户和每月 8 美元的 Go 用户无法使用。
Work 拥有 Chat 所不具备的功能
访问 Work 的界面是一个标签选择器,它将 Work 呈现为 Chat 的替代选项:

显而易见的问题是:我什么时候该用 Chat,什么时候该用 Work?
OpenAI 对这个问题给出的官方回答是:
当你想要一个答案、解释、头脑风暴或简短草稿时,请使用 Chat。当你希望 ChatGPT 完成一项有明确成果的任务时,请使用 ChatGPT Work,例如简报、演示文稿、分析、定期更新、工作流或可供你审阅和使用的文件。
我觉得这个回答几乎毫无用处,因为多年来我一直用普通的 ChatGPT Chat 来处理所有这些任务类型!
那么更好的问题是:Work 有哪些 Chat 所不具备的功能?
经过大量实验,我想我大致弄清楚了:
- 可选择使用 Luna 和 Terra 替代 Sol
- 一个可访问互联网的代码执行环境
- 一个无头 Chrome 浏览器
- 会话之间共享的持久化文件系统
- 发布 ChatGPT Sites 的能力
- 支持使用 Sol、Luna 和 Terra 运行子智能体会话
- 定时提示词自动化(ChatGPT Chat 中可能也有)
模型选择
在 Work 中,你可以选择 GPT-5.6 Sol、Luna 或 Terra,每种都提供 Light、Medium、High、Extra High、Max 或 Ultra 推理级别。你也可以选择 GPT-5.5,推理级别为 Light、Medium、High 或 Extra High。
这些看起来与通过 OpenAI API 可用的模型相同。
Chat 提供了不同的选择:5.6 Instant、Medium、High、Extra High 和 Pro。它没有说明这些是 Luna、Terra 还是 Sol(我猜是 Sol?)。5.6 Pro 似乎是 Chat 独有的,在 Work 中没有对应版本。
根据我使用 Codex 的经验,目前的理解是 Ultra 是一种特殊模式,会更积极地委派任务给子智能体。
我认为 ChatGPT Work 会话会从你的 Codex 配额中计费,而 ChatGPT Chat 会话则有自己独立的配额。这可能有助于解释模型可用性的差异。
支持联网的代码执行!
作为 Code Interpreter 模式的长期爱好者——该模式由 OpenAI 于 2023 年率先推出——这对我来说是 ChatGPT Work(Cloud)中最令人兴奋的功能,没有之一。
代码执行环境现在可以连接互联网的其余部分了!
ChatGPT Chat 做不到这一点——如果你让它安装额外的软件包,或与网站或 API 交互,这些访问都会被容器代理拦截。
(奇怪的是,今年 1 月它获得了安装软件包的能力,但现在似乎又不行了。真希望他们有更好的更新日志!)
Claude 的同类容器自去年 9 月推出以来,一直允许受限的互联网访问。Claude 可以从 PYPI 和 NPM 安装软件包,也可以从 GitHub 克隆仓库。但也就仅此而已:允许访问的域名白名单非常短。
ChatGPT Work 允许的远不止这些。它可以配置为仅允许访问特定的域名列表,但默认设置似乎是开放访问所有域名。
这使得 Work 成为一款极其有用的工具。你可以让它克隆 GitHub 仓库、安装依赖项,然后用它们与互联网的其余部分交互!
一个完整的无头 Chrome 浏览器
ChatGPT Work 的另一个杀手级功能是浏览器工具。ChatGPT Work 可以启动一个完整的 Chrome 实例,加载网站、填写表单并截取屏幕截图。
如果某个网站需要登录,浏览器可以提示你接管操作,输入密码和 2FA 验证码,而无需将这些凭据经由模型本身往返传递。
它甚至可以对已加载页面的 DOM 运行 JavaScript。我输入了以下提示词:
Load simonwillison.net in your browser and extract the headings using JavaScript
ChatGPT Work 启动了一个浏览器实例并运行了这段代码:
await tab.playwright.evaluate(() => { return Array.from(document.querySelectorAll("h1,h2,h3,h4,h5,h6"), heading => ({ level: heading.tagName.toLowerCase(), text: heading.innerText.trim().replace(/\s+/g, " "), id: heading.id || null })); });
这感觉很像我的shot-scraper javascript工具,只不过现在我在手机上也能使用它了!
一个持久化的共享文件系统
ChatGPT Chat 的每个聊天会话都会获得一个全新的文件系统。这些文件系统无法从任何其他会话访问。
在 ChatGPT Work 中,每个会话都有自己的临时文件夹——名称类似 /workspace/scratch/e00a0a017944——但每个文件夹都会跨会话持久保留,因此你可以访问之前聊天中的文件。我现在在 /workspace/scratch 里已经有 171 个文件夹了!
据我所知,该 /workspace 卷会挂载到所有当前正在运行的 Work 会话中——一个会话中的文件编辑可以立即被其他会话看到。不过它们似乎并不共享同一进程空间,一个会话中运行的 localhost 服务器也无法从另一个会话访问。
ChatGPT Sites
ChatGPT Work 能够借助 Cloudflare Workers 构建并部署完整的网站。这些网站可以包含 HTML 和 JavaScript,也能运行服务端功能,包括基于 Cloudflare D1 和 R2 的有状态功能。
下面是我用这个功能构建的一个简单网站:
london-pelicans-in-her-piety.simonw.chatgpt.site

我的提示词是:
Figure out all of the places in London with a pelican in her piety, then turn that into a JSON file and build a ChatGPT sites site about them
(鹈鹕哺雏是中世纪基督教图像中一个引人入胜的母题——一旦你了解了它,就会发现它无处不在。)
这些网站默认仅对创建它们的用户可见,但你可以将其设为公开,也可以(在团队版套餐中)与特定的其他个人共享。
与 Sol、Luna 和 Terra 一起的子智能体
这一条没什么好多说的。ChatGPT Chat 无法运行子智能体,ChatGPT Work 可以。这绝对是一个面向高级用户的功能:如果你正在运行一个复杂的项目,需要多个并行智能体协同工作,Work 就能胜任。
定时提示词自动化
另一个似乎是在某个时间点从普通 ChatGPT 迁移到 ChatGPT Work 的功能。你可以像这样给 ChatGPT Work 下达提示词:
run a search to see if Waymo have announced a launch date for Half Moon Bay every day at 8am
这会安排一个提示词按该频率运行。这些提示词可以自行判断是否发生了值得关注的事情,也可以决定就某些新信息向你发出通知。
更新:实际上这个功能在 ChatGPT Chat 里似乎也能用。
不过在这里仍然值得一提,因为它可以与其他 ChatGPT Work 专属功能配合使用。例如,你可以设置一个定时任务,让某个 ChatGPT Site 每小时更新一次。
这安全吗?
目前摆在我面前的一个开放问题是,这一切到底有多安全。
我的 致命三连模型 警示了任何智能体系统所固有的风险——当它同时具备访问私有数据的权限、接触不可信内容的渠道,以及将窃取的信息传回攻击者的途径时,危险便随之而来。
ChatGPT Work 三者兼备!
我很想听听 OpenAI 如何保护 ChatGPT Work 会话免受提示词注入攻击。我猜他们的答案和 Codex 一样,都是那套 自动审查机制。
OpenAI 本可以把这件事讲清楚得多
搞清楚这一切所花费的功夫,远远超出了本应需要的程度。
我认为这里有两个关键问题:
- OpenAI 应该从 Work 的用途而非实际运作方式来解释它
- OpenAI 仍然坚持隐藏其系统提示词和工具描述
如果 ChatGPT Work 的文档包含了该智能体实际使用的系统提示词和工具描述,我就不需要写这篇文章了。
来源:Simon Willison 博客 · simonwillison.net