Skip to main content

Web 上的通用 agent:速成课

12 个概念 · 你的第一个通用 agent,就在学习 Foundations 时使用的同一个浏览器标签页中

主图标题为「Harness Wars」,副标题是「竞争已经超越模型」。两个厂商栏围绕中央的「VS」徽章相对而立:左侧是 Claude Cowork(Anthropic 的 Web harness),右侧是 ChatGPT Work(OpenAI 的 Web harness)。每栏都列出本课程讲解的同样 6 个部分,并配有通俗说明:heartbeat(按时钟或事件启动工作)、connector(引入数据并送出结果)、run-until-done(朝终点推进,完成后停止)、state spine(在多次运行之间保留信息)、human gate(在关键时刻让你保持控制)以及 body(运行实际发生的地方,即远程环境)。中央有 3 个相互咬合的齿轮,上方标注「相同的核心结构,不同的实现」;下方的小人图标旁写着「选择 harness,正确指挥」。底部横条在「每个 Web harness 的 6 个部分」下列出全部 6 项。

前 6 门课程里,你一直在聊天标签页中工作。你提问,它回答;你再问,它再答。每一轮都由你启动。这是很好的学习方式,但普通聊天有一个限制:你停止输入,对话也随之停止。

能自行持续工作的 agent 并非 Web 上的新事物。ChatGPT 从 2025 年初就能运行计划任务;你离开时,它也能独立完成深度研究;它还有配备自己计算机的 agent 模式。这些功能真实而强大,却散落在各处:一个任务藏在这里,一个研究工具放在那里,agent 模式又位于某个菜单中。日常工作没有一个清晰统一的入口,无法把文件、会话和服务汇入同一条工作流。

2026 年 7 月改变了这一点。两家大公司把这些部分汇集成一个清晰的工作界面,放在聊天框旁边,使用同一个网址。在 claude.ai,Claude Cowork 作为远程会话运行在 Anthropic 的服务器上。在 chatgpt.com,ChatGPT Work 是 ChatGPT 内的新模式,与熟悉的 Chat 模式并列,使用 OpenAI 的 GPT-5.6 模型。(ChatGPT 还有面向开发者的 Codex 模式,但在 Web 和手机上,你主要会看到 Chat 与 Work。)

因此,2026 年 7 月并没有发明浏览器 agent,而是让它们成为正式的工作场所。聊天框没有改变,仍然会等待你,以后也一样。改变的是旁边的界面。在那里启动会话后,任务会在公司的服务器上运行。你可以关闭标签页,也可以登上飞机,工作仍会继续。等它遇到只有你能做的选择时,问题会发送到你的手机。

本课程会带你参观这个界面,同时第一次讲解后续每门课程都需要的一项技能:指挥通用 agent。你将了解什么是远程会话、文件究竟去了哪里、审批如何到达手机,以及如何交接一项你不会全程观察的工作。你还会学会查看新的 agent 产品,并认出其中相同的组成部分。

两家公司几乎同时构建了这种产品,并得出了同一组组成部分。这有力证明了本书的核心观点:真正的技能是结构,而不是工具。

这里还有一个更大的故事,值得在入口处点明。两家公司不再只围绕模型竞争,也在争夺包裹模型的一切:计划、connector、记忆与关口。本书把这层外壳称为 harness,把这场竞争称为 harness 之战。过去,工程师在代码中进行这场竞争;如今它已经来到 Web。你在其中的位置很简单:这里不需要构建 harness,只需选择适合的一套并正确指挥。概念 3 会把两套 harness 并排展示给你。

你无需安装任何内容。Foundations 在浏览器标签页中运行,本课程也一样。

本课程适合谁。 适合任何学完 Foundations、希望无需安装任何内容便能指挥真实 agent 的读者。首先是知识工作者,也就是每天与文档、电子表格、邮件和聊天打交道的人:律师、会计师、营销人员、分析师、创业者和学生。也适合希望在进入终端前先走最平缓一步的工程师。会编程,从这里开始不会损失什么;不会编程,这里正适合你。因此,它是通用 agent 部分的第一门课程。每个人第一天都能在浏览器里学习。

请先完成 Foundations,尤其是 2026 年 AI 提示词工程技能与 Connector 本课程默认你已经具备 3 项基础:能向模型清楚交代任务;知道什么是上下文;知道技能和 connector 是什么。如果其中任何一项还很陌生,请先完成那两门课程,共约 2 小时。

所需时间。 核心路线(第 1–3 部分)约需阅读 90 分钟;加上第 4 部分和附录,整门课程接近 2 小时。项目还会增加动手时间,其中计划任务练习持续 1 周,而真正的学习会在这里留下来。后面有 7 个参考附录:前 6 个分别映射到一门后续课程(学到时再读),最后 1 个描绘整个行业。把它们当作参考,不要一次读完。

第一次来?用 2 分钟回顾应当已经掌握的内容
  • 交代任务是完整描述一项工作:结果、限制、读者与原因。模糊的提示词只能得到模糊的结果。(Foundations 课程 2。)
  • 上下文是模型在一轮中看到的一切。更多并不更好;有意识地选择正确上下文才更好。(Foundations 课程 2。)
  • 技能是只教一次的任务,存放在 SKILL.md 文件中。只有当你的请求匹配时,AI 才会加载它。(Foundations 课程 5。)
  • Connector 通过 MCP 标准,让 AI 以安全、受限的方式访问 Drive、Gmail 或 Slack 等真实服务。你授予权限,AI 在权限内工作。(Foundations 课程 5。)
  • 聊天机器人与 agent。 聊天机器人负责回答;agent 会规划、使用工具并完成步骤。本课程会让你第一次真正指挥一个 agent。

如果其中任何一项还很陌生,请先阅读那两门 Foundations 课程。本课程会把它们全部用于真实工作。

📚 教学辅助材料

打开完整幻灯片

查看完整演示文稿 —— Web 上的通用 agent

供教师和自学者参考。 本课程讲解一个可迁移的核心观念:agent 产品由 6 个部分组成(heartbeat、connector、run-until-done loop、state spine、human gate、body)。一旦理解这些部分,任何新产品都只需短暂浏览,而不是一门新学科。可以分 3 遍教授。第一遍讲变化:聊天框会等待,旁边的 agent 界面不会(概念 1–3)。第二遍讲界面本身:文件存在哪里、connector 如何向外延伸、审批如何送达手机(概念 4–7)。第三遍讲无人观察时如何工作:委派循环与计划任务(概念 8–9),然后根据工作会触碰什么来选择界面(概念 10–12)。6 个项目就是评测。学生离开课程时最重要的一个习惯是:完成的工作必须离开平台。

通俗术语表

这些词会贯穿整门课程。现在先读一遍,遇到不清楚的术语时再回来查看。

术语通俗含义
聊天框每一轮都等待你的对话,无法自行启动任何事情
Agent 界面聊天框旁边的产品,能够规划、行动并运行多步骤工作
远程会话在厂商服务器上运行的会话。你的标签页只是观察它的窗口,不是运行它的机器
本地会话在你自己的机器上运行的会话。机器休眠时,它也会暂停。后续课程会讲解这类会话
任务文件系统远程会话工作时使用的临时空间。只把它当作草稿区,绝不能视为永久存储;各厂商的保留与清理规则不同
平台存储永久保存到厂商平台账户中的文件。任务和标签页结束后仍会保留
出口(第 3 层)把交付物从平台移到你控制的地方:通过 connector 保存、下载、写入本地或提交到仓库。文件进入你的记录系统
账户脊柱保存的会话和文件,会在设备之间同步。你无需自行构建的记忆
人工关口风险操作继续前必须由人批准的节点。在这个界面上,审批会到达你的手机
计划任务按时钟在厂商服务器上启动的工作,无需你的任何设备在线
计量使用量每个套餐包含的运行次数或小时预算。使用他人服务器执行无人值守工作,总会有这种预算
数据保管谁持有你的数据:它存放在谁的机器上,以及谁能访问
它从何而来

日期在这里很重要。这个界面只有几周历史,但根源更早。

浏览器 agent 并非始于 2026 年。ChatGPT 在 2025 年 1 月推出计划任务;同年 2 月推出深度研究,可自行浏览数十分钟;2025 年年中又推出配备自己计算机的 agent 模式。因此,早在本课程之前,Web 就能独立运行工作。缺少的只是一个清晰统一的入口,各部分仍散落在菜单和工具中。

Claude 沿着自己的路径来到同一个地方。Anthropic 提供在其服务器上运行的云端编程会话,即使合上笔记本电脑也能继续工作。它很有用,但主要面向开发者。

随后在 2026 年 7 月,两家公司前后只差几天,就把这些部分汇入同一个入口。

Cowork 在 claude.ai 上推出 Web 版(测试阶段,先开放 Max 套餐,更多套餐随后跟进)。会话在 Anthropic 的服务器上运行,文件和会话保存到你的账户;即使没有设备在线,计划任务也会触发。

ChatGPT Work 于 2026 年 7 月 9 日推出。 它不是独立产品,而是 ChatGPT 内与 Chat 并列的新 agent 模式,运行在 GPT-5.6 上。它会制作完成的文件:电子表格、幻灯片、文档、仪表盘和小型 Web 应用。它通过改名后的 Plugin Directory 访问你的服务。Scheduled Tasks 可以运行一次、按计划运行、在事件发生时运行,或持续观察变化。它不是新的价格层级。在 Web 和移动端,它随符合条件的付费套餐提供,不包含 Free 或 Go,并消耗各套餐的 agent 配额。(在 ChatGPT 桌面应用中,Chat、Work 和 Codex 面向包括 Free 在内的所有套餐。Codex 是该桌面应用中的独立视图,无法在 Web 或移动端选择。)可用性一直在变化,请在实时产品页面确认自己的访问权限。

两家公司相隔几天,都把 agent 放在聊天框旁边。两种不同产品,同一种结构。本课程讲解的就是这种结构。

为什么会发生,以及它让你做到哪些过去做不到的事

学习界面之前,先理解它为何存在会更有帮助。这件事有两面:一面是它给你的能力,另一面是公司得到的回报。两面都要看。理解公司的目标后,你会睁着眼使用界面,而不是盲目信任。这也解释了本课程稍后会反复强调的一条规则。

它填补的空白。 2026 年 7 月之前,Web 已经能够自行运行工作,但各部分散乱且不均衡。计划任务在一个菜单里,研究工具在另一个菜单里,agent 模式又藏在下拉菜单中。单独看都很强大,组合起来却难以发现,更难使用。没有一个地方能让文件、会话、服务与无人值守运行相遇。因此,大多数人从未使用任何一项。这些发布把各部分集中到一个清晰界面,放在大家每天都会打开的网址。能力早已存在,改变的是它终于易于访问和组合。

2026 年 7 月把 4 项能力汇集到一个更清晰的工作界面中:

  1. 同一日常界面里的长时间工作。 远程会话在公司的服务器上运行,因此关闭标签页、合上笔记本电脑或登上飞机后,任务仍会继续。远程 agent 运行早已存在;变化在于 Work 和 Cowork 把它放到普通聊天旁边,形成一条通用工作流。(概念 2。)
  2. 内置于工作界面的计划功能。 计划任务按时钟或触发器启动,不需要你的设备在线。你坐下前,周一简报已经完成。计划任务也早已存在;如今它与项目、文件、connector 和 agent 运行并列,不再属于单独工具。(概念 9。)
  3. 围绕会话和项目组织工作。 会话与文件保存在账户中,并跟随你切换设备。新界面把相关文件、指令与持续工作汇集在一个可见位置,大幅减少重复粘贴上下文。(概念 4。)
  4. 跨越文件与已连接服务的多个步骤。 Agent 连接你的服务、制定计划、连续数小时完成多个步骤,最终交回成品文件,而不只是聊天回复。需要你选择的事项会发送到手机。新之处在于,这一切不再要求你穿梭于多个独立产品模式。(概念 5–8。)

现在看另一面,因为它会改变你使用这些能力的方式。 对外宣称的目标是增强你完成工作的能力,商业目标则是扩大覆盖并形成锁定。整个 2026 年,两家公司都在对抗一种说法:它们出售的是聊天产品,而市场想要 agent。最快的解决方案,是把 agent 放到数亿用户已经所在的地方。无需安装新应用,也无需学习终端。一步之内,聊天用户就变成 agent 用户。把会话、文件和 connector 保存进公司账户还会产生另一个结果:离开变得昂贵,这叫作切换成本。方便的账户记忆,也正是让你难以离开的东西。

这不是怀疑一切的理由,而是养成一个明确习惯的理由。最能帮助你的功能(免费且可用的记忆)和最能帮助公司的功能(工作不断堆积在其服务器上),其实是同一项功能。因此,概念 5 会要求你把成品移出平台,保存到自己的存储中。保留便利,拒绝锁定。看清公司的目标后,这个习惯显得理所当然,而不是多疑。

还有一个诚实的限制。 这些能力不会让工作本身变得更好或更安全。一条薄弱的指令现在会自行运行,中途没有人及时发现问题。把代码、浏览器和在线 connector 放进一个始终运行的界面,也会扩大错误运行的触达范围。ChatGPT Work 发布当周,安全审查人员就指出了这一点。新能力只是杠杆。它帮助还是伤害你,仍取决于任务说明、审查与判断。因此,本课程会为每项新能力配上一条纪律,而不是只推销能力。

简单来说

Agent 能力早已存在于 Web,只是分散在不同工具和模式中。现在,它们集中在你已经使用的网址,形成一个面向日常工作的入口;你离开后仍会继续运行。这是它带来的好处。代价是工作不断堆积在公司的服务器上。它对你很方便,也让公司更容易留住你。因此,可以享受便利,但要把任何成品送到自己的存储中。还要记住:这个界面让工作无需你在场也能运行,却不会自动让工作变好。质量仍由你负责。

一张图看懂思维转变

两个面板顶部都有相同的地址栏,写着 claude.ai / chatgpt.com。左侧是 2026 年 7 月之前:聊天框中的人物图标启动每一轮,下方写着「你就是 heartbeat」;旁边的虚线框说明 agent 虽已存在,却散落各处,一个任务在某个菜单里,研究功能在另一个菜单里,agent 模式又藏在下拉菜单中,没有统一入口。右侧是 2026 年 7 月之后:同一个聊天框保持不变,旁边新增一张卡片,标为「agent 界面:公司服务器上的远程会话」;卡片里有合上的笔记本电脑图标、写着「计划任务仍会触发」的时钟标签,以及正在接收审批卡片的手机图标,下方标注「关口来到你身边」。底部写着:2026 年 7 月没有发明 Web agent,而是给了它们一个清晰的家。

caution

事实核验日期:2026 年 7 月 21 日。Web 版 Cowork 和 ChatGPT Work 都只有几周历史。各套餐分阶段开放,使用量按额度计量,名称也会变化。这是本书中老化最快的一页。在依赖任何限制、套餐层级或功能前,请查看实时产品页面。

本课程涵盖什么

部分主题你将学到什么
1转变2026 年 7 月发生了什么、什么是远程会话,以及为何两家厂商得出同一种结构
2界面会话、账户脊柱、三层文件、没有文件夹的 connector,以及口袋里的关口
3无人观察时工作委派循环、如何交代一项你不会观察的工作,以及无需设备在线的计划任务
4选择与开放路径根据任务选择 Web 或桌面、没有厂商云的开源路径,以及本课程如何交接给后续课程

两种阅读方式。 第一次先读下面的 为什么会发生,再依次阅读第 1–3 部分,然后完成项目 1–3。约需阅读 90 分钟,无需安装任何内容就能成为 agent 用户。拥有 1 周真实会话经验后,再读第 4 部分、深入说明与项目 4–6。

哪些要记住,哪些要查询。 本课程贯穿两层内容,它们的老化速度完全不同。记住第一层,查询第二层。 持久层:聊天框会等待,而且永远如此;远程会话存在于账户中,不在标签页里;每份交付物都会落入 3 层之一,成品必须离开平台;人工关口必须到达你真正会查看的地方;任何厂商的 agent 产品,都只是同一种结构使用不同名称。机械层:下面所有套餐层级、运行限制、按钮标签与产品名称。它们只有几周历史,每月都会变化。把每一项视为实时文档的指针,而不是需要背诵的事实。

先说明一个边界。 本课程讲解界面与委派循环,不讲运行时决策:经过验证的无人值守工作长期应该住在哪里、迁移时什么会一起带走,以及如何重新赢得信任。这是本节末尾 离开笔记本电脑 的主题。本课程是前门。在依赖门后的任何东西前,请先阅读那门课程。


第 1 部分:转变

1. 同一个地址,两种不同事物

今天打开 claude.ai 或 chatgpt.com,会发现聊天框和 agent 位于同一个地址。在 ChatGPT 中,区别直接显示在屏幕上:Chat 模式与 Work 模式并排位于同一应用中。(桌面应用还为开发者提供独立的 Codex 视图;Web 和手机上主要显示 Chat 与 Work。)两者并不相同,学会区分是本课程的第一项技能。

聊天框就是你在 Foundations 中熟悉的对话。每一轮都等待你:你输入,它回答,然后再次等待。它无法按计划启动,无法对事件作出反应,也无法在关闭标签页后继续。这不是缺少功能,而是对话本来就如此。聊天框永远不会在你缺席时运行工作,也不必这样做。它是思考、起草与设计的地方。

Agent 界面位于旁边。你交给它的是一项任务,不是一条消息。它会制定计划、使用工具、完成多个步骤并产出交付物,只在某项决定需要你时暂停。即使你不再观察,它仍会继续工作。

这里有一项简单测试,值得在整个职业生涯中记住,因为每家公司都会在营销中模糊这条界线:

如果我停止输入,工作会停止吗?

聊天框:会。Agent 界面:不会。无论哪个网址、哪家公司、今年还是以后,这一个问题都能区分两者。

如果想理解得更深,可以这样看:普通聊天轮次是同步的。它在你等待时运行,然后停止并等待下一轮。Agent 运行则是委派的。启动之后,它会持续朝结果推进;可以稍后运行,也可以观察变化,不需要等你的下一轮才能继续。这才是真正的界线,并会在按钮和菜单变化后继续存在。「停止输入」测试只是日常感受它的方式。

还有一项提醒,避免这项测试误导你。你经常会用自然语言从聊天框启动委派运行,例如「每周一总结这些邮件」。文字进入聊天框,但你设置的是委派任务,不是普通回复。因此,应观察工作会做什么,而不只是文字输入了哪里。

2026 年 7 月还有一件事没有改变,而且很重要:聊天框仍保留原来的职责。设计任务、起草说明、手工测试想法都属于聊天工作,本课程中的每项任务也从这里开始。Agent 界面没有取代聊天框,只是搬到了隔壁。

简单来说

一个窗口,两间房。第一间房里,你不说话就不会发生任何事;第二间房里,你离开后,工作人员仍会继续。本课程讲的是第二间房。你仍会用第一间房准备要交接的内容。

检查自己

一位同事说:「我每天都用 claude.ai,所以已经在使用 agent。」请用两句话纠正他。

查看答案

他使用的是聊天框:一停止输入,工作就停止,这意味着每一轮仍由他手工启动。Agent 界面是旁边的产品:把工作交给它,它会规划、行动,并在标签页关闭后继续。每天使用聊天确实是一项技能,却不等于使用 agent。

2. 远程会话:标签页是窗口,不是运行时

这是整门课程的核心架构概念,其他一切都源于这个事实。

Agent 可以住在两个地方。它可以住在你的机器上,也就是后面 3 门课程会讲到的桌面应用与终端。此时,应用就是运行时(实际执行工作的东西)。合上笔记本电脑,执行工作的机器进入休眠,任务便停在原处。它也可以住在厂商的服务器上,也就是本课程的情况。此时,浏览器标签页只是观察会话的窗口,不是运行它的机器。

后果很容易说明,而且每一项都会改变你的工作方式:

  • 关闭标签页,工作继续。 会话从来不在标签页里,而在你的账户中,运行于不会随你休眠的基础设施上
  • 从手机打开会话,看到的是同一个会话。 不是副本,也不是摘要,而是通过更小窗口查看同一项运行中的工作
  • 上周关闭的标签页所创建的计划任务仍会触发。 计划也位于厂商服务器上,你的设备不在关键路径中

claude.ai 启动 Cowork 会话,就在用于聊天的同一个浏览器标签页中。它作为远程会话运行在 Anthropic 的服务器上。会话和文件保存到你的账户中,这种连续性无需自行设置。工作遇到只有你能作出的决定时,审批会发送到手机上的 Claude 应用。

编写本课程时,Web 版 Cowork 仍处于测试阶段:先开放 Max 套餐,更多套餐随后跟进,使用量按额度计量。这里的机械层变化很快。在依赖它之前,请到实时产品页面确认自己套餐的访问权限。

chatgpt.com 切换到 ChatGPT 的 Work 模式(2026 年 7 月 9 日发布,使用 GPT-5.6)。它不是独立应用,而是与 Chat 模式并列于同一界面,专为持续数小时的多步骤项目而构建:把目标拆成步骤,并自行完成其中一些部分。会话在 Web、桌面和移动端之间进行云同步:从笔记本电脑开始,在手机上查看,看到的仍是同一个会话。无论你的设备是否在线,Scheduled Tasks 都在云端运行。

访问权限按套餐分阶段开放。在 Web 和移动端,Work 面向符合条件的付费套餐推出,不包含 Free 或 Go。(ChatGPT 桌面应用中的 Chat、Work 和 Codex 面向包括 Free 在内的所有套餐。Codex 是桌面应用里的独立视图,无法在 Web 或移动端选择。)这些付费套餐无需额外标价便可使用,但会消耗各套餐的 agent 使用配额。因此,这里的「计量」指套餐内含的配额,不是单独账单。可用性持续变化,这些套餐细节也是本书中老化最快的说法。依赖之前,请在 OpenAI 的实时产品页面确认当前访问权限。

两种架构并排显示。左侧是你的机器:一个方框把应用与运行时一同放在笔记本电脑中;休眠图标展示后果——机器休眠,工作暂停。右侧是厂商服务器:服务器方框中保存一个带有会话 ID 的会话;方框外 3 个窗口指向它,分别是打开的笔记本电脑标签页、合上的笔记本电脑和手机,全部标有同一个会话 ID。底部写着:会话不住在标签页里,而在你的账户中。

还要说明一个诚实的限制,避免夸大这个概念。远程会话运行在公司的机器上,只能访问这些机器能够访问的内容:你的 connector、它自己的任务文件系统,以及平台文件。它无法自行访问本地硬盘、桌面应用,也无法访问已登录银行账户的浏览器配置文件。需要这些内容的工作必须使用本地桥接或本地 agent,这正是后续课程所教的内容。(还有一项以后会用到的细节:桌面应用可以充当桥接。打开时,它能让远程会话有限访问本地文件或浏览器;关闭应用后,会话仍会继续,却失去本地访问能力。现在不必掌握,只需知道这道墙并非绝对。)第 4 部分会给出完整决策表。

简单来说

桌面 agent 像在你家工作的员工:家里停电,员工也会停下。远程会话像在厂商办公室工作的员工:你家有没有电并不重要,笔记本电脑和手机只是用来查看其进度的窗口。

深入理解:后面还会两次遇到这个观念

先在脑中保留这个概念。本节稍后的 循环工程 会告诉你,无人值守工作需要某个能在多次运行之间保持唤醒的东西,并追问它住在哪里。离开笔记本电脑 会把桌上的机器称为「最后一个单点故障」,并完整讲解如何消除它。这里展示的是两种观念的消费级版本:厂商服务器保持唤醒,所以你的机器不必如此。同一个观念,无需配置文件。

检查自己

拉合尔的 Ayesha 在下午 5 点从 Web 会话启动客户报告。6 点停电,8 点她从手机打开会话。她会看到什么?为什么停电从来不是问题?

查看答案

她会看到已经完成的工作,或看到等待自己在手机上批准的事项。会话始终运行在厂商服务器上;笔记本电脑只是观察它的窗口,关上窗口不会停止另一侧的内容。她会在 Cowork 桌面课程中遇到的桌面 agent 则会在机器断电时立即暂停,因为机器本身就是运行时。

3. 两家厂商,同一种结构

现在进入本课程存在的核心原因。2026 年 7 月,Anthropic 与 OpenAI 前后只差几天,就把自己的 agent 界面带进浏览器。两种产品展示出一组明显相似的组成部分,并拥有同样的解剖结构。

本书把这套结构归纳为 6 个部分,后续课程会深入构建每一项。今天无需先学完那些课程,也能把它们当作阅读透镜。下面用一句话解释每个部分,以及它在 ChatGPT Work 中的位置。所有名称都来自 OpenAI 的 2026 年 7 月发布内容:

三栏图。左栏标题为「ChatGPT Work · ChatGPT 中的一种模式」,列出 OpenAI 的功能名称:Scheduled Tasks、Plugin Directory、基于结果的执行、云同步会话、审批提示、云端执行 + Sites。右栏标题为「Cowork · 远程会话」,列出 Anthropic 的名称:计划任务、connector、执行到完成、账户中的会话与文件、手机审批、会话工作。中央金色栏标题为「本书讲解的结构」,列出每一对名称对应的 6 个部分:heartbeat、connector、run-until-done loop、state spine、human gate 与 body,并各配一句解释。两侧厂商栏的箭头指向中央共享部分。底部写着:只需学习一次结构,每个新产品都只需阅读半小时。

ChatGPT Work 的名称本书的名称一句话含义
Scheduled TasksHeartbeat在你缺席时启动工作的机制:运行一次、按计划、由事件触发或持续监控变化
Plugin Directory(已连接应用)Connector在权限范围内访问 Slack、Gmail、Drive 等真实服务,让 agent 能够行动,而不只给出建议
基于结果的任务执行Run-until-done loop给出一个结果,它会跨多个步骤朝结果推进:不是一次回答,而是一条终点线
云同步会话与 ProjectsState spine跨设备、跨运行保留的记忆,让工作继续而不是重新开始
审批提示(移动端)Human gate工作继续前,把高风险或依赖判断的决定交给人,并送达手机
Work 的云端执行环境与成品工具Body一次运行实际执行工作的地方,会制作完成的文档、电子表格、幻灯片、仪表盘和小型 Web 应用

用同一套透镜查看 Web 版 Cowork,会得到一张使用 Anthropic 名称的相同表格:计划任务、connector、保存到账户的会话、手机审批。两家厂商,同一种结构。

为什么这对刚接触 agent 3 周的你很重要?因为产品会不断发布,名称也会不断变化,你不可能每次都从零学习。当彼此独立的构建者反复得出同样的组成部分时,组成部分就是纪律,产品只是包装。只需学习一次结构,此后每个新的 agent 产品都只需阅读半小时,而不是学习一个新领域。 这是本书的核心主张,2026 年 7 月则是迄今最有力的证据:技能在结构,不在工具。

有两点需要诚实说明,避免把透镜误当承诺。第一,相同结构不代表相同行为。两者的开放顺序、套餐层级、限制与细节各不相同,而且每周都在变化。映射只告诉你寻找什么,并不承诺配置完全相同。第二,这里只把 6 个部分作为词汇介绍。循环工程 会教你设计每一项;在学习之前,不应安排任何重要工作(概念 9 会进一步说明)。

再补充一点,也是在预告概念 6。ChatGPT Work 发布时,把代码执行、浏览器访问和企业 connector 放进一个始终运行的空间,因此一次错误运行能够触达更远,安全审查人员立即指出了这一点。这不是批评产品,而是这种结构的成本,每家厂商都要承担。也正因如此,connector 后面会单独占据一个概念,审批关口也不是可选项。

简单来说

不同公司的汽车外观不同,但都有发动机、车轮、制动器和方向盘。了解组成部分后,短暂熟悉就能驾驶任何汽车。Agent 产品也一样。这张表就是零件清单。本书教你认识各部分,让任何厂商的包装都无法再次迷惑你。还要注意:两家公司正在围绕相似发动机,竞相制造更好的汽车,这就是「harness 之战」。在 Web 上,你是选择汽车的驾驶者,不是造车的工程师。两种工作都很重要,只是彼此不同。

结构相同,两者究竟在哪里不同? 6 个部分相同,包装并不相同。下面根据两家厂商各自的 2026 年 7 月发布内容进行诚实对比。每一行都只代表 2026 年 7 月中旬,请对照实时页面核验;这是本书中老化最快的表格。

三栏对比。中央金色栏列出 6 个共享部分:heartbeat、connector、run-until-done、state spine、human gate 与 body,并标注「两者完全相同,这就是你要学习的内容」。左翼是 Cowork(Anthropic),右翼是 ChatGPT Work(OpenAI),逐行列出包装差异:模型(Claude 与 GPT-5.6)、界面(远程会话与应用中的模式)、销售方式、connector(MCP 目录与 Plugin Directory)、额外成品(文档、表格和幻灯片,与相同内容外加 Sites)以及编程工具。两侧的编程工具一行都用陶土色突出显示:Claude Code 是独立界面,Codex 是只在桌面应用中的视图,并标为唯一一个结构性而非外观性的差异。底部写着:几乎所有差异都属于包装,组成部分是共享的,这就是论点。

Web 版 Cowork(Anthropic)ChatGPT Work(OpenAI)
它是什么从 claude.ai 的 Cowork 界面进入的远程会话ChatGPT 内与 Chat 并列的一种模式,位于 chatgpt.com
在哪里运行Anthropic 的服务器OpenAI 的服务器
模型Claude(每项任务可选 Opus/Sonnet 层级)GPT-5.6 系列
销售方式Web 测试版,按套餐分阶段开放,按额度计量Web 与移动端随符合条件的付费套餐提供,新桌面应用面向所有套餐;消耗各套餐的 agent 配额
ConnectorAnthropic 基于 MCP 的 connector 目录Plugin Directory(发布时由 App Directory 更名),同样基于 MCP
Run-until-done在任务说明中写明停止条件给出结果,它会跨多个步骤朝结果推进
持久工作区Projects + 保存的上下文文件(Anthropic 将其命名为 CLAUDE.mdProjects + 可审阅、可纠正的记忆
完成的成品文档、电子表格、幻灯片和文件文档、电子表格、幻灯片、仪表盘,以及 Sites(可发布到 URL 的 Web 应用)
配套编程工具Claude Code(独立界面)Codex(作为一种模式合并进同一应用)
移动关口Claude 应用中的审批ChatGPT 应用中的审批

带着各部分阅读这张表,会立即看到一种规律:几乎所有差异都位于包装栏,中央的组成部分是共享的。 模型不同,套餐规则不同,connector 列表使用不同名称,一方提供另一方没有的 URL 发布功能。有些差异比标签更深:任务如何访问本地文件、审批如何工作、编程 agent 是否位于同一应用。这些是真实差异,概念 10 会使用它们。但 heartbeat 仍是 heartbeat,gate 仍是 gate,两者的 spine 也仍是 spine。共享部分是持久层,其余则是本课程要求你查询而非记忆的机械层。这正是 6 部分透镜以展示而非宣称的方式证明自身价值。即使只学过其中一种产品,另一种也只需短暂熟悉,因为承载工作的部分正是二者共享的部分。

理解正在发生的事情。 请注意两种产品在何处竞争,而不只是模型。模型仍然重要,而且两者都很强;但产品还在竞争模型周围的一切:计划器、connector 层、会话脊柱、手机关口与文件出口。本书把这层包装称为 harnessHarness 工程 专门讲解它。过去两年里,harness 主要由工程师在代码和终端中手工构建。2026 年 7 月的发布说明,harness 已经作为成品来到 Web,两家公司开始竞争谁的 harness 更好。这样的竞争对你有利,也解释了界面为何进步得如此迅速。

但要清楚记住一条界线,才能正确理解:在 Web 上,公司参与 harness 之战,你不参与。 你不在这里构建 harness,而是在两个成品中选择。工程师连接循环、工具、上下文与检查的工作属于后面的 Harness 工程课程,它是真实而深入的工作。你在这个界面上的工作更小也不同:选择适合任务的预制 harness,再正确指挥它。知道这场竞争正在发生会帮助你选择,却不会让你变成 harness 工程师。那是另一门课程,也是一把不同的椅子。

每种产品分别面向谁? 组成部分相同,但厂商瞄准的人群既重叠又不同。理解目标有助于选择,分两层来看。

厂商瞄准的人群。两种产品面向同一个核心用户:知识工作者,也就是每天在文档、电子表格、邮件和聊天之间移动信息,却不编程的人。「制作完成的电子表格、幻灯片或报告」就是为他们写的。不过,用户周围的结构不同。ChatGPT Work 是同一个应用中的一种模式,而该应用还包含编程 agent Codex。因此,OpenAI 瞄准的是这样一种工作场所:同一个人或团队无需切换应用,就能同时处理知识工作与代码。它还随现有付费套餐提供,没有新的标价,因此覆盖面更广。Web 版 Cowork 先面向 Max 套餐,并按额度计量,对应更窄、意愿更强的早期群体。它的编程 agent Claude Code 仍是独立界面,让两类用户的界线更清晰。

应该选择哪一种?这是本书的建议,不是厂商的说法。对大多数文档与 connector 知识工作而言,两者都适合。真正的平局判断标准都很普通:更喜欢哪家公司的模型、现有 connector 已经连接在哪一边,以及正在支付哪个套餐。只有一种情况会让选择更明确。如果既做知识工作又编程,并希望放在同一屋檐下,ChatGPT 桌面应用把 Chat、Work 和 Codex 放在一起,设置更轻。如果希望工作 agent 与编程 agent 保持独立,并分别治理,那么 Cowork 与 Claude Code 的分离更合适。无论哪种,主要都是包装选择,不是能力选择,因此它只是结构的脚注,而不是标题。

本课程明确排除一种同时不适合二者的用户,而且这一点很重要:处理受监管数据的人。在合规团队书面批准之前,受保护健康信息(PHI)、享有特权的材料和受监管财务记录都不是任一 Web 界面的目标内容,因为工作文件与平台存储按定义处于厂商保管之下。概念 10 会完整讲解。这里先记住:「面向谁」存在一条任何厂商营销都不会替你画出的硬边界。

包装之外还有一个真实差异值得指出,因为它会改变你的选择。OpenAI 的编程 agent Codex 与 Work 位于同一个 ChatGPT 应用中,不过在桌面应用里是独立视图,Web 和手机上无法选择。Anthropic 则把编程 agent Claude Code 保持为完全独立的界面。 知识工作者不会感受到差别,但同时处理知识工作与代码的人会在意。桌面端 ChatGPT 把 Chat、Work 和 Codex 放在同一屋檐下;Claude 一侧则需要在 Cowork 与 Claude Code 之间切换。两者没有高下之分。这是真实的结构差异,会在概念 10 的「根据工作会触碰什么来选择」表格中发挥价值。

简单来说

两种产品以同样方式构建,主要区别在标签、模型与各套餐的销售方式。一个真正的结构差异是:OpenAI 把编程工具与工作 agent 放在同一应用中,Anthropic 则将二者分开。只做文档工作时不会察觉;如果还编程,就值得了解。

检查自己

下个季度,第三家厂商发布一款名为「Flows」的 agent 产品。发布页列出触发器、集成、自动驾驶模式与工作区记忆。请在阅读其文档前,把 4 个名称映射到本书的组成部分。

查看答案

触发器对应 heartbeat;集成对应 connector;自动驾驶模式对应 run-until-done loop(阅读文档时的第一个问题是:停止条件是什么,由谁检查?);工作区记忆对应 state spine。不到 1 分钟,你就读懂了一款从未见过的产品,并带着正确问题开始。这项练习正是本概念讲解的技能。


第 2 部分:界面

转变已经理解,下面学习界面本身的工作部分:会话住在哪里、文件实际落在哪里、无人观察时 connector 会做什么,以及唯一需要你的决定如何找到你。共有 4 个概念,其中三层文件是整门课程最重要的一项纪律。读到那里时请放慢速度。

4. 账户脊柱:无需自行构建的会话与文件

在此前的 Foundations 工作流中,独立对话经常从零开始。你反复粘贴上下文、重新解释项目、再次上传文件。多数时候,连续性由你手工维持。

Agent 界面把连续性作为功能交给你。会话保存到账户中,会话生成的文件也保存到账户中。从任何设备打开,看到的都是同一项工作、同一个进度。本课程称其为账户脊柱(也就是概念 3 中 state spine 在这个界面上的版本):一种跨会话、跨设备保留的记忆,由厂商构建,不需要你雇人维护。

这是真正的好处,应当使用;但它也有代价,依赖它承载工作前必须了解。脊柱位于厂商保管之下,并采用厂商的格式。会话、文件和工作历史都存放在对方机器上,受其账户系统管理,并采用对方定义的形状。这并不邪恶,却处处构成依赖:依赖你支付的套餐、产品继续存在,以及厂商规则仍与你的要求兼容。概念 5 会提供让这种依赖保持安全的纪律。现在先同时记住两面:脊柱提供免费连续性,但住在别人的房子里。

每个 Cowork 会话都会保存到 claude.ai 账户,生成的文件也附在其中。明天从任何设备返回时,上下文、计划和文件仍在原处。实际上,会话列表就是你在这个界面上的工作日志。

ChatGPT Work 的会话会在 Web、桌面和移动端之间进行云同步:从笔记本电脑开始,再从手机重新打开,看到的是同一个会话、状态和文件。两项功能扩展了这条脊柱。Projects 把相关聊天、文件与指令汇入一个持久空间,在会话之间共享上下文,是重复性工作的自然归宿(内置了概念 6 的持久工作区观念)。启用记忆后,它可以携带过去聊天中的相关上下文,并提供可审阅的摘要和可检查、可纠正的来源。会话列表、Projects 与记忆共同构成脊柱,设备只是窗口。Cowork 标签页对数据保管的所有说明在这里同样成立:这条脊柱位于 OpenAI 的服务器上,采用 OpenAI 的格式。

3 个小习惯能让脊柱帮助你,而不是妨碍你。按工作成果为会话命名,不要按聊天命名。 「Acme 续约简报,5 月发票运行」在 3 个月后仍能被找到,「快速问题」永远不能。每个会话只放一条工作流。 把客户报告与假期计划混在同一会话,会让上下文相互渗透;你已经在 Foundations 中学过陈旧上下文如何损害质量。清理已失效内容。 长会话会在每一轮携带全部历史,而上下文在这个界面上的成本与聊天中完全一样。有意选择的少量上下文,胜过习惯性拖入的大量上下文。

简单来说

在聊天标签页里,你每天晚上把文件带回家,第二天早上再带回来。Agent 界面则像一张带抽屉的办公桌:所有东西留在原处,随时都能从任何地方取用。这张桌子非常实用,但别忘了,它放在厂商的大楼里,不在你的楼里。

检查自己

请各用一句话说明账户脊柱带来的好处与代价。

查看答案

好处:无需自行构建的连续性,会话和文件在标签页关闭、一天结束和设备切换后仍会保留。代价:这种连续性位于厂商保管之下,采用厂商格式;任何只存在于那里的内容都依赖你的套餐、对方的产品与规则。下一个概念会把这项代价转化为工作纪律。

5. 三层文件:交付物究竟住在哪里?

这是本课程最具代表性的概念。把 agent 触碰的每个文件看作位于 3 层之一。它是模型,不是物理定律,但在实践中很可靠,能把模糊问题变成清晰问题。每制作一份交付物,都要决定它落在哪一层。

第 1 层:任务文件系统。 远程会话工作时,会使用厂商服务器上的临时空间,存放草稿、中间计算和未完成文件。工作结束后会清理,各厂商的具体保留规则不同,因此绝不能视为存储。第 1 层对自己的性质很诚实:任何明天还需要的内容都不应以它为家。

第 2 层:平台存储。 永久保存到厂商平台账户中的文件。任务、标签页与一周结束后仍会存在。这就是概念 4 的账户脊柱在文件上的应用,也是自然默认值:除非送往别处,工作会落在这里。第 2 层是安全的,但也处于厂商保管之下,采用厂商格式,并位于厂商登录之后。

第 3 层:出口。 文件离开平台,落入你控制的地方:通过 connector 保存到 Drive、发送邮件或 Slack 消息、直接下载到自己的机器、写入本地文件夹,或提交到仓库。出口有很多,具体哪扇门并不重要。关键是目的地:只有第 3 层会让交付物进入你的记录系统,也就是公司、客户或未来的自己真正会寻找它的地方。

三层架子上下排列。顶层使用陶土色虚线边框:任务文件系统,即会话的临时工作文件夹,任务结束时会被清理,只存放草稿与临时内容。中层使用实心石板色:平台存储,保存到你的账户,任务与标签页结束后仍会存在;它处于厂商保管之下,也是默认落点。底层为金色:「出口」,文件离开平台并进入你控制的系统,列出 4 扇示例门(通过 connector 保存、下载、写入本地、提交到仓库),并注明具体哪扇门不重要,这是唯一由你保管的层。从底层伸出的箭头穿过标有「厂商平台」的边界框。右侧向下的竖括号写着「保管:对方、对方、你」。底部写着:完成的工作离开平台,其他内容可以留下。

整项纪律可以写成一行,也是这门课程最值得记住的一句话:

完成的工作离开平台,其他内容可以留下。

把各层当作风险阶梯,这句话就不言自明。只存在于第 1 层的交付物已经丢失:清理不是 bug,而是该层的定义。只存在于第 2 层的交付物今天安全,明天可能成为人质:它会保留,所以今天安全;却只在那里保留,处于他人保管之下,只能通过他人的登录访问,所以明天可能受制于人。第 3 层的交付物属于你:位于 Drive 版本历史、公司事项文件夹或仓库中,受你的保留规则治理,同事可以找到;即使下季度厂商产品改变形状,它仍然存在。

Cowork Web 会话在临时任务文件系统(第 1 层)中工作,把输出随会话保存到账户(第 2 层),也可以通过已连接服务保存或发送文件,例如 Drive、Gmail、Slack(第 3 层)。通往第 3 层的路径经过你授权的 connector,因此下一个概念会更严肃地对待 connector 范围。

这里同样有 3 层。第 1 层是 Work 任务运行时使用的隔离工作环境,包含只为该任务启动的独立文件系统。具体实现由 OpenAI 管理,不属于你控制的界面。第 2 层是任务生成的完成文件:文档、电子表格、幻灯片、仪表盘和 Sites,与云同步会话及 Projects 一同保留。第 3 层是出口:完成文件离开平台,进入你控制的地方。在这个浏览器界面上,主要自动出口是通过 Plugin Directory 的 connector 保存到 Drive、Gmail 或 Slack。下载是手工出口;连接桌面桥接后,还可以增加本地写入。这里有一项值得肯定 OpenAI 的功能:Sites 可以把完成的 Web 应用或仪表盘发布到可共享 URL,确实很实用。但要用概念 5 来理解。托管在平台上的 Site 仍然是带有公开入口的第 2 层,不是由你保管的第 3 层。具体保留与导出规则只有几周历史,请对照实时文档核验。底层的三层结构不会变化,这才是要学习的部分。

完整示例。 Ayesha 为一位客户进行月度开票。草稿数字位于第 1 层:agent 的临时计算与临时 CSV。它们在那里产生并消失,这是正确做法,因为没人审计草稿纸。发票模板下个月还会复用,所以保存到第 2 层的平台存储,并附在 30 天后会重新打开的会话上。完成的发票 PDF 会两次进入第 3 层:保存到公司的 Drive 文件夹,同时通过邮件 connector 发给客户。为什么要两次?为什么一定是第 3 层?因为有一天,审计师、合伙人或 11 月的 Ayesha 会问:「3 月发票在哪里?」答案必须是「公司的记录中」,不能是「在我 Cowork 账户的某个地方」。记录系统属于公司,只有第 3 层能进入那里。

每份会生成交付物的任务说明都应以一条指令结束,这样层级决定会自然完成:

End by listing every file you created and where each one landed:
temporary working space, platform storage, or a system I control (connector save, download, local write, or repo commit).

这一行会把看不见的默认值变成看得见的决定,项目 2 会让你在真实工作中实践。

简单来说

一张纸可以放在 3 个地方。放在工作人员的草稿板上:当天结束就扔掉。放在工作人员自己的抽屉里:很安全,但在对方桌子里,不在你的桌子里。放在你的文件柜中:属于你,适用你的规则,你的人也能找到。规则很简单:所有成品都进入你的文件柜,草稿可以留在草稿板或抽屉中。

深入理解:这项纪律以后还会成长

后面两门课程会把成熟后的这个概念交还给你。循环工程 会讲解 state spine,也就是循环在多次运行之间保留的记忆,而记忆住在哪里正是层级决定。离开笔记本电脑 会讲解行李箱测试:搬家时什么会一起带走;它的规则「仓库保存真相」,就是穿上工程服的第 3 层。本课程的项目 6「出口演练」,则是那门课程「家园消失演练」的初学者版本。现在先用发票与简报养成层级习惯,学到工程版本时就会觉得顺理成章。

检查自己

一位律师在 Web 会话中制作比较备忘录,并把平台链接分享给客户。如果就此停止,有哪两个问题?

查看答案

第一,数据保管:备忘录只存在于第 2 层的厂商平台,不在公司的事项文件夹与保留系统中,因此公司自身的委托记录出现缺口。第二,访问:链接的共享与权限机制属于平台,不属于公司;公司无法治理自己没有持有的内容。解决办法是进入第 3 层:把备忘录保存到文档管理系统,再按照公司的规则从那里分享。平台链接只是一扇窗口,客户拿到的是窗口,不是文件。

6. Web 上的 Connector:访问与出口合二为一

你已经在 Foundations 中见过 connector:在权限范围内访问真实服务,例如通过 MCP 标准访问 Drive、Gmail 与 Slack。你授予范围,AI 在其中工作。这个定义在这里没有变化。变化的是,当持有 connector 的是 agent 而不是聊天时,它承载的分量。

在这个界面上,信任控制归结为两根杠杆:connector 范围审批。后面的 Cowork 桌面课程会介绍桌面 agent,它们增加第三根杠杆(agent 可以查看哪些本地文件夹),并围绕它建立完整纪律。仅浏览器会话没有自己的本地文件系统,因此不存在这根杠杆。它的职责由刚学过的层级决定与授予的 connector 范围共同承担。

这就引出了本概念要明确陈述的事实:在 Web 上,connector 承载双重分量。 Connector 一直是 agent 访问服务的方式;在仅浏览器会话中,它还是文件的主要自动出口。概念 5 通往第 3 层的路径大多经过已经授权的 connector。下载是手工出口,支持时桌面桥接还能增加本地写入,但无人值守工作主要依靠 connector 这扇门。连接服务时看到的同一个权限页面,如今既治理 agent 可以读取什么,也治理成品能够去哪里。因此,Foundations 中的习惯从良好实践升级为规则:点击连接前先阅读范围,并只授予完成工作所需的最小范围。

第一次执行真实任务前,有两项具体细节值得了解:

  • 读取范围不等于发送范围。 授予邮件 connector 读取权限,可以让 agent 总结邮件串。写入或发送属于不同且更大的授权。从你的地址发出的消息无法收回,其他人会据此行动。不要假设存在安全默认值。Connector 差异很大:有些只能读取,有些只能创建草稿,有些则能真实写入或发送,具体取决于应用、套餐与工作区设置。因此,请检查所启用 connector 的实际操作和权限。对任何有后果的动作要求审批,并把任何能够发送的配置视为单独、更高信任级别的决定
  • 不可信内容始终使用谨慎模式。 这是 Cowork 课程会完整讲解的一条规则的简版。别人写的文字可能携带隐藏指令,例如收到的邮件、厂商 PDF 或陌生网页。对你而言只是普通句子,对 agent 而言却可能像命令。这种手法称为提示词注入,是真实攻击,不是理论。现阶段的防御很简单:任务触碰并非由你编写的内容时,保持「行动前先询问」模式。在计划中寻找从未要求的步骤。如果计划提出未请求的 connector 操作,不要批准;应当重定向或重新开始

授权纪律与 Foundations 相同,但在风险升高的地方值得重复:特定工作流需要服务时再连接,不要提前猜测。每个 connector 都是访问能力,如今也是一扇门。

简单来说

Connector 是交给工作人员的一把钥匙。在这个界面上,同一把钥匙打开两种东西:工作人员可以进入哪些房间取信息,以及成品通过哪个投递口离开大楼。钥匙打开的范围超过任务所需,不是便利,而是你选择的风险。交出前先读清每把钥匙能打开什么。

检查自己

在桌面环境中(下一门课程),信任杠杆是文件夹、connector 与审批。Web 上只有两项。第三项去了哪里?什么接管了它的职责?

查看答案

文件夹杠杆消失了,因为仅浏览器远程会话没有自己的本地文件系统可供限定。(桌面应用打开时,桌面桥接可以借出范围受限的本地访问,但这是桌面的杠杆,不是标签页的。)它的职责由两项内容接管:层级决定(概念 5)治理文件住在哪里,connector 范围治理 agent 可以访问什么,以及文件能从哪里退出。正是这种继承,让 connector 在这个界面上承载双重分量。

7. 口袋里的关口

本书中的每个 agent 产品都遵守一项承诺:真正需要人的决定会交给人。本书称之为人工关口。这个界面改变的不是关口,而是关口在哪里找到你。

使用桌面 agent 时,审批卡出现时你通常正坐在屏幕前;关口与视线偶然位于同一处。这个界面消除了这种偶然。工作会在你吃午饭、开会或睡觉时运行,这正是它的目的,因此审批不能停在标签页里等待,而要发送到手机:一条通知、一张审批卡、一项可在任何地方用 30 秒读完并处理的决定。

请准确理解手机的角色,因为两种错误都很常见。手机是关口,不是工作台。 你可以在手机上审阅计划、批准步骤、用一句话重定向或停止任务;不要在那里起草任务说明,也不要在那里审阅 40 页交付物。设计工作属于大屏幕。手机存在的目的,是避免会话为了 10 秒的决定停滞 6 小时。

现在进入本概念的核心提醒。它借自后面才会学习的课程,因为太重要,不能等待:关口没有移动,门铃必须移动。 在屏幕前工作时,升级事项自然落到眼前。如今工作在视线之外运行,审批可能无人看到。看不见的升级会延迟决定,有时等于默认作出决定。会话在一项你从未看到的审批上暂停 3 天,并没有大声失败,而是静默失败,情况更糟。

因此,在信任任何无人值守工作前,有一个不可协商的习惯:有意让关口响一次。 设计一项需要 1 次审批的小任务,例如要求把无害测试文件保存到已连接的测试文件夹,这类步骤会暂停等待确认。启动后离开计算机,确认通知确实到达手机:应用已安装、登录同一账户、通知已开启,并且没有被专注模式屏蔽。然后从手机批准。没有听过的警报只是传闻。项目 3 会带你完成这项测试。

Cowork 远程会话的审批会发送到 Claude 移动应用。执行第一项离开后继续的任务前,请确认应用已安装、登录同一账户并启用通知,然后把上面的有意审批测试从头到尾运行一次。

OpenAI 直接构建了移动关口。ChatGPT 移动应用让你与运行中的工作保持连接。离开办公桌时,仍可回答问题、审阅输出并批准重要操作。OpenAI 把 Work 描述为:在你跟随进度、回答问题、改变方向并批准重要操作的同时,将目标拆成多个步骤。因此,关口按设计就会到达手机。预检与 Cowork 相同:安装应用、登录同一账户并开启通知。信任任何无人观察的工作前,也要把有意审批测试从头到尾运行一次。(一些最详细的移动审批文档针对主机 Mac 上的 Codex 工作。请在实时页面确认 Work 模式的具体行为。不过,移动关口本身属于官方设计。)

简单来说

你离开后,工作人员仍会继续,偶尔必须向你提问。在这个界面上,问题会发送到手机。两条规则:第一,在手机上回答问题,但真正的设计应在办公桌完成;第二,信任这种安排之前,有意让工作人员问一次,并确认问题真的到达。没听过响声的门铃可能已经坏了,而你毫不知情。

检查自己

计划在周一早晨生成的简报已经连续 2 周没有产出,你也从未收到错误。第一项和第二项检查分别是什么?

查看答案

第一,关口是否能到达你:是否有会话停在一项从未送达手机的审批上?关口静默未送达是本概念的失败模式,会产生完全相同的症状:没有输出,也没有错误。第二,任务是否实际运行:计量使用量与套餐限制(概念 9)可能在预算用尽时让计划任务暂停、无法运行或需要干预,而且不能依赖系统一定报错。请注意两项检查的共同点:在这个界面上,沉默本身含义不明,除非你让它具有明确含义。离开笔记本电脑 会用工程化方法再次讲解这个观念。


第 3 部分:无人观察时工作

你已经了解这个界面。现在学习让它发挥价值的技能:交接你不会全程观察的工作。本部分讲解委派循环,也就是本书后续每门课程默认你已经掌握的 4 个步骤。随后讲解这个界面专为其构建的能力:无需任何设备在线,工作按时钟自行启动。

8. 委派循环:交代、计划、批准、审阅

这是本书第一次讲解委派,也可能是你人生中第一次。Foundations 中的一切都是对话:你提问、阅读、再提问,没有任何事情在你看不到时发生。委派不同。你描述结果,agent 完成多步骤工作,你再查看成品。结果的质量几乎完全由 4 个时刻决定,其中只有 1 个是提示词。

第 1 步:交代任务。 像向一位聪明、积极,却不了解背景的新同事说明工作一样描述任务:结果、限制、受众与原因。这是 Foundations 课程 2 的任务说明纪律,但风险更高,因为模型不再只是针对说明中的空白回答,而会针对空白采取行动。

一组对比就能说明差别:

  • 查询:「总结这份 PDF。」
  • 任务:「阅读这 3 个文件,标出每个截止日期和所有未完成承诺。为经理制作一页简报:语气直接,截止日期优先,不写引言。」

查询在聊天中完全适用,任务则适合这个界面。请注意任务比查询多出的内容:要制作什么、依据什么、给谁阅读、采用什么形式、遵守哪些规则。否则,每一项都会变成 agent 在你看不到的任务中途替你默默作出的决定。

第 2 步:计划。 每份非简单任务说明都以一行结束:

Lay out your plan first, and pause for my approval before doing anything.

这句话在这个界面上比任何其他地方都重要。使用桌面 agent 时,你常会观察运行过程,并在某一步中途打断。这里的目的恰恰是让你离开。因此,计划通常是意图与成品之间唯一的拦截点。 跳过它,第一次发现错误时已经太迟:错误已经跑遍任务中的所有文件。

第 3 步:批准或重定向。 批准前先阅读计划。只需 2 分钟检查 4 件事:

  • 范围:它是否只触碰你指定的内容,还是任务已经悄悄扩大?
  • 顺序:是否有任何行动发生在验证之前?
  • 触达:它是否提出使用未要求的 connector 或发送操作?(如果是,而且任务包含他人编写的内容,请停止并重读概念 6。)
  • 假设:它对你从未说明的格式、受众或规则作了哪些假设?

发现问题时,不要从头开始。用一句话重定向:「在第 2 步中,使用现有模板的标题,不要自行发明。」Agent 会改写计划并再次询问。在计划阶段用一句话纠正几乎没有成本;错误运行被自信执行后再清理,会耗掉一个下午。

第 4 步:审阅。 交付物会在你身处别处时到达,因此要把审阅直接写进任务说明。每项会生成交付物的任务末尾,都加上这些内容:

Before you start: ask me 1–2 clarifying questions.
If any sources contradict each other on a material point, flag the
contradiction in the deliverable. Do not silently pick one.
When done: list every file you created and where each one landed —
temporary working space, platform storage, or a system I control (connector save, download, local write, or repo commit).

第一行会暴露原本可能变成缺陷的假设。第二行存在的原因是:模型训练会把它推向消除冲突并给出自信答案,但对律师或会计师而言,在两个矛盾来源中默默选择一个,才是最重要的失败。第三行自动执行概念 5 的层级纪律。阅读结果时,如果 90% 都正确,可以手工编辑最后一句;如果结构有问题,应告诉 agent 哪里不对并要求修订。与 agent 迭代会教会它你的偏好,自己重写则什么也教不会。

4 个步骤排成一行——交代、计划、批准或重定向、审阅——以箭头连接;一条虚线「重定向」箭头从第 3 步返回第 2 步,标为「一句话,新计划」。第 2 步「计划」以金色突出。下方放大的面板标题为「第 2 步是杠杆」,说明:桌面 agent 可以在运行途中打断,但这里你会离开,因此计划通常是意图与成品之间唯一的拦截点;计划阶段用一句话修正几乎没有成本,修复错误运行则耗掉一个下午。底部写着:计划才是重要步骤;修正计划,不要修复残局。

现在运行第一项任务(10 分钟,无需连接任何服务)。 取一份真实且杂乱的输入,例如会议记录、项目计划,或粘贴到文件中的 3 封相关邮件。打开 agent 界面,附加或粘贴这些内容,然后发送一项完整的 4 步任务:写明结果、限制与受众,加入先看计划的那一行,再加入 3 行审阅要求。阅读计划;有意重定向一件小事,亲自感受重定向如何运作;批准后离开,喝杯茶再回来;最后对照任务说明阅读交付物。这一次运行比本概念剩余文字教得更多,而且正是后续每门课程都会原样使用的循环。

明确指出反模式。 这个界面最常见的失败,是把它当成拥有超能力的聊天框:用一行提示词启动无人观察的多步骤工作。算式很无情:任务说明越模糊,agent 独自作出的决定越多;无人观察的运行越长,这些决定在你看见前叠加得越多。聊天中的模糊查询浪费一条回复;这个界面上的模糊任务会浪费你一整个下午去清理。

简单来说

每次都用 4 个步骤。完整说明想要什么:结果、规则与读者。工作开始前要求先看计划。阅读计划,若有错误就用一句话纠正,再对照要求检查结果。计划是最重要的步骤。修正计划只需 1 分钟,修正已经完成的错误工作则需要一个下午。

深入理解:这个循环就是整节内容的缩影

后续每门课程都会深化循环中的一个步骤。Cowork 课程会深化桌面工作的第 2、3 步:逐步审批卡、执行视图与完整信任模型。规格驱动开发 深化第 1 步,直到任务说明成为足够精确、可用于检查工作的规格。循环工程 自动化第 3 步:由检查 agent 阅读工作,你无需查看每次运行。信任检查器 深化第 4 步,直到审阅变成测量。后来学到的内容不会替代这个循环,只会磨利其中一个步骤。

检查自己

你交代了一项使用多个来源的任务,跳过「先展示计划」这一行,然后去开会。回来时,交付物已经完成,却建立在对某个来源的误读上。使用桌面 agent 时,也许能在运行途中发现。为什么这里从来没有这张安全网?哪一句话能替代它?

查看答案

安全网是你盯着屏幕的双眼,而这个界面的目的正是无人观察,所以双眼从一开始就不会在那里。你无法在运行途中拦截,唯一剩下的拦截点位于运行之前:「Lay out your plan first, and pause for my approval.」在这个界面上,这句话不只是良好实践,而是安全网。

9. 无需设备在线的计划任务

到目前为止,一切仍由你按下启动按钮。本概念连这一步也会移除,正是这项能力让 2026 年 7 月值得单独开一门课程。

计划任务是只需描述一次并设置频率的任务,之后会按照自己的时钟在厂商服务器上运行:笔记本电脑合上,手机放在口袋里,你的所有设备都可以离线。每周一 8 点,在你坐下前,本周简报已经等待阅读。这是真实承诺。本概念还会加入一套纪律,防止它悄悄变成混乱。

每项计划任务都由 4 个答案组成。 创建之前,按以下顺序写下来:

  1. 它应该做什么? 永久任务说明。包含概念 8 的全部要求,并增加一点:现场没有人澄清,因此说明必须在你缺席时仍能成立,包括空结果。「如果本周没有新项目,生成一行说明」能区分平静的一周与无法辨别的静默失败
  2. 它可以触碰什么? 按名称列出范围内的文件与平台存储。范围模糊的计划任务每周都会越扩越大,而且无人观察
  3. 它能触达什么? 列出 connector。Connector 是权限,不是建议:没有邮件 connector 的任务无论说明怎么写,都无法发送邮件,这是一项优点。完全按照概念 6,只授予工作所需的最小触达范围,不多给任何权限,因为它会在无人观察的情况下按计划无限期使用授权
  4. 何时启动? 频率。还要诚实承认所有计划器都存在的事实:「周一 8 点」意味着大约周一 8 点。计划器会错峰,有时也会延迟。如果输出有严格截止时间,计划本身并非保证,离开笔记本电脑 会妥善讲解这个主题

4 张卡片排列在一条轴线上,从左侧的「你按下启动」走向右侧的「它在你缺席时运行」:一次(运行 1 次后停止,例如明天的提醒)、按计划(由时钟触发,笔记本电脑合上,例如每周一上午 8 点)、由触发器启动(支持的触发器触发时开始,例如新增文件)以及监控期间(观察变化,出现时行动,例如仪表盘数字变化)。图注说明,这 4 种来自 ChatGPT Work 自己的 Scheduled Tasks。下方金色横幅写着:本课程的上限是会「报告」的计划;会「行动」的计划要等到循环工程。底部写着:任务形状决定 heartbeat,两家厂商都是同样 4 种。

第一次设置计划前有 3 条规则,每一条都有人付出代价才学会:

  • 永远不要计划一项你尚不敢离开它的工作。 计划是梯子的最后一级,不是第一级。先手工运行并观察至少几次,再无人观察地运行几次。只有经受住离开考验的任务,才配得到时钟。只运行过 1 次就设置计划,不是自动化,而是订阅了每周惊喜
  • 把计量算式写下来。 在他人服务器上执行无人值守工作总有预算:每天的运行次数,或每个套餐的小时数;按层级分阶段开放,而且每家公司不同。在多个计划任务于同一周冲突前,先对照套餐限制计算。达到使用量或任务限制后,任务可能暂停、无法运行或需要干预。不要把没有错误消息当作依据,应查看 Scheduled 页面与通知。这正是概念 7 警告的失败:在你赋予沉默明确含义之前,它什么也不代表
  • 运行完成不等于任务成功。 计划器的职责止于「已经运行」,工作是否正确不属于它的职责。因此,要把成功信号写进任务自身输出:任务说明以一行明确内容结束,例如处理项目数、生成文件及其层级,或显式的空结果说明;你要检查这一行。绿色只表示「运行过」,只有这一行表示「有效」

Cowork 的计划任务使用自然语言描述并设置频率,在 Web 上远程运行:无需你的任何设备在线就会触发,结果留在会话中等待你。访问与运行限制按套餐分阶段开放并计量,请根据套餐的实时限制计算,不要依赖这里印出的数字。有一项值得尽早知道的细节,它与限制恰恰相反:即使计算机休眠或桌面应用关闭,Cowork 计划任务仍会远程运行。它们可以使用 connector、插件和保存到 Claude 账户的文件,却无法绑定计算机上的文件夹。因此,如果重复工作流依赖本地文件或桌面应用,需要另一种依赖桌面的设置。让计划工作只使用 connector 与账户存储,承诺就能成立。

按照 OpenAI 的说法,ChatGPT Work 的 Scheduled Tasks 覆盖刚学过的全部 4 种 heartbeat:执行一次操作、按计划重复、在事件发生时重复,或长期监控变化。(在这个 Web 界面上,「出现新文件」等事件式触发通过定期监控处理,不是即时推送,因此这里可以把「触发」与「监控」视为同一家族。)发布示例同时包含两类。一些负责报告:每天早晨检查仪表盘,总结发生的变化;另一些负责行动:收到新反馈时更新演示文稿,或把重复出现的反馈主题转成按优先级排序的产品想法。因此,产品不只会报告。尽管如此,这门初学者课程仍有意停在报告这条线。会行动的计划具有更大的爆炸半径(更多事情可能出错,并触达更远),应当等你在后续课程学会检查器设计、状态、幂等性与恢复。那是本课程选择的规则,不是产品限制。4 个答案(做什么、触碰什么、触达什么、何时)与 3 条规则在这里原样适用。任务在云端针对你的账户运行,通过 Plugin Directory 授予触达权限。使用量会消耗套餐的 agent 配额,因此这里同样必须进行计量计算。请在实时页面确认当前配额。

还有一项明确限制:在包含上传文件的 Project 内创建 Scheduled Task 后,该任务无法访问这些 Project 文件。因此,请使用受支持的 connector 或任务能够访问的其他来源,不要围绕上传到 Project 的文件设计计划工作流。这就是概念 3 的实践:同一种 6 部分结构,另一家公司的按钮。

还要诚实说明边界。 只用本概念,你能构建的是报告型计划:读取来源、综合信息、制作简报并放入正确层级。这确实很有价值,许多人在这个界面的第 1 年价值正是如此,也是本课程有意设置的上限。你还不能安全构建会行动的计划,也就是按频率发送、归档、更新和决定。无人观察的行动需要尚未掌握的组成部分:为工作评分的检查器、机器可验证的停止条件,以及在多次运行之间记忆的状态文件。循环工程 会教你设计全部内容,离开笔记本电脑 则讲解经过验证的结果应该住在哪里。本概念打开了门,那些课程会穿门而过。

简单来说

计划任务是一项永久指令:无需再次要求,工作人员每周一都会执行;即使笔记本电脑关闭也一样。写下 4 件事:工作、可以触碰什么、可以触达什么,以及何时运行。还有 3 条规则:只计划那些你离开时已经能做好的工作;触及限制前先计算套餐预算,并查看 Scheduled 页面,不要相信沉默;让工作报告自己的结果,因为「运行过」与「有效」是两个不同事实。

检查自己

Ayesha 想设置两项计划:周一早晨总结客户未付发票(从 Drive 读取,简报保存到账户),以及周五自动向每位逾期客户发送付款提醒。哪一项属于本课程,哪一项必须等待?二者的一词区别是什么?

查看答案

周一总结属于这里:它是报告型计划,读取、综合并放入一个层级;某周出错只需重写。周五提醒必须等待:任务会在无人观察时按计划对外部世界采取行动,一次错误运行就会给真实客户发送邮件,而本课程没有任何东西会在发送前检查。用一个词概括差别:行动(相对于报告)。报告型计划是本课程的上限。行动型计划需要循环工程讲解的检查器、停止条件与状态;即使如此,提醒邮件也正是人工关口存在的原因。


第 4 部分:选择与开放路径

现在,你已经能够在这个界面上指挥 agent,让文件落入正确层级,并按时钟安排报告任务。还剩 3 个诚实问题:什么时候这个界面是错误选择?完全没有厂商云的开源路径是什么样?无论产品多优秀,这个界面永远无法替你完成什么?本部分会回答全部 3 个问题,然后把你交给本节余下课程。

10. Web、桌面还是终端:根据工作会触碰什么来选择

刚学过的界面只是多个选项之一。成熟习惯是按任务选择,而不是宣誓只忠于一种。区分所有情况的规则很短:根据工作会触碰什么来选择。

工作需要……界面本书在哪里讲解
Connector 与文档工作、跨设备连续性、无需安装Web本课程
机器关闭后仍必须继续的工作Web(仓库工作可使用云端 Routine,属于后续主题)本课程;循环工程
本地文件、桌面应用、已经登录账户的浏览器桌面Cowork 与 OpenWork,知识工作者的下一门课程
代码、仓库、命令行编程 agentAgentic Coding,工程师的下一门课程
有保管要求的受监管数据(PHI、享有特权的材料、受监管财务数据)目前以上都不适用。 先取得合规团队的书面答复Cowork 课程包含完整的受监管工作负载指南

一个小型路由图。顶部的问题是:工作会触碰什么?5 条带标签的路线向下展开:connector 与文档、连续性、无需安装,指向标为「Web,本课程」的金色卡片;机器关闭后的工作也指向同一张金色卡片;本地文件与桌面应用指向标为「桌面,Cowork 课程」的石板色卡片;代码与仓库指向标为「编程 agent,Agentic Coding 课程」的石板色卡片;受监管数据指向陶土色卡片,写着「停止:先取得合规团队的书面答复」。底部写着:这张表既为下一项任务,也为下一门课程提供路由。

把表格读两遍,因为它承担两项工作。作为任务路由器,它回答今天的问题:这份报告应该使用哪个界面。作为课程路由器,它回答本节的问题:下一门同事型 agent 课程该选什么。每天都在处理文档与 connector 的知识工作者继续学习 Cowork 课程,它会增加 Web 无法访问的一切;工程师继续学习 Agentic Coding。没有人必须放弃这个界面,健康设置会长期按任务混用多种界面。

有一行风险最大,值得单独说明:受监管数据。 记住概念 5 的内容:第 1、2 层按定义处于厂商保管之下。远程会话的工作文件与平台存储位于厂商机器上,这正是界面能够工作的原因,也是合规制度关心的重点。因此,对 PHI、客户享有特权的材料或受监管财务数据,问题不是「这个界面是否谨慎」,而是「在这个套餐与这些文件条件下,是否允许数据处于这种保管状态」。只有合规团队能够书面回答。Cowork 课程会完整讲解。在取得书面答案前,受监管数据不能触碰这个界面。

还有一条熟悉的规则,可以避免多界面组合变成混乱:知道每份交付物落入了哪一层。 位于第 3 层的交付物,无论在 Drive、仓库还是公司记录中,都不在意由哪个界面生成。这正是第 3 层的全部意义。

简单来说

不同工作需要不同场所。文档与已连接服务,或机器关闭时仍要运行的工作:用 Web。自己的文件与桌面程序:用下一门课程中的桌面应用。代码:用编程 agent。敏感受监管数据:停止,先取得合规团队的书面同意。可以同时使用多个场所,只需确保每份完成的文档最终进入自己的文件柜,无论由哪个场所制作。

检查自己

3 项任务来到桌面:(a)根据 Slack 与 Notion 制作每周总结,即使旅行也需要;(b)整理笔记本电脑某个文件夹中的 200 个文件;(c)综合客户享有特权的文档制作备忘录。请为每项任务选择界面,并指出决定性事实。

查看答案

(a)Web:只触碰 connector,而且机器关闭后仍要继续,两项事实指向同一个方向。(b)桌面:工作触碰本地文件系统,仅浏览器远程会话无法自行直接访问。这属于 Cowork 课程。(c)目前两者都不适用:享有特权的材料是数据保管问题,第 1、2 层按定义处于厂商保管之下。任何界面接触数据前,合规团队必须书面答复。3 项任务、3 个答案、1 条规则:工作会触碰什么,就决定使用什么。

11. 开放路径:没有厂商云

先承认本课程结构上的一件事,再说明它要求的坦诚。

本书每门同事型 agent 课程都把厂商工具与开源孪生工具配对:Claude Code 配 OpenCode,Cowork 配 OpenWork。本课程打破了这种模式,标签页中配对的是两个闭源产品:Web 版 Cowork 与 ChatGPT Work。这是有意的。两个竞争者相隔几天便发布了同一种结构:一个作为远程会话,另一个作为聊天应用中的模式。这正是本书论点的证据,因此你需要并排看到。但若默默打破模式,就会形成偏见。缺少的开源标签页本应回答这个问题:完全没有厂商云时,还能拥有这个界面吗?

可以,但需要自己动手。今天有两条开放路径。其中一些词(self-hosted、cron、GitHub Actions)属于工程师的词汇;现在不必掌握,只需知道路径存在。

OpenWork:远程与共享工作区。 OpenWork 是下一门课程会正式介绍的开源桌面同事型 agent。它可以连接到不在你笔记本电脑上运行的 worker,例如通过 URL 和访问令牌访问自己托管的 OpenWork worker,或一步连接组织的共享云 worker。这正是本课程的核心观念:执行工作的机器不是你正在看的机器。不过,这里的工作运行在你或组织控制的基础设施上。窗口属于你,大楼也属于你。

OpenCode:使用你自己的计划器。 对于连接仓库的工作,概念 9 的开放答案是由你自己的时钟触发编程 agent:在自己运行的机器上使用 cron,或使用计划执行的 GitHub Actions 作业。没有厂商云、套餐层级与分阶段开放。完整模式由 循环工程 讲解。今天只需知道它存在,而且并不罕见。

现在把交换条件清楚说一次。它也是本书每项开放与托管选择最终归结的交换。公司向你出售脊柱,开放路径要求你自己构建。 在厂商界面上,第一天就会得到可用的一切:会话、文件、同步、手机关口与计划器。但它们处于对方保管之下,采用对方格式,按对方价格,遵守对方规则。在开放路径上,每一项都要由你设置、运行与修复。作为交换,你得到厂商无法出售的两样东西。第一,数据保管:数据位于你控制的机器。第二,选择:决定哪个模型看到提示词,并能自由切换。没有哪一边天然高尚。概念 10 的受监管数据属于保管能力彻底胜出的情况;必须在周五交付简报的独立顾问,则属于现成脊柱彻底胜出的情况。大多数读者会同时保留两种答案,每项任务选择一种。现在应该已经很熟悉这种思路。

简单来说

厂商界面像一间配好家具的办公室:桌子、抽屉、门铃第一天就能工作,但位于对方的大楼里。开放路径像一间需要自行布置的空房:工作更多,却属于你的大楼、规则和选择。两者没有简单的优劣。敏感工作往往需要自己的大楼,快速工作往往需要现成办公室。你可以同时租一间,也拥有一间。

检查自己

一家 NGO 请你设置每周捐赠者报告自动化。其数据政策禁止把捐赠者记录放在第三方消费平台,但团队没有工程师。政策迫使它选择哪条路径?团队失去什么?承诺前应坦诚说哪一句话?

查看答案

政策迫使它选择开放路径:捐赠者记录不能进入消费级厂商平台的第 1、2 层,而这两层正是厂商界面的基础。团队失去免费脊柱、同步、手机关口与托管计划器;现在必须有人构建并持续维护。坦诚的话是:「这条路径用运维人员替代订阅费。必须有人负责设置、更新,以及系统出故障的那个早晨。团队没有工程师,因此真正的决定是这项成本,而不是软件。」数据保管不是免费的,要用运维来支付。

12. 这个界面不能做什么,以及下一步去哪里

像本书每门课程一样,在诚实边界处结束。

界面不会改善工作。 远程会话只会让薄弱的任务说明变成无人观察的工作,不会让它变好。你见过的每根质量杠杆都位于屏幕这一侧:任务说明(概念 8)、计划审阅(唯一拦截点)、层级决定(概念 5)、有意进行的关口测试(概念 7),以及先离开测试再设置计划的规则(概念 9)。2026 年 7 月把 agent 搬进浏览器,却没有搬走你的任何责任。

这个界面只有几周历史,按额度计量、分阶段开放,并带有厂商形状。 本页每项机械事实,包括套餐层级、运行限制、按钮名称甚至产品名称,都是本书中老化最快的材料。离开时应带走持久层:停止输入测试、窗口而非运行时的架构、三层文件及其一行纪律、6 部分阅读透镜、4 步循环和计划任务的 4 个答案。它们能经受每次更名。还有一项纪律能同时保护你免受所有变化影响,请最后再听一次:重要内容绝不能只存在于平台。 任何不愿丢失的内容都要进入第 3 层。

这个界面是起点,不是终点。 你现在已经能够继续走完本节。下面是每门课程为刚学到的内容增加的部分:

  • Cowork 与 OpenWork 是知识工作者的下一门课程,把委派循环扩展到真实文件和桌面,并加入 Web 不需要的完整信任模型:文件夹杠杆、自主阶梯与受监管工作负载纪律
  • Agentic Coding 是工程师的下一门课程,在终端和代码上使用同一循环
  • 规格驱动开发 会磨利第 1 步,直到任务说明成为足够精确、可以检查工作的规格,也能在这个界面上运行
  • 循环工程 构建概念 9 暂时挡住的东西:会行动的计划,并加入让行动保持安全的检查器、停止条件与 state spine
  • Harness 工程信任检查器 先让循环安全,再让它可测量
  • 离开笔记本电脑 以运行时决策结束本节,说明经过验证的工作应该住在哪里;刚学过的界面就是其中一些住所的前门

最后用 3 句话概括整门课程。聊天框用于设计,agent 界面用于运行。2026 年 7 月,两者搬到同一个地址,分工因此更清晰,而不是更模糊。学习结构,地址还会再次改变。

简单来说

这个界面改变工作在哪里运行、何时运行,却不改变工作质量。质量仍来自任务说明、计划审阅与检查。本页产品会多次更名并改变限制,本页观念不会。把成品保存在自己的存储中,并把这些观念带入下一门课程。

检查自己

一位读者学完课程后说:「既然 agent 已经在 Web 上运行,桌面和终端课程都过时了。」请使用概念 10 的规则与本概念的边界,用两句话纠正。

查看答案

界面按工作会触碰什么划分,不按谁最后发布。仅浏览器远程会话无法自行直接访问本地文件、桌面应用与仓库,而这些都是真实工作,因此桌面和终端课程讲解的是这个界面没有覆盖的领域。无论新旧,没有任何界面会改善工作本身;技能在于任务说明、计划审阅与检查,本节余下内容会让这些技能更加深入。


本书在哪里使用这个界面(内部实践)

截至 2026 年 7 月中旬,诚实答案是:本书自己的无人值守循环不在这个界面上运行,原因正是概念 10 正确发挥作用。本书是一个仓库,循环与仓库连接,审阅关口在 CI 中位于合并关口旁边,完全如 离开笔记本电脑 的内部实践部分所述。工作触碰的是仓库,因此路由到另一个界面。

这个界面在本书生产中确实有两类价值。第一,每个循环之前的聊天侧设计工作:起草任务说明、测试审阅提示词、手工运行一个 heartbeat。第二,围绕本书的 connector 与文档任务。第二类就是概念 9 所说的报告工作,也是本课程上限。这种分工不是妥协,而是本课程讲解的劳动分配:在聊天框设计,在工作会触碰的界面运行。你现在读到的正是这种安排的产物。


🚀 项目

6 个项目,由易到难。使用真实但低风险的工作,例如笔记、计划和草稿;绝不要使用受监管数据(概念 10 的规则也适用于练习)。

📱 项目 1 · 15 分钟 · 合盖测试。 难度:简单 · 使用:概念 2。操作。 启动一个小型多步骤会话(把粘贴的 3 份文档总结成一份简报)。运行中途关闭标签页,再从手机重新打开。完成标准:你看到同一会话在第二台设备上继续,并能用一句话说明运行时究竟在哪里。

🗂️ 项目 2 · 30 分钟 · 三层审计。 难度:简单 · 使用:概念 5、8。操作。 运行一项会产出交付物的真实任务。使用概念 8 的完整任务说明,包括末尾列出每个文件及其层级的那一行。完成标准:能说出任务创建的每个文件属于哪一层,而且交付物本身存在于第 3 层,也就是你的 Drive、收件箱或记录中,而不只在平台上。

🔔 项目 3 · 20 分钟 · 有意让关口响起。 难度:简单至中等 · 使用:概念 7。操作。 设计一项需要 1 次审批的任务,然后完全离开计算机。审批行为因产品、connector 与工作区而异,因此使用安全、低风险的触发条件:要求 agent 把无害测试文件保存到已连接的测试文件夹,或准备一项需要确认的操作草稿。本练习不要使用发送、删除、购买或账户变更。如果没有触发审批,这本身也是发现:检查审批模式与 connector 设置,并记录如何才能让关口响起。完成标准:审批到达手机,你从手机处理,回来时成品正在等待。没听过的警报只是传闻,这个项目让你听一次。

⏰ 项目 4 · 30 分钟 + 1 周 · 第一项报告计划。 难度:中等 · 使用:概念 9。操作。 使用 1 个 connector 与 1 个文件来源创建周一早晨简报。先写 4 个答案(做什么、触碰什么、触达什么、何时),在任务说明中加入空结果行与成功信号,并写下套餐的计量算式。厂商注意事项:ChatGPT 中,在包含上传文件的 Project 内创建 Scheduled Task 后,该任务无法访问这些 Project 文件。请使用支持的 connector 或任务能够访问的其他来源,不要围绕上传到 Project 的文件构建计划工作流。完成标准:在你的所有设备都离线时触发 2 次,并且每次结果都包含成功信号,而不只是运行完成。

🔁 项目 5 · 45 分钟 · 一项任务,两家厂商。 难度:中等 · 可选,需要同时访问两种产品 · 使用:概念 3。操作。 在 Web 版 Cowork 与 ChatGPT Work 模式中运行同一项任务。两边都需要付费套餐,而且分阶段开放可能意味着暂时无法同时访问。如果如此,可以与拥有另一种产品的人合作比较结果,或只在现有产品上运行,并根据概念 3 的表格预测另一边。把对比表放在旁边实际测试:每行是否仍然成立?自 2026 年 7 月中旬以来,某次开放或更名是否改变了内容?完成标准:拥有一页保存在第 3 层的笔记,说明确认了哪些对比行、哪些已经漂移(机械层实时老化),以及双方是否都出现全部 6 个共享部分。最后一项发现才是重点,而不是差异。

🧳 项目 6 · 45 分钟 · 出口演练。 难度:综合项目 · 使用:概念 5、11。操作。 假设平台本季度消失。只使用第 3 层,也就是 Drive、邮件和记录,重建工作状态:模板、永久任务说明与交付物。完成标准:写下无法重建的内容列表。这份列表就是第 2 层暴露面,也是下周要执行的保存纪律。(学习 离开笔记本电脑 时,会再次遇到这项演练,但增加工程要求。)


附录:后续课程在 Web 上的对应关系

通用 agent 部分的其余课程使用 Claude Code 与 OpenCode 教授技能:这些本地工具从终端运行,并处理自己机器上的文件。本课程讲解 Web 界面:Web 版 Cowork 与 ChatGPT Work,二者都远程运行,都位于浏览器标签页中。

这些附录就是桥梁。它们会针对每门后续课程提出一个问题:无需安装任何内容时,能从 Web 界面完成多少?答案从来不是「全部」,也不是「完全不能」。有些观念可以换一个名称后完整迁移,有些以较弱形式迁移,还有一些完全无法跨越,因为需要 Web 界面不具备的本地机器或真实代码执行。最后一个附录会完全退后一步,描绘整个行业的 harness 之战。

最后一类不是 Web 界面的缺口,而是本节要求你离开浏览器的准确界线。因此,请用两种方式阅读这些附录:既把它们当作今天已经能做什么的地图,也当作下一批课程为何存在的预告。

有一条规则贯穿所有附录。在 Web 上,你租用完成的 harness;在后续课程中,你亲自构建。 当某个主题属于厂商 harness 已经替你完成的事情时,它可以「迁移」;当它需要你自行连接时,则「无法迁移」。把这条线保持在视野中,每个附录都会以同样方式呈现。

两个并排面板,都由 harness 工程的同样 5 个动词构成:约束、告知、验证、纠正、升级。左侧面板标题为「在 Web 上 · 你租用完成的 harness」,是一只密封盒:约束、验证、纠正显示为灰色,标为「替你完成」;只有告知与升级显示为金色,标为「由你设置」。说明文字写着:5 个动词中有 2 个属于你,另 3 个属于厂商。标为「跨过桥梁」的陶土色箭头指向右侧面板,标题为「在后续课程中 · 你构建一个 harness」;其中 5 个动词都是活动部分,标为「由你构建」,说明写着:全部 5 个动词都属于你,即规则、hook、sandbox、检查器与关口。底部写着:两边的 5 个动词相同,改变的是谁握着工具。

再补充一条框架说明,让下面的边界保持诚实。附录说 Web「无法访问本地文件」或「没有本地仓库」时,指的是仅浏览器会话:一个标签页,不安装任何东西。本课程讲的就是这种界面。它之外紧邻两样东西。桌面桥接(概念 2)可以在桌面应用打开时,借给远程会话有限的本地访问。本地 agent(桌面与编程课程)则从一开始就在你的机器上运行。因此,应把「无法迁移」各行理解为「仅浏览器」:它们标出标签页的终点,也正是下一批课程的起点。

附录 A · Web 上的 Agentic Coding

Agentic Coding 课程 通过 15 个概念讲解 Claude Code 与 OpenCode,也是本书的上下文工程课程。大多数观念都围绕管理模型看到什么,以及让工作可以检查。由于 6 个部分相同,其中相当多内容能迁移到 Web。无法迁移的,是所有假定存在终端、本地文件系统和自行运行代码的内容。

可以完整迁移:

那门课程讲解在 Web 上对应
计划模式(先读,批准后再行动)概念 8 的委派循环。运行前先要求计划。同一种观念,无需快捷键
规则文件(CLAUDE.md / AGENTS.md),永久项目指令Project 保存的指令,加上概念 6 的持久工作区观念。Agent 每次会话都会读取的永久规则
上下文管理(保持窗口精简,重新开始还是继续)选择新会话或继续现有会话。概念 4 的 state spine 是同一套栈,只是由厂商管理
让模型与任务匹配Web 上较弱:得到界面指定的模型,不是菜单。习惯仍然存在,即「了解这个界面运行哪个模型」
MCP:连接记录系统正是 connector。概念 6。底层标准相同,两边目录不同
技能(打包且可复用的知识)在符合条件的套餐中,两个产品家族都允许从聊天创建技能、在编辑器中构建,或上传包含指令、资源与代码的包。格式可以迁移
验证循环(尝试、检查、修复、重复)检查条件并告诉你变化的计划报告,也是概念 9 的上限。你得到由平台替你执行的检查,但尚未得到自动修复
提示词注入:上下文就是门概念 6 的不可信内容规则,逐字相同。任何界面上的风险与习惯都一样

以较弱形式迁移:

那门课程讲解Web 上的受限版本
斜杠命令与技能周围的运行时技能本身可以迁移(见上文)。较弱的是编程 agent 设置的其余部分:自行编写的斜杠命令,以及对技能运行时的控制,包括生命周期 hook、模型路由、文件系统与强制执行层。你得到技能,得不到运行它的机器
子 agent(拥有独立上下文窗口的单独 worker)Web 界面可以自行把大型任务展开成多个子步骤,但你不能自行创建使用指定模型与受限工具集的子 agent。你得到厂商的编排,不是自己的编排
恢复、撤销、回退会话可以恢复,但没有 /rewind 回到先前步骤,也没有基于 Git 的 /undo 撤销 agent 编辑,因为工作不在你的仓库中发生。撤销方式是「把旧文件保存在第 3 层」

无法迁移,这正是重点:

那门课程讲解Web 无法做到的原因
Hook 与插件(每次都由代码强制执行的规则)Hook 是在你的机器上运行、用于阻止或检查操作的代码。Web 界面不运行你的代码,也不暴露这些生命周期事件。这是整门课程最清楚的「离开浏览器」界线。当需要模型无法靠说辞绕过的保证时,就需要自行构建的 harness,也就是 Harness 工程
处理本地仓库、运行终端命令仅浏览器会话运行在公司的服务器上,不在你的磁盘上。它无法自行打开终端或编辑本地项目。桌面桥接可以借出有限的本地访问,但终端与仓库工作流属于本地工具。这是概念 2 的重述:运行时位于远程
通过模型路由控制成本(用前沿模型规划,用廉价模型执行)强模型规划、廉价模型执行的拆分需要你选择两个模型,并能在任务中途切换。Web 界面替你选择模型

诚实小结。 如果工作是文档、connector 与计划报告,Web 界面以不同名称覆盖了 Agentic Coding 课程的大部分价值。工作一旦触碰自己的代码、文件,或必须由代码强制执行的规则,就到达 Web 界面的边缘。这不是缺陷,而是下一批课程的入口;现在你已经知道它准确位于哪里。

附录 B · Web 上的 Cowork 与 OpenWork

这一项与其他附录不同。Cowork 与 OpenWork 课程 是本课程最近的亲属。它讲解同一种面向知识工作者的通用 agent 同事,建立在同一委派循环上,区别在运行时。那门课程在桌面上讲解两种产品:Claude Desktop 内的 Cowork,以及开源孪生工具 OpenWork。本课程则在 Web 上讲解 Cowork。同一家族,不同住所。因此,这里的地图不问「能迁移多少」,因为几乎全部可以迁移,而是问「桌面提供哪些 Web 没有的能力,以及为什么」。

可以完整迁移,因为属于同一产品家族:

那门课程讲解在 Web 上对应
委派,不要查询(把工作交给同事)概念 1、8 的内容,逐字相同。这是最重要的单一习惯,在任何界面都一样
任务循环(交代、计划、批准、执行、审阅)概念 8 的委派循环。同样 6 个步骤,计划处同样是拦截点
计划就是杠杆概念 8 的核心,也是委派循环图突出计划步骤的原因
把 Connector 作为信任杠杆(最小范围,读取不等于发送)正是概念 6。同样的 connector、范围纪律与「读取范围不等于发送范围」规则
审批模式(行动前询问、不询问直接行动)概念 7 的手机关口。Web 把同一项审批发送到手机,而不是显示内嵌卡片
技能(agent 按描述选择的已保存操作手册)Web 版 Cowork 携带同一套技能系统:目录、/skill-creatorSKILL.md 格式属于产品,不属于桌面。这是 Web 界面比前面附录暗示得更强的一个地方
自主阶梯(每类任务只升一级)概念 8、9 的纪律:绝不要计划一项你不敢离开的工作。阶梯关乎信任,不关乎使用哪个界面
提示词注入与不可信内容概念 6 的不可信内容规则。含隐藏指令的厂商 PDF 故事在 Web 上完全相同
计划任务(Cowork 内置频率)概念 9。Cowork 的 /schedule 与 Scheduled 视图在 Web 上使用方式相同
分层指令栈(全局、文件夹、会话)概念 4、6:全局设置、Project 指令与会话提示词。「文件夹」层变成 Project 层

可以迁移,但 Web 会改变形状:

那门课程讲解Web 上的区别
3 根信任杠杆:文件夹、connector、审批其中 2 根相同,第 1 根改变。桌面上,你授予一个本地文件夹的访问权限;仅浏览器会话没有本地文件夹可授予。工作区是概念 5 的任务文件系统与平台存储。范围纪律仍然存在,但「在磁盘上建立专用工作文件夹」变成「把工作放进自己的 Project」。(桌面桥接可以访问本地文件夹,但那是桌面应用的工作,不是标签页的。)
子 agent(批量任务中的并行 worker)Web 版 Cowork 仍可自行把批次展开给并行 worker。失去的是桌面对每个 worker 更完整的可见性,以及任何依赖本地文件的控制。模式仍在,本地文件版本无法迁移
持久工作区(一个文件夹加 CLAUDE.md变成概念 6 的 Project 加已保存指令。同一种观念,但磁盘上没有文件夹。上下文文件变成 Project 的指令字段
模型路由(强模型思考,廉价模型搬运)与附录 A 一样,Web 上更弱。每项任务得到界面的模型选择器,不是 OpenWork 的完整厂商选择

无法迁移,而这正是桌面存在的全部原因:

那门课程讲解Web 无法做到的原因
把本地文件作为执行界面这是桌面课程的核心。Agent 在你机器上的文件夹中读写文件,例如事项文件夹、结账周期文件夹、营销活动文件夹。远程 Web 会话运行在公司服务器上,无法自行访问本地硬盘。这是概念 2,也是 Cowork 必须作为独立桌面课程存在的最大原因
OpenWork 本身(开源、自带模型的孪生工具)OpenWork 是要安装的桌面应用,连接你选择的模型厂商,文件保留在自己的机器上。这种交换没有 Web 版本。概念 11 已经点名开放路径,但它不是浏览器界面
「本地优先」隐私(文件永不离开机器)在 Web 上,agent 读取的文件内容按定义位于公司服务器。桌面最核心的隐私承诺「文件保留在本地」,无法存在于远程界面。对受监管数据而言,这是决定性区别,概念 10 已经画出界线
把 Cowork 插件作为角色包(Legal、Finance、Sales)桌面课程的插件会把技能、connector、斜杠命令与子 agent 打包成一个角色。完整插件系统是否能从 Web 使用,正是需要查看实时页面的几周历史细节;但它最初就是为桌面运行构建的
基于备份的恢复(Time Machine、Git、Drive 历史)桌面课程的恢复方式是「本地备份回滚文件」。Web 上没有本地文件可回滚,恢复依赖概念 5 的纪律:把先前版本保存在第 3 层

诚实小结。 Cowork 课程与本课程是通往同一房间的两扇门。如果工作是文档与 connector,并希望以最低摩擦开始,Web 界面已经提供那门课程的大部分能力,包括技能系统。工作一旦必须触碰自己机器上的文件、让数据离开厂商服务器,或使用 OpenWork 的自带模型路径,就需要桌面。这不是 Web 的缺陷,而是桌面课程成为下一门课程的原因:工作回到自己的机器时,就去那里。

附录 C · Web 上的循环工程

循环工程课程 教你构建一个替你向 agent 发提示词的系统:自行启动、完成工作、检查结果、记住做过什么,只在选择真正需要人时才呼叫你。课程使用 Claude Code 与 OpenCode,并采用本课程作为阅读透镜的同一套 6 部分结构:1 个 heartbeat、4 个工作部分和 1 条 spine。

诚实的分界如下。那门课程自己就画出了这条线,有一整节标题是「循环可以在哪里运行?」答案很直接:普通聊天框不能运行循环,Claude Code、OpenCode 和 Cowork 可以。因此,Web 界面位于中间:能触发简单 heartbeat,却无法完成让循环在真实运行时值得信任的工程工作。

可以用简单形式迁移:

那门课程讲解Web 上的简单版本
计划 heartbeat(每天早晨运行,笔记本电脑关闭)概念 9 的计划任务。这是 Web 擅长的一种 heartbeat。按时钟触发报告,正是 Cowork 的 /schedule 与 ChatGPT Work Scheduled Tasks 提供的能力
事件 heartbeat(有内容到达时作出反应)部分可以。ChatGPT Work Scheduled Tasks 能监控变化,属于轻量事件触发器;但无法得到课程中的 GitHub 事件与 API 触发机制
Spine(多次运行之间的记忆,让今天承接昨天)较弱形式。账户会保留会话与 Projects,因此部分记忆能够延续;但没有课程中的真实 spine:仓库里的 progress.md 与规则文件,每次运行开始先读,结束再更新
技能(写一次,每次运行都读取的知识)如附录 A 所述,两种产品家族都在符合条件的套餐中提供打包技能。因此,「没有运行从零开始」在两边都能迁移到 Web
Heartbeat 菜单(任务会结束、重复,还是只发生一次?)概念 9 的自我检查。选择最轻量循环的纪律不依赖界面,是一种思维方式,不是一条命令

无法迁移,而这正是课程真正讲解的内容:

那门课程讲解Web 无法做到的原因
制造者与检查器分离(一个 agent 编写,由另一个独立 agent 评分)这是那门课程最重要的单一观念,Web 无法实现真实版本。Web 提供界面自己的 run-until-done,由厂商决定何为「完成」。你不能创建拥有独立模型与书面评分标准的检查 agent。附录 A 的验证循环在这里再次遇到同一堵墙
Worktree(隔离,避免并行 agent 相互冲突)Worktree 是机器上的独立 Git 检出。Web 没有本地仓库,因此没有可以隔离的东西。整个概念都假定存在 Web 不具备的本地文件系统
仓库中的 spine(循环读写的 progress.md 与规则文件)真实 spine 以文件形式存在于自己的仓库中,每个 heartbeat 开始时读取,结束时更新。Web 会话记忆属于厂商并采用厂商格式。「没有 spine 就没有循环」这条规则正说明严肃循环为何需要拥有仓库的工具
/goal/loop、有上限的 shell 循环(由你控制的 run-until-done)这些是 Claude Code 命令与 OpenCode shell 模式。Web 界面给你厂商版 run-until-done,不是课程版本;后者由你设置停止条件、重试上限与无进展检查
动态工作流(把完整编排写成可重新运行的脚本)这是循环 body 的最深形式:多个子 agent 经过检查并受上限控制,再打包成一个脚本。即使在本地工具中,也只有 Claude Code 支持,远超任何 Web 界面
Cloud Routines 与 GitHub Actions(无人值守运行时)课程中的真实无人值守 heartbeat 在 Anthropic Routines 或 GitHub runner 上针对仓库运行,并有分支规则与运行上限。Web 计划任务只是较轻的亲属:它负责报告,不会在 claude/ 分支上打开经过审阅的拉取请求

诚实小结。 Web 界面能够运行循环最简单 heartbeat 的形状:在你睡觉时触发的计划报告。这是真实能力,对许多人已经足够。但循环工程的重点不在 heartbeat,而在让无人值守循环保持安全的组成部分:独立检查器、隔离、属于你的 spine,以及由你控制的停止条件。每一项都需要拥有仓库并能运行代码的工具。因此,这个附录标出整节最清晰的晋级路线:当计划报告必须变成一个可以在你睡觉时放心改变事物的循环,你已经超出 Web 界面,循环工程会在那里接住你。

附录 D · Web 上的 Harness 工程

整门课程一直指向这个附录。概念 3 与 harness 之战说明已经讲清分工:在 Web 上租用完成的 harness,后续课程教你构建。Harness 工程课程 就是构建发生的地方。它讲解模型周围那层把原始智能变成可信 agent 的结构:决定 agent 可以做什么、知道什么、如何证明工作,以及出错后会发生什么的一切。

因此,这个附录的界线最清楚。几乎没有任何构建内容能迁移到 Web,但课程的思维方式,即 5 个动词,可以完整迁移。这是 Web 用户看清一件事的最佳透镜:租用的 harness 替你做了什么,又没有做什么。

把 5 个动词作为透镜(这种思维可以迁移):

课程用 5 个动词组织 harness 的全部工作。在 Web 上,你不会构建其中任何一项,但能够看到全部 5 项;理解它们,就知道自己信任厂商完成什么。

动词含义在 Web 上由谁完成
约束(限制 agent 可以做什么)权限规则、拒绝列表、sandbox厂商替你完成。你能控制的小部分是 connector 范围与审批模式(概念 6、7)
告知(提供所需信息)规则文件、技能、工具设计部分由你完成。Project 指令与打包技能(符合条件的 Cowork、ChatGPT 套餐均支持)是你的告知界面,其余属于厂商
验证(工作通过证明后才算数)Hook、测试、类型化输出厂商内置的 run-until-done。无法添加自己的 hook 或检查
纠正(恢复,然后修复系统)检查点、棘轮由厂商完成。唯一「回去」的方式是概念 5 的第 3 层副本
升级(交给人处理)人工关口、醒目日志双方共享。概念 7 的手机关口是你的升级界面,日志属于厂商

这张表就是诚实图景。在 Web 上,5 个动词中有 2 个真正留给你一部分:通过 Projects 与打包技能告知,通过手机坐在升级关口。另 3 个让无人值守 agent 保持安全的动词由厂商替你完成,方式不可见,也无法改变。

无法迁移,因为构建 harness 就是整门课程:

那门课程讲解Web 无法做到的原因
权限规则(按爆炸半径允许、询问、拒绝)拒绝规则是 settings.jsonopencode.json 中由工具强制执行的一行。Web 提供审批模式,不提供规则语言。你无法在 Web 界面写下「拒绝读取 .env
核心规则:护栏存在于 harness,绝不只写在提示词里这是课程最重要的一句话,也恰好是 Web 上无法执行的内容。要把规则从提示词移入强制执行层,必须能够访问该层,Web 不会暴露。在 Web 上,所谓护栏是厂商的护栏,加上 Project 指令中能说的内容;课程会把后者称为请求,不是护栏
Sandbox(文件系统、网络与分支围栏)Sandbox 是操作系统层的墙,限制 agent 能触达什么。它假设存在你控制的机器与可以围住的运行时。Web 会话运行在厂商服务器和厂商 sandbox 中,条件无法由你设置
Hook(操作前后自动运行的代码)Hook 是你的代码,由 harness 在固定时刻运行,可以阻止或检查操作。Web 不运行你的代码。这是附录 A 的同一堵墙,从 harness 一侧观察:严肃控制需要本地工具的最清晰单一原因
类型化输出(由机器检查并由你验证的判定)你编写一个验证器,循环在信任结果前运行。它需要你控制的运行时。Web 给你厂商验证,不提供添加自己验证的位置
棘轮与 4 类失败(把每个错误变成永久修复)棘轮把每项教训写入你拥有的 harness 界面:规则、hook 或围栏。Web 没有这样的写入位置。你可以学习分类失败的习惯,却无法把修复安装到课程要求的位置
内外分离、可观测性、harness 耦合这些是工程师长期构建与调优 harness 的纪律,假设你拥有 harness。Web 用户按设计不拥有它。这正是 harness 之战说明已经指出的交换:租用意味着无法调优

诚实小结。 Harness 工程是本节最明确要求「离开浏览器」的课程,也是本课程从概念 3 开始一直指向的课程。它的完整主题,就是你在 Web 上租用、在桌面上构建的那一层。今天可以带过界线的只有一件事:5 个动词,作为观察租用 harness 替你做什么的透镜;以及一条规则,真正的护栏是强制执行的,不是口头请求的。但一旦需要设置护栏、写拒绝规则、添加 hook、围住 sandbox 或把修复写入棘轮,就到达整门课程一直描绘的准确边缘。在 Web 上信任 harness,在那门课程中构建 harness。这就是租用盒子与设计盒子的区别。

附录 E · Web 上的信任检查器

信任检查器课程 会追问循环与 harness 课程一直推迟的问题:如何知道检查器够好? Agent 为自己的工作评分,或审阅 agent 返回 PASS 时,判定只是模型的意见。这门课程讲解评测:测试测试者的纪律,让「检查器说 PASS」变成一个可以辩护的数字。它建立一组黄金案例文件,以无头方式运行,对照你自己的评分校准裁判,并让每次变更都必须通过结果关口。

这是本节最需要「仓库与 shell」的课程。完整方法由文件夹、runner 脚本与 jq 构成,Web 上不存在这些机制。不过,课程还教一种看待测量的方式。它会改变你阅读任何 agent 输出的方式,包括 Web agent,而且可以完整迁移。

作为判断迁移(这是 Web 上的真正价值):

那门课程讲解在 Web 上成为一种思维习惯
Agent 是分布,不是函数(评价比率,不评价单次运行)最值得带走的观念。计划报告成功运行 1 次,只代表 1 次运行,不是证明。如果工作重要,应在多次运行中检查后再信任。无需工具,只需拒绝相信单个绿色结果的纪律
裁判也是模型(PASS 是需要校准的意见)Web agent 说「完成」或「已经检查」时,要记住这是主张,不是证明。Web 提供厂商检查器,却无法由你校准。因此,你仍是人工校准:尤其在早期,要抽查判定
先看哪些失败,再看失败多少(比率会隐藏严重度)审阅一批 agent 工作时,错误的 3 项比高总分更重要。这种阅读习惯适用于任何界面的任何输出
门槛是决定,不是发现作为指挥 agent 的人,由你决定多好才算足够,以及哪些任务适用。任何界面上,这项判断都在你手中;它是概念 8 的计划审阅纪律应用到结果上
演示是最弱的证据「我试过,它有效」只是 1 次运行,任务往往因容易成功而被选择,观察者也希望它成功。当你决定是否把重要工作交给 Web agent 时,这种警惕会保护你

无法迁移,因为构建评测套件需要仓库与 shell:

那门课程讲解Web 无法做到的原因
黄金集(受版本控制的案例文件夹)案例是仓库中的 JSON 文件,像代码一样经过审阅并标注日期。Web 没有保存它们的仓库,也没有版本化位置
Runner(在 shell 循环中使用 claude -p / opencode runjq整个 runner 都是无头命令行执行与 shell 评分。Web 既不运行你的 shell,也不运行脚本。这与此前每个附录遇到的是同一堵墙
校准裁判(盲测 20 项协议、4 格表)可以手工完成其中的思考,但课程版本会测量一个可以检查和替换的模型裁判。Web 裁判属于厂商并被密封,无法对它执行协议
回归套件与 CI 关口(每次变更都重新运行,低于基线即失败)这是一项连接到 CI 的评测作业,具有分支保护与已提交基线。CI、分支、基线每一项都是 Web 不具备的仓库工具
按计划监控漂移(每晚运行,下降时告警)课程把完整套件作为计划循环针对基线运行。Web 可以计划一份报告,却无法针对已提交基线运行一套测试,因为没有套件与基线的存放位置
古德哈特定律防御(agent 永远看不到的密封保留集)保留案例放在 agent 无法访问的文件夹中。这假设存在你控制并能隔离的文件系统。Web 既没有文件夹,也没有围墙

诚实小结。 信任检查器是所有这些课程中最难从 Web 构建的一门,因为完整方法就是文件、shell 与仓库。Web 界面无法构建评测套件。但它可能最值得提前阅读,因为这种思维无需工具。每次依赖 Web agent,都是在信任一个从未测试过的检查器。那门课程教你感受其中分量:评价比率而非单次运行,先读严重度再读数量,并继续充当厂商检查器永远得不到的人工校准。到达仓库时,你会构建真实套件。此前先保持这种心态:只有经过诚实观察的历史记录才能赢得信任,而在 Web 上,保存记录的人就是你。

附录 F · Web 上的离开笔记本电脑

这是最后一个课程映射附录,用整门课程依赖的边界闭合循环。从一开始,本课程就称自己为前门,把 离开笔记本电脑 称为平面图。现在可以看出原因。那门课程回答本节最后一个问题:不是 agent 做什么,而是住在哪里,由谁维持运行。它把每种选择分入 4 个住所;本课程讲解的 Web 界面并不在地图之外,而是其中一个有具体限制的住所。

因此,这个附录与前 5 个不同。前面都问:那门课程的哪些内容可以在 Web 上完成?这里问:Web 界面位于那门课程地图的哪里?答案会澄清整门课程在本节的位置。

把 Web 界面放入 4 个住所:

离开笔记本电脑用一个问题划分运行时:谁操作循环,工作在哪里运行?Web 界面位于如下位置。

那门课程的住所Web 界面的位置
住所 1:你的会话(一切由你负责,合盖即停止)最接近由你手工驱动的普通 Web 会话。你启动、观察,完成后停止。Web 版本甚至移除了「合盖即停止」,因为会话运行在公司服务器上,不在笔记本电脑中
住所 2:云端计划(时钟移出,笔记本电脑可以关闭)Web 界面在这里达到上限,而且表现很好。Cowork Scheduled Task 或 ChatGPT Work Scheduled Task 正是知识工作的这个住所。课程直接把 Cowork Scheduled Tasks 列为住所 2 示例。概念 9 的计划报告就是住所 2 循环
住所 3:托管运行时(你发送定义,由厂商运行循环)作为作者无法从 Web 触达。住所 3 意味着通过 API 向厂商交付 agent 定义,并围绕它运营业务。这是构建者使用 SDK 与平台文档完成的动作,不在浏览器聊天中完成
住所 4:你自己的进程(harness 作为服务器上的库)完全无法触达。这是模式 2,由你编写并运行运行时,是全书距离 Web 界面最远的事物

作为决定性判断迁移的内容:

课程真正的礼物不是机械步骤,而是选择住所的 4 个问题,全部依赖判断。它们适用于包括本界面在内的任何界面。

那门课程讲解在 Web 上仍要提出的问题
Q1:用户是谁?(只有你,还是其他人?)最重要的问题,完全由你提出。如果答案是只有你,Web 计划任务通常已经是完整答案;课程也明确指出,住所 2 是大多数人的上限。一旦其他人依赖输出,就会开始感受到 Web 的边缘
Q4:一个糟糕夜晚会造成多少损失?(爆炸半径决定速度)这是概念 9 的报告与行动界线,也是 harness 课程的预算问题,只是针对运行时提出。它依赖判断,而判断在任何界面都属于你
无头执行是桥梁无法从 Web 跨过这座桥,这正是识别信号。每次离开 Web 搬向更强住所,都要经过 Web 不提供的无头命令(claude -popencode run)。桥梁真实存在,起点就在浏览器终点
行李箱测试(纪律会迁移,机械部分需重建)永久任务说明、Project 指令、对「完成」的理解,这些属于纪律,换到更强工具时会一起迁移;Web 自己的按钮和设置不会。把工作知识保存在自己的笔记中并保持可移植,就是 Web 用户版本的「仓库保存真相」

无法迁移,因为离开笔记本电脑意味着离开浏览器:

那门课程讲解Web 无法做到的原因
无头调用claude -popencode run每次搬迁都会跨过的桥。Web 没有无头命令,正因如此无法到达住所 3、4,也只能部分到达住所 2
托管运行时(通过 API 使用 agent 定义、环境与会话)构建者使用代码与平台文档驱动的运行时,没有浏览器路径
最小无人值守套件(幂等性、漏跑检测、并发锁)围绕自己运行的循环连接的 6 项控制。在 Web 上由厂商运行循环,因此你不构建套件,只继承厂商提供的内容,也无法添加
到达协议与重新建立基线(用评测套件证明迁移)在新住所运行黄金集,需要附录 E 的套件,而套件需要仓库。没有套件,就没有到达协议
拥有运行时(住所 3、4)课程整个后半部分。拥有运行时的任何部分都意味着运营基础设施,恰好与租用 Web 界面相反

诚实小结,也是课程映射附录的结尾。 离开笔记本电脑告诉你:Web 界面有真实位置,也有上限。Web 是手工驱动工作的良好住所 1,也是按计划运行知识工作报告的真实住所 2。这覆盖大量真实工作,对许多人就是全部故事。但工作一旦需要跨过无头桥梁、针对仓库运行、拥有自己的 sandbox,或从受你控制的运行时服务其他人,就到达本课程从第一页开始描绘的边缘。这是本课程与离开笔记本电脑共同负责的边界:本课程是前门,后者是整栋房子的平面图。现在你知道哪些房间能从浏览器打开,哪些需要拿起钥匙并安装工具。这就是 Web 界面的诚实形状:真实的起点、清晰的终点,以及终点之后一切事物的地图。

附录 G · 整个行业的 Harness 之战

前 6 个附录逐一把本课程映射到后续课程,最后一个则向外看。概念 3 点出两家公司之间的 harness 之战。到 2026 年,参与者已不只两家,而是整个行业;几乎所有严肃实验室都接受同一种框架:竞争已经从原始模型转移到模型周围的 harness。

这是这里最值得看清的一件事。阅读新闻时,标题都在谈模型:这个得分更高,那个价格更低。但产品真正竞争的是外壳:计划、connector、记忆、关口与运行时。本附录是一份战场指南,说明谁在哪里竞争。目的不是背诵。正如课程反复强调,产品按周老化;重点在于学过的 6 部分结构能够读懂每一种产品。

行业快照——事实核验日期:2026 年 7 月 21 日。 本附录比课程其他部分老化更快,设计上就应单独更新。下面许多内容只宣布尚未发布,竞争格局每月变化。请把它当作带日期的快照,不是持久事实;依赖任何一行前,都要对照来源核验。

参与者分布在 3 条战线。前述附录的租用与构建界线贯穿整个行业。

战线 1:消费级工作界面(租用完成的 harness)。 本课程讲的就是这场竞争:聊天框旁边、面向日常知识工作的 agent 界面。

参与者界面当前状态
OpenAI · ChatGPT WorkChatGPT 内的一种模式本课程主题,2026 年 7 月发布
Anthropic · Claude Coworkclaude.ai 上的远程会话本课程主题,2026 年 7 月扩展到 Web 与移动端
Google · Gemini SparkGemini 应用中的 24/7 云端 agent在 I/O 2026 宣布:个人 agent 在 Google 云机器上运行,即使设备关闭也能跨 Gmail、Docs 与 Workspace 工作。与本课程讲解的结构相同,纪律也相同:主打护栏是在花钱或发邮件前询问。2026 年中仅在美国提供早期访问。通过 Search、Workspace 与 Chrome,它拥有最深资金与最广分发
Microsoft · Copilot TasksMicrosoft 365 中统一的任务界面Auto、Researcher、Analyst 模式,加上计划功能:组成部分相同,直接面向企业 Office 工作。Microsoft 的优势是分发。正如一位分析师所说,战斗不再是谁拥有最好的聊天机器人,而是谁拥有工作界面
Meta · Meta AIWhatsApp、Messenger、Instagram 内的 agent竞争重点是覆盖面,不是能力:harness 住在数十亿人已经聊天的地方,更新后的模型系列 Muse Spark 显示出一次严肃重建。据报道,Meta 曾试图以 20 亿美元收购 agent 初创公司 Manus,但中国监管机构在 2026 年要求撤销交易。这提醒我们,竞争还有地缘政治战线

请带着概念 3 的 6 个部分阅读这张表。每一种都有 heartbeat(计划)、connector、run-until-done loop、state spine、human gate 与 body。名称不同、所有者不同、结构相同。这就是本课程的完整论点,同时在 5 家公司展开。

战线 2:托管运行时(租用运行时,不租用界面)。 消费级界面下一层是企业平台:你向厂商交付 agent 定义,由厂商运行循环。这就是附录 F 的住所 3,被作为产品出售。

参与者平台它是什么
Google Cloud · Gemini Enterprise Agent PlatformVertex AI 的演进构建、运行与治理 agent,并提供编排、运行时、记忆以及 Agent Identity、Agent Gateway 等治理原语。Google 现在把整个企业 agent 路线图归入这个品牌
Microsoft · Copilot / Agent 365横跨 Microsoft 365 的企业 agent 层同一种治理推进,与 Office、Teams、Windows 绑定
Alibaba Cloud · Wukong、Qwen CloudAI 原生企业平台使用多个 agent 自动化业务任务,并提供技能门户,把 60 多种云产品转成兼容 MCP 的技能

战线 2 的主线是治理,不是能力。这一层的难题不是制作能工作的 agent,而是制作企业可以信任的 agent:身份、政策与审计。一项调查发现,多数公司已经在生产环境运行 agent,却只有少数能真正治理。这道差距正是 Harness 工程与信任检查器所讲的内容,只是被打包成企业产品。

战线 3:开放引擎(构建自己的 harness)。 在租用消费级界面的最远端,是开放权重模型:完全没有界面,只有一个放进自己构建并运行的 harness 中的引擎。这是租用与构建界线的构建端。

参与者引擎为何与本课程有关
DeepSeek · V4开放权重、工具原生、兼容 Anthropic API预先调优,可直接放入 Claude Code、OpenCode 与其他编程 agent。采用情况真实:发布不到 1 个月,快速模型已经占 DeepSeek agent 流量的大多数;2026 年中,中国开放模型的整体 token 份额超过美国模型
Alibaba · Qwen 3.6 / 3.7开放权重系列(Apache 2.0),另有专有旗舰「Agent Frontier」原生支持 MCP,拥有 100 万 token 上下文,并展示 35 小时自主运行、调用工具超过 1000 次(该运行属于专有 Agent Frontier 旗舰,不是 Apache 许可的开放系列)。开放系列是自行托管的选择
Meta · Llama开放权重仍是最知名的开放系列,不过 Meta 自己的战略正在从纯模型发布转向购买并发布 agent(Manus)

战线 3 承载本书最深的承诺。只有开放权重引擎能让你拥有整个 harness:模型、运行时、sandbox 与数据。来源清楚说明原因,也再次回到概念 10:托管版 DeepSeek API 在中国运行,因此对受监管或敏感数据,自行托管开放权重是清晰路径。拥有引擎,也就拥有数据保管。这是本课程打开前门的房子中最远的墙。

诚实小结。 3 条战线,1 场战争。消费级界面上,5 家公司争相把最好的完成版 harness 租给你。托管运行时上,同一批巨头把 harness 租给企业,并围绕治理竞争。开放引擎上,开放权重实验室把零件交给你自行构建。模型不同、价格不同、分发不同,结构不变。3 条战线上的每种产品都由 heartbeat、connector、loop、spine、gate 与 body 构成。在本课程最平缓的界面上学一次结构,就能读懂任何年份、任何战线的整个行业。因此,本书讲结构,不讲工具。工具正在战争,结构是你带着穿行其中的和平条约。


来源与延伸阅读

本书内部

  • 技能与 Connector,本课程从浏览器运行的两项升级。Foundations 课程 5
  • Cowork 与 OpenWork,从桌面深化本课程的委派循环:文件夹、信任杠杆、自主阶梯、受监管工作负载
  • 循环工程,本课程作为阅读透镜的 6 个部分,在那里成为由你设计的事物;还会讲解会行动的计划如何安全实现
  • 离开笔记本电脑,这个界面背后的运行时决策。本课程是前门,那门课程是平面图

产品(实时页面,也是当前数字的唯一来源)

ChatGPT Work(OpenAI):

Cowork(Anthropic):

OpenWork(Cowork 的开源孪生工具):

  • OpenWork:由 OpenCode 驱动的开源 Cowork 替代方案及其文档

更广泛的行业(附录 G),主要来源与发布来源:

依赖任何数字前,请对照这些页面核验。这是本书中老化最快的一页:两种 Web 工作界面都在 2026 年 7 月发布或大幅扩展(Cowork 的 Web 与移动界面扩展了现有产品,ChatGPT Work 作为新模式发布);各套餐分阶段开放,配额按额度计量,名称也会改变。这里的一切都在 2026 年 7 月 21 日核验。易变事实(开放层级、配额、connector 操作与 Project 文件限制)也会在出现位置附上来源标记。


一句话小结

聊天框会等待,而且永远如此。改变的是旁边的界面:你离开后,工作仍在公司的服务器上运行;需要你时,问题会来到手机。

所有习惯集中在一处

完整交代任务。在计划阶段发现问题,不要等到完成后。把成品送到出口(第 3 层)。只安排负责报告的工作,而且必须先经历过离开测试。用 6 个部分阅读每款新产品。依赖这一切前,把运行时问题带到离开笔记本电脑课程。

闪卡学习辅助


测试你的理解

Checking access...