Web 上的通用 agent:速成课
12 个概念 · 你的第一个通用 agent,就在学习 Foundations 时使用的同一个浏览器标签页中

前 6 门课程里,你一直在聊天标签页中工作。你提问,它回答;你再问,它再答。每一轮都由你启动。这是很好的学习方式,但普通聊天有一个限制:你停止输入,对话也随之停止。
能自行持续工作的 agent 并非 Web 上的新事物。ChatGPT 从 2025 年初就能运行计划任务;你离开时,它也能独立完成深度研究;它还有配备自己计算机的 agent 模式。这些功能真实而强大,却散落在各处:一个任务藏在这里,一个研究工具放在那里,agent 模式又位于某个菜单中。日常工作没有一个清晰统一的入口,无法把文件、会话和服务汇入同一条工作流。
2026 年 7 月改变了这一点。两家大公司把这些部分汇集成一个清晰的工作界面,放在聊天框旁边,使用同一个网址。在 claude.ai,Claude Cowork 作为远程会话运行在 Anthropic 的服务器上。在 chatgpt.com,ChatGPT Work 是 ChatGPT 内的新模式,与熟悉的 Chat 模式并列,使用 OpenAI 的 GPT-5.6 模型。(ChatGPT 还有面向开发者的 Codex 模式,但在 Web 和手机上,你主要会看到 Chat 与 Work。)
因此,2026 年 7 月并没有发明浏览器 agent,而是让它们成为正式的工作场所。聊天框没有改变,仍然会等待你,以后也一样。改变的是旁边的界面。在那里启动会话后,任务会在公司的服务器上运行。你可以关闭标签页,也可以登上飞机,工作仍会继续。等它遇到只有你能做的选择时,问题会发送到你的手机。
本课程会带你参观这个界面,同时第一次讲解后续每门课程都需要的一项技能:指挥通用 agent。你将了解什么是远程会话、文件究竟去了哪里、审批如何到达手机,以及如何交接一项你不会全程观察的工作。你还会学会查看新的 agent 产品,并认出其中相同的组成部分。
两家公司几乎同时构建了这种产品,并得出了同一组组成部分。这有力证明了本书的核心观点:真正的技能是结构,而不是工具。
这里还有一个更大的故事,值得在入口处点明。两家公司不再只围绕模型竞争,也在争夺包裹模型的一切:计划、connector、记忆与关口。本书把这层外壳称为 harness,把这场竞争称为 harness 之战。过去,工程师在代码中进行这场竞争;如今它已经来到 Web。你在其中的位置很简单:这里不需要构建 harness,只需选择适合的一套并正确指挥。概念 3 会把两套 harness 并排展示给你。
你无需安装任何内容。Foundations 在浏览器标签页中运行,本课程也一样。
本课程适合谁。 适合任何学完 Foundations、希望无需安装任何内容便能指挥真实 agent 的读者。首先是知识工作者,也就是每天与文档、电子表格、邮件和聊天打交道的人:律师、会计师、营销人员、分析师、创业者和学生。也适合希望在进入终端前先走最平缓一步的工程师。会编程,从这里开始不会损失什么;不会编程,这里正适合你。因此,它是通用 agent 部分的第一门课程。每个人第一天都能在浏览器里学习。
请先完成 Foundations,尤其是 2026 年 AI 提示词工程 和 技能与 Connector。 本课程默认你已经具备 3 项基础:能向模型清楚交代任务;知道什么是上下文;知道技能和 connector 是什么。如果其中任何一项还很陌生,请先完成那两门课程,共约 2 小时。
所需时间。 核心路线(第 1–3 部分)约需阅读 90 分钟;加上第 4 部分和附录,整门课程接近 2 小时。项目还会增加动手时间,其中计划任务练习持续 1 周,而真正的学习会在这里留下来。后面有 7 个参考附录:前 6 个分别映射到一门后续课程(学到时再读),最后 1 个描绘整个行业。把它们当作参考,不要一次读完。
第一次来?用 2 分钟回顾应当已经掌握的内容
- 交代任务是完整描述一项工作:结果、限制、读者与原因。模糊的提示词只能得到模糊的结果。(Foundations 课程 2。)
- 上下文是模型在一轮中看到的一切。更多并不更好;有意识地选择正确上下文才更好。(Foundations 课程 2。)
- 技能是只教一次的任务,存放在
SKILL.md文件中。只有当你的请求匹配时,AI 才会加载它。(Foundations 课程 5。) - Connector 通过 MCP 标准,让 AI 以安全、受限的方式访问 Drive、Gmail 或 Slack 等真实服务。你授予权限,AI 在权限内工作。(Foundations 课程 5。)
- 聊天机器人与 agent。 聊天机器人负责回答;agent 会规划、使用工具并完成步骤。本课程会让你第一次真正指挥一个 agent。
如果其中任何一项还很陌生,请先阅读那两门 Foundations 课程。本课程会把它们全部用于真实工作。
📚 教学辅助材料
查看完整演示文稿 —— Web 上的通用 agent
供教师和自学者参考。 本课程讲解一个可迁移的核心观念:agent 产品由 6 个部分组成(heartbeat、connector、run-until-done loop、state spine、human gate、body)。一旦理解这些部分,任何新产品都只需短暂浏览,而不是一门新学科。可以分 3 遍教授。第一遍讲变化:聊天框会等待,旁边的 agent 界面不会(概念 1–3)。第二遍讲界面本身:文件存在哪里、connector 如何向外延伸、审批如何送达手机(概念 4–7)。第三遍讲无人观察时如何工作:委派循环与计划任务(概念 8–9),然后根据工作会触碰什么来选择界面(概念 10–12)。6 个项目就是评测。学生离开课程时最重要的一个习惯是:完成的工作必须离开平台。
通俗术语表
这些词会贯穿整门课程。现在先读一遍,遇到不清楚的术语时再回来查看。
| 术语 | 通俗含义 |
|---|---|
| 聊天框 | 每一轮都等待你的对话,无法自行启动任何事情 |
| Agent 界面 | 聊天框旁边的产品,能够规划、行动并运行多步骤工作 |
| 远程会话 | 在厂商服务器上运行的会话。你的标签页只是观察它的窗口,不是运行它的机器 |
| 本地会话 | 在你自己的机器上运行的会话。机器休眠时,它也会暂停。后续课程会讲解这类会话 |
| 任务文件系统 | 远程会话工作时使用的临时空间。只把它当作草稿区,绝不能视为永久存储;各厂商的保留与清理规则不同 |
| 平台存储 | 永久保存到厂商平台账户中的文件。任务和标签页结束后仍会保留 |
| 出口(第 3 层) | 把交付物从平台移到你控制的地方:通过 connector 保存、下载、写入本地或提交到仓库。文件进入你的记录系统 |
| 账户脊柱 | 保存的会话和文件,会在设备之间同步。你无需自行构建的记忆 |
| 人工关口 | 风险操作继续前必须由人批准的节点。在这个界面上,审批会到达你的手机 |
| 计划任务 | 按时钟在厂商服务器上启动的工作,无需你的任何设备在线 |
| 计量使用量 | 每个套餐包含的运行次数或小时预算。使用他人服务器执行无人值守工作,总会有这种预算 |
| 数据保管 | 谁持有你的数据:它存放在谁的机器上,以及谁能访问 |
它从何而来
日期在这里很重要。这个界面只有几周历史,但根源更早。
浏览器 agent 并非始于 2026 年。ChatGPT 在 2025 年 1 月推出计划任务;同年 2 月推出深度研究,可自行浏览数十分钟;2025 年年中又推出配备自己计算机的 agent 模式。因此,早在本课程之前,Web 就能独立运行工作。缺少的只是一个清晰统一的入口,各部分仍散落在菜单和工具中。
Claude 沿着自己的路径来到同一个地方。Anthropic 提供在其服务器上运行的云端编程会话,即使合上笔记本电脑也能继续工作。它很有用,但主要面向开发者。
随后在 2026 年 7 月,两家公司前后只差几天,就把这些部分汇入同一个入口。
Cowork 在 claude.ai 上推出 Web 版(测试阶段,先开放 Max 套餐,更多套餐随后跟进)。会话在 Anthropic 的服务器上运行,文件和会话保存到你的账户;即使没有设备在线,计划任务也会触发。
ChatGPT Work 于 2026 年 7 月 9 日推出。 它不是独立产品,而是 ChatGPT 内与 Chat 并列的新 agent 模式,运行在 GPT-5.6 上。它会制作完成的文件:电子表格、幻灯片、文档、仪表盘和小型 Web 应用。它通过改名后的 Plugin Directory 访问你的服务。Scheduled Tasks 可以运行一次、按计划运行、在事件发生时运行,或持续观察变化。它不是新的价格层级。在 Web 和移动端,它随符合条件的付费套餐提供,不包含 Free 或 Go,并消耗各套餐的 agent 配额。(在 ChatGPT 桌面应用中,Chat、Work 和 Codex 面向包括 Free 在内的所有套餐。Codex 是该桌面应用中的独立视图,无法在 Web 或移动端选择。)可用性一直在变化,请在实时产品页面确认自己的访问权限。
两家公司相隔几天,都把 agent 放在聊天框旁边。两种不同产品,同一种结构。本课程讲解的就是这种结构。
为什么会发生,以及它让你做到哪些过去做不到的事
学习界面之前,先理解它为何存在会更有帮助。这件事有两面:一面是它给你的能力,另一面是公司得到的回报。两面都要看。理解公司的目标后,你会睁着眼使用界面,而不是盲目信任。这也解释了本课程稍后会反复强调的一条规则。
它填补的空白。 2026 年 7 月之前,Web 已经能够自行运行工作,但各部分散乱且不均衡。计划任务在一个菜单里,研究工具在另一个菜单里,agent 模式又藏在下拉菜单中。单独看都很强大,组合起来却难以发现,更难使用。没有一个地方能让文件、会话、服务与无人值守运行相遇。因此,大多数人从未使用任何一项。这些发布把各部分集中到一个清晰界面,放在大家每天都会打开的网址。能力早已存在,改变的是它终于易于访问和组合。
2026 年 7 月把 4 项能力汇集到一个更清晰的工作界面中:
- 同一日常界面里的长时间工作。 远程会话在公司的服务器上运行,因此关闭标签页、合上笔记本电脑或登上飞机后,任务仍会继续。远程 agent 运行早已存在;变化在于 Work 和 Cowork 把它放到普通聊天旁边,形成一条通用工作流。(概念 2。)
- 内置于工作界面的计划功能。 计划任务按时钟或触发器启动,不需要你的设备在线。你坐下前,周一简报已经完成。计划任务也早已存在;如今它与项目、文件、connector 和 agent 运行并列,不再属于单独工具。(概念 9。)
- 围绕会话和项目组织工作。 会话与文件保存在账户中,并跟随你切换设备。新界面把相关文件、指令与持续工作汇集在一个可见位置,大幅减少重复粘贴上下文。(概念 4。)
- 跨越文件与已连接服务的多个步骤。 Agent 连接你的服务、制定计划、连续数小时完成多个步骤,最终交回成品文件,而不只是聊天回复。需要你选择的事项会发送到手机。新之处在于,这一切不再要求你穿梭于多个独立产品模式。(概念 5–8。)
现在看另一面,因为它会改变你使用这些能力的方式。 对外宣称的目标是增强你完成工作的能力,商业目标则是扩大覆盖并形成锁定。整个 2026 年,两家公司都在对抗一种说法:它们出售的是聊天产品,而市场想要 agent。最快的解决方案,是把 agent 放到数亿用户已经所在的地方。无需安装新应用,也无需学习终端。一步之内,聊天用户就变成 agent 用户。把会话、文件和 connector 保存进公司账户还会产生另一个结果:离开变得昂贵,这叫作切换成本。方便的账户记忆,也正是让你难以离开的东西。
这不是怀疑一切的理由,而是养成一个明确习惯的理由。最能帮助你的功能(免费且可用的记忆)和最能帮助公司的功能(工作不断堆积在其服务器上),其实是同一项功能。因此,概念 5 会要求你把成品移出平台,保存到自己的存储中。保留便利,拒绝锁定。看清公司的目标后,这个习惯显得理所当然,而不是多疑。
还有一个诚实的限制。 这些能力不会让工作本身变得更好或更安全。一条薄弱的指令现在会自行运行,中途没有人及时发现问题。把代码、浏览器和在线 connector 放进一个始终运行的界面,也会扩大错误运行的触达范围。ChatGPT Work 发布当周,安全审查人员就指出了这一点。新能力只是杠杆。它帮助还是伤害你,仍取决于任务说明、审查与判断。因此,本课程会为每项新能力配上一条纪律,而不是只推销能力。
Agent 能力早已存在于 Web,只是分散在不同工具和模式中。现在,它们集中在你已经使用的网址,形成一个面向日常工作的入口;你离开后仍会继续运行。这是它带来的好处。代价是工作不断堆积在公司的服务器上。它对你很方便,也让公司更容易留住你。因此,可以享受便利,但要把任何成品送到自己的存储中。还要记住:这个界面让工作无需你在场也能运行,却不会自动让工作变好。质量仍由你负责。
一张图看懂思维转变

事实核验日期:2026 年 7 月 21 日。Web 版 Cowork 和 ChatGPT Work 都只有几周历史。各套餐分阶段开放,使用量按额度计量,名称也会变化。这是本书中老化最快的一页。在依赖任何限制、套餐层级或功能前,请查看实时产品页面。
本课程涵盖什么
| 部分 | 主题 | 你将学到什么 |
|---|---|---|
| 1 | 转变 | 2026 年 7 月发生了什么、什么是远程会话,以及为何两家厂商得出同一种结构 |
| 2 | 界面 | 会话、账户脊柱、三层文件、没有文件夹的 connector,以及口袋里的关口 |
| 3 | 无人观察时工作 | 委派循环、如何交代一项你不会观察的工作,以及无需设备在线的计划任务 |
| 4 | 选择与开放路径 | 根据任务选择 Web 或桌面、没有厂商云的开源路径,以及本课程如何交接给后续课程 |
两种阅读方式。 第一次先读下面的 为什么会发生,再依次阅读第 1–3 部分,然后完成项目 1–3。约需阅读 90 分钟,无需安装任何内容就能成为 agent 用户。拥有 1 周真实会话经验后,再读第 4 部分、深入说明与项目 4–6。
哪些要记住,哪些要查询。 本课程贯穿两层内容,它们的老化速度完全不同。记住第一层,查询第二层。 持久层:聊天框会等待,而且永远如此;远程会话存在于账户中,不在标签页里;每份交付物都会落入 3 层之一,成品必须离开平台;人工关口必须到达你真正会查看的地方;任何厂商的 agent 产品,都只是同一种结构使用不同名称。机械层:下面所有套餐层级、运行限制、按钮标签与产品名称。它们只有几周历史,每月都会变化。把每一项视为实时文档的指针,而不是需要背诵的事实。
先说明一个边界。 本课程讲解界面与委派循环,不讲运行时决策:经过验证的无人值守工作长期应该住在哪里、迁移时什么会一起带走,以及如何重新赢得信任。这是本节末尾 离开笔记本电脑 的主题。本课程是前门。在依赖门后的任何东西前,请先阅读那门课程。
第 1 部分:转变
1. 同一个地址,两种不同事物
今天打开 claude.ai 或 chatgpt.com,会发现聊天框和 agent 位于同一个地址。在 ChatGPT 中,区别直接显示在屏幕上:Chat 模式与 Work 模式并排位于同一应用中。(桌面应用还为开发者提供独立的 Codex 视图;Web 和手机上主要显示 Chat 与 Work。)两者并不相同,学会区分是本课程的第一项技能。
聊天框就是你在 Foundations 中熟悉的对话。每一轮都等待你:你输入,它回答,然后再次等待。它无法按计划启动,无法对事件作出反应,也无法在关闭标签页后继续。这不是缺少功能,而是对话本来就如此。聊天框永远不会在你缺席时运行工作,也不必这样做。它是思考、起草与设计的地方。
Agent 界面位于旁边。你交给它的是一项任务,不是一条消息。它会制定计划、使用工具、完成多个步骤并产出交付物,只在某项决定需要你时暂停。即使你不再观察,它仍会继续工作。
这里有一项简单测试,值得在整个职业生涯中记住,因为每家公司都会在营销中模糊这条界线:
如果我停止输入,工作会停止吗?
聊天框:会。Agent 界面:不会。无论哪个网址、哪家公司、今年还是以后,这一个问题都能区分两者。
如果想理解得更深,可以这样看:普通聊天轮次是同步的。它在你等待时运行,然后停止并等待下一轮。Agent 运行则是委派的。启动之后,它会持续朝结果推进;可以稍后运行,也可以观察变化,不需要等你的下一轮才能继续。这才是真正的界线,并会在按钮和菜单变化后继续存在。「停止输入」测试只是日常感受它的方式。
还有一项提醒,避免这项测试误导你。你经常会用自然语言从聊天框启动委派运行,例如「每周一总结这些邮件」。文字进入聊天框,但你设置的是委派任务,不是普通回复。因此,应观察工作会做什么,而不只是文字输入了哪里。
2026 年 7 月还有一件事没有改变,而且很重要:聊天框仍保留原来的职责。设计任务、起草说明、手工测试想法都属于聊天工作,本课程中的每项任务也从这里开始。Agent 界面没有取代聊天框,只是搬到了隔壁。
一个窗口,两间房。第一间房里,你不说话就不会发生任何事;第二间房里,你离开后,工作人员仍会继续。本课程讲的是第二间房。你仍会用第一间房准备要交接的内容。
检查自己
一位同事说:「我每天都用 claude.ai,所以已经在使用 agent。」请用两句话纠正他。
查看答案
他使用的是聊天框:一停止输入,工作就停止,这意味着每一轮仍由他手工启动。Agent 界面是旁边的产品:把工作交给它,它会规划、行动,并在标签页关闭后继续。每天使用聊天确实是一项技能,却不等于使用 agent。
2. 远程会话:标签页是窗口,不是运行时
这是整门课程的核心架构概念,其他一切都源于这个事实。
Agent 可以住在两个地方。它可以住在你的机器上,也就是后面 3 门课程会讲到的桌面应用与终端。此时,应用就是运行时(实际执行工作的东西)。合上笔记本电脑,执行工作的机器进入休眠,任务便停在原处。它也可以住在厂商的服务器上,也就是本课程的情况。此时,浏览器标签页只是观察会话的窗口,不是运行它的机器。
后果很容易说明,而且每一项都会改变你的工作方式:
- 关闭标签页,工作继续。 会话从来不在标签页里,而在你的账户中,运行于不会随你休眠的基础设施上
- 从手机打开会话,看到的是同一个会话。 不是副本,也不是摘要,而是通过更小窗口查看同一项运行中的工作
- 上周关闭的标签页所创建的计划任务仍会触发。 计划也位于厂商服务器上,你的设备不在关键路径中
在 claude.ai 启动 Cowork 会话,就在用于聊天的同一个浏览器标签页中。它作为远程会话运行在 Anthropic 的服务器上。会话和文件保存到你的账户中,这种连续性无需自行设置。工作遇到只有你能作出的决定时,审批会发送到手机上的 Claude 应用。
编写本课程时,Web 版 Cowork 仍处于测试阶段:先开放 Max 套餐,更多套餐随后跟进,使用量按额度计量。这里的机械层变化很快。在依赖它之前,请到实时产品页面确认自己套餐的访问权限。
在 chatgpt.com 切换到 ChatGPT 的 Work 模式(2026 年 7 月 9 日发布,使用 GPT-5.6)。它不是独立应用,而是与 Chat 模式并列于同一界面,专为持续数小时的多步骤项目而构建:把目标拆成步骤,并自行完成其中一些部分。会话在 Web、桌面和移动端之间进行云同步:从笔记本电脑开始,在手机上查看,看到的仍是同一个会话。无论你的设备是否在线,Scheduled Tasks 都在云端运行。
访问权限按套餐分阶段开放。在 Web 和移动端,Work 面向符合条件的付费套餐推出,不包含 Free 或 Go。(ChatGPT 桌面应用中的 Chat、Work 和 Codex 面向包括 Free 在内的所有套餐。Codex 是桌面应用里的独立视图,无法在 Web 或移动端选择。)这些付费套餐无需额外标价便可使用,但会消耗各套餐的 agent 使用配额。因此,这里的「计量」指套餐内含的配额,不是单独账单。可用性持续变化,这些套餐细节也是本书中老化最快的说法。依赖之前,请在 OpenAI 的实时产品页面确认当前访问权限。

还要说明一个诚实的限制,避免夸大这个概念。远程会话运行在公司的机器上,只能访问这些机器能够访问的内容:你的 connector、它自己的任务文件系统,以及平台文件。它无法自行访问本地硬盘、桌面应用,也无法访问已登录银行账户的浏览器配置文件。需要这些内容的工作必须使用本地桥接或本地 agent,这正是后续课程所教的内容。(还有一项以后会用到的细节:桌面应用可以充当桥接。打开时,它能让远程会话有限访问本地文件或浏览器;关闭应用后,会话仍会继续,却失去本地访问能力。现在不必掌握,只需知道这道墙并非绝对。)第 4 部分会给出完整决策表。
桌面 agent 像在你家工作的员工:家里停电,员工也会停下。远程会话像在厂商办公室工作的员工:你家有没有电并不重要,笔记本电脑和手机只是用来查看其进度的窗口。
深入理解:后面还会两次遇到这个观念
检查自己
拉合尔的 Ayesha 在下午 5 点从 Web 会话启动客户报告。6 点停电,8 点她从手机打开会话。她会看到什么?为什么停电从来不是问题?
查看答案
她会看到已经完成的工作,或看到等待自己在手机上批准的事项。会话始终运行在厂商服务器上;笔记本电脑只是观察它的窗口,关上窗口不会停止另一侧的内容。她会在 Cowork 桌面课程中遇到的桌面 agent 则会在机器断电时立即暂停,因为机器本身就是运行时。
3. 两家厂商,同一种结构
现在进入本课程存在的核心原因。2026 年 7 月,Anthropic 与 OpenAI 前后只差几天,就把自己的 agent 界面带进浏览器。两种产品展示出一组明显相似的组成部分,并拥有同样的解剖结构。
本书把这套结构归纳为 6 个部分,后续课程会深入构建每一项。今天无需先学完那些课程,也能把它们当作阅读透镜。下面用一句话解释每个部分,以及它在 ChatGPT Work 中的位置。所有名称都来自 OpenAI 的 2026 年 7 月发布内容:

| ChatGPT Work 的名称 | 本书的名称 | 一句话含义 |
|---|---|---|
| Scheduled Tasks | Heartbeat | 在你缺席时启动工作的机制:运行一次、按计划、由事件触发或持续监控变化 |
| Plugin Directory(已连接应用) | Connector | 在权限范围内访问 Slack、Gmail、Drive 等真实服务,让 agent 能够行动,而不只给出建议 |
| 基于结果的任务执行 | Run-until-done loop | 给出一个结果,它会跨多个步骤朝结果推进:不是一次回答,而是一条终点线 |
| 云同步会话与 Projects | State spine | 跨设备、跨运行保留的记忆,让工作继续而不是重新开始 |
| 审批提示(移动端) | Human gate | 工作继续前,把高风险或依赖判断的决定交给人,并送达手机 |
| Work 的云端执行环境与成品工具 | Body | 一次运行实际执行工作的地方,会制作完成的文档、电子表格、幻灯片、仪表盘和小型 Web 应用 |
用同一套透镜查看 Web 版 Cowork,会得到一张使用 Anthropic 名称的相同表格:计划任务、connector、保存到账户的会话、手机审批。两家厂商,同一种结构。
为什么这对刚接触 agent 3 周的你很重要?因为产品会不断发布,名称也会不断变化,你不可能每次都从零学习。当彼此独立的构建者反复得出同样的组成部分时,组成部分就是纪律,产品只是包装。只需学习一次结构,此后每个新的 agent 产品都只需阅读半小时,而不是学习一个新领域。 这是本书的核心主张,2026 年 7 月则是迄今最有力的证据:技能在结构,不在工具。
有两点需要诚实说明,避免把透镜误当承诺。第一,相同结构不代表相同行为。两者的开放顺序、套餐层级、限制与细节各不相同,而且每周都在变化。映射只告诉你寻找什么,并不承诺配置完全相同。第二,这里只把 6 个部分作为词汇介绍。循环工程 会教你设计每一项;在学习之前,不应安排任何重要工作(概念 9 会进一步说明)。
再补充一点,也是在预告概念 6。ChatGPT Work 发布时,把代码执行、浏览器访问和企业 connector 放进一个始终运行的空间,因此一次错误运行能够触达更远,安全审查人员立即指出了这一点。这不是批评产品,而是这种结构的成本,每家厂商都要承担。也正因如此,connector 后面会单独占据一个概念,审批关口也不是可选项。
不同公司的汽车外观不同,但都有发动机、车轮、制动器和方向盘。了解组成部分后,短暂熟悉就能驾驶任何汽车。Agent 产品也一样。这张表就是零件清单。本书教你认识各部分,让任何厂商的包装都无法再次迷惑你。还要注意:两家公司正在围绕相似发动机,竞相制造更好的汽车,这就是「harness 之战」。在 Web 上,你是选择汽车的驾驶者,不是造车的工程师。两种工作都很重要,只是彼此不同。
结构相同,两者究竟在哪里不同? 6 个部分相同,包装并不相同。下面根据两家厂商各自的 2026 年 7 月发布内容进行诚实对比。每一行都只代表 2026 年 7 月中旬,请对照实时页面核验;这是本书中老化最快的表格。

| Web 版 Cowork(Anthropic) | ChatGPT Work(OpenAI) | |
|---|---|---|
| 它是什么 | 从 claude.ai 的 Cowork 界面进入的远程会话 | ChatGPT 内与 Chat 并列的一种模式,位于 chatgpt.com |
| 在哪里运行 | Anthropic 的服务器 | OpenAI 的服务器 |
| 模型 | Claude(每项任务可选 Opus/Sonnet 层级) | GPT-5.6 系列 |
| 销售方式 | Web 测试版,按套餐分阶段开放,按额度计量 | Web 与移动端随符合条件的付费套餐提供,新桌面应用面向所有套餐;消耗各套餐的 agent 配额 |
| Connector | Anthropic 基于 MCP 的 connector 目录 | Plugin Directory(发布时由 App Directory 更名),同样基于 MCP |
| Run-until-done | 在任务说明中写明停止条件 | 给出结果,它会跨多个步骤朝结果推进 |
| 持久工作区 | Projects + 保存的上下文文件(Anthropic 将其命名为 CLAUDE.md) | Projects + 可审阅、可纠正的记忆 |
| 完成的成品 | 文档、电子表格、幻灯片和文件 | 文档、电子表格、幻灯片、仪表盘,以及 Sites(可发布到 URL 的 Web 应用) |
| 配套编程工具 | Claude Code(独立界面) | Codex(作为一种模式合并进同一应用) |
| 移动关口 | Claude 应用中的审批 | ChatGPT 应用中的审批 |
带着各部分阅读这张表,会立即看到一种规律:几乎所有差异都位于包装栏,中央的组成部分是共享的。 模型不同,套餐规则不同,connector 列表使用不同名称,一方提供另一方没有的 URL 发布功能。有些差异比标签更深:任务如何访问本地文件、审批如何工作、编程 agent 是否位于同一应用。这些是真实差异,概念 10 会使用它们。但 heartbeat 仍是 heartbeat,gate 仍是 gate,两者的 spine 也仍是 spine。共享部分是持久层,其余则是本课程要求你查询而非记忆的机械层。这正是 6 部分透镜以展示而非宣称的方式证明自身价值。即使只学过其中一种产品,另一种也只需短暂熟悉,因为承载工作的部分正是二者共享的部分。
理解正在发生的事情。 请注意两种产品在何处竞争,而不只是模型。模型仍然重要,而且两者都很强;但产品还在竞争模型周围的一切:计划器、connector 层、会话脊柱、手机关口与文件出口。本书把这层包装称为 harness,Harness 工程 专门讲解它。过去两年里,harness 主要由工程师在代码和终端中手工构建。2026 年 7 月的发布说明,harness 已经作为成品来到 Web,两家公司开始竞争谁的 harness 更好。这样的竞争对你有利,也解释了界面为何进步得如此迅速。
但要清楚记住一条界线,才能正确理解:在 Web 上,公司参与 harness 之战,你不参与。 你不在这里构建 harness,而是在两个成品中选择。工程师连接循环、工具、上下文与检查的工作属于后面的 Harness 工程课程,它是真实而深入的工作。你在这个界面上的工作更小也不同:选择适合任务的预制 harness,再正确指挥它。知道这场竞争正在发生会帮助你选择,却不会让你变成 harness 工程师。那是另一门课程,也是一把不同的椅子。
每种产品分别面向谁? 组成部分相同,但厂商瞄准的人群既重叠又不同。理解目标有助于选择,分两层来看。
厂商瞄准的人群。两种产品面向同一个核心用户:知识工作者,也就是每天在文档、电子表格、邮件和聊天之间移动信息,却不编程的人。「制作完成的电子表格、幻灯片或报告」就是为他们写的。不过,用户周围的结构不同。ChatGPT Work 是同一个应用中的一种模式,而该应用还包含编程 agent Codex。因此,OpenAI 瞄准的是这样一种工作场所:同一个人或团队无需切换应用,就能同时处理知识工作与代码。它还随现有付费套餐提供,没有新的标价,因此覆盖面更广。Web 版 Cowork 先面向 Max 套餐,并按额度计量,对应更窄、意愿更强的早期群体。它的编程 agent Claude Code 仍是独立界面,让两类用户的界线更清晰。
应该选择哪一种?这是本书的建议,不是厂商的说法。对大多数文档与 connector 知识工作而言,两者都适合。真正的平局判断标准都很普通:更喜欢哪家公司的模型、现有 connector 已经连接在哪一边,以及正在支付哪个套餐。只有一种情况会让选择更明确。如果既做知识工作又编程,并希望放在同一屋檐下,ChatGPT 桌面应用把 Chat、Work 和 Codex 放在一起,设置更轻。如果希望工作 agent 与编程 agent 保持独立,并分别治理,那么 Cowork 与 Claude Code 的分离更合适。无论哪种,主要都是包装选择,不是能力选择,因此它只是结构的脚注,而不是标题。
本课程明确排除一种同时不适合二者的用户,而且这一点很重要:处理受监管数据的人。在合规团队书面批准之前,受保护健康信息(PHI)、享有特权的材料和受监管财务记录都不是任一 Web 界面的目标内容,因为工作文件与平台存储按定义处于厂商保管之下。概念 10 会完整讲解。这里先记住:「面向谁」存在一条任何厂商营销都不会替你画出的硬边界。
包装之外还有一个真实差异值得指出,因为它会改变你的选择。OpenAI 的编程 agent Codex 与 Work 位于同一个 ChatGPT 应用中,不过在桌面应用里是独立视图,Web 和手机上无法选择。Anthropic 则把编程 agent Claude Code 保持为完全独立的界面。 知识工作者不会感受到差别,但同时处理知识工作与代码的人会在意。桌面端 ChatGPT 把 Chat、Work 和 Codex 放在同一屋檐下;Claude 一侧则需要在 Cowork 与 Claude Code 之间切换。两者没有高下之分。这是真实的结构差异,会在概念 10 的「根据工作会触碰什么来选择」表格中发挥价值。
两种产品以同样方式构建,主要区别在标签、模型与各套餐的销售方式。一个真正的结构差异是:OpenAI 把编程工具与工作 agent 放在同一应用中,Anthropic 则将二者分开。只做文档工作时不会察觉;如果还编程,就值得了解。
检查自己
下个季度,第三家厂商发布一款名为「Flows」的 agent 产品。发布页列出触发器、集成、自动驾驶模式与工作区记忆。请在阅读其文档前,把 4 个名称映射到本书的组成部分。
查看答案
触发器对应 heartbeat;集成对应 connector;自动驾驶模式对应 run-until-done loop(阅读文档时的第一个问题是:停止条件是什么,由谁检查?);工作区记忆对应 state spine。不到 1 分钟,你就读懂了一款从未见过的产品,并带着正确问题开始。这项练习正是本概念讲解的技能。
第 2 部分:界面
转变已经理解,下面学习界面本身的工作部分:会话住在哪里、文件实际落在哪里、无人观察时 connector 会做什么,以及唯一需要你的决定如何找到你。共有 4 个概念,其中三层文件是整门课程最重要的一项纪律。读到那里时请放慢速度。
4. 账户脊柱:无需自行构建的会话与文件
在此前的 Foundations 工作流中,独立对话经常从零开始。你反复粘贴上下文、重新解释项目、再次上传文件。多数时候,连续性由你手工维持。
Agent 界面把连续性作为功能交给你。会话保存到账户中,会话生成的文件也保存到账户中。从任何设备打开,看到的都是同一项工作、同一个进度。本课程称其为账户脊柱(也就是概念 3 中 state spine 在这个界面上的版本):一种跨会话、跨设备保留的记忆,由厂商构建,不需要你雇人维护。
这是真正的好处,应当使用;但它也有代价,依赖它承载工作前必须了解。脊柱位于厂商保管之下,并采用厂商的格式。会话、文件和工作历史都存放在对方机器上,受其账户系统管理,并采用对方定义的形状。这并不邪恶,却处处构成依赖:依赖你支付的套餐、产品继续存在,以及厂商规则仍与你的要求兼容。概念 5 会提供让这种依赖保持安全的纪律。现在先同时记住两面:脊柱提供免费连续性,但住在别人的房子里。
每个 Cowork 会话都会保存到 claude.ai 账户,生成的文件也附在其中。明天从任何设备返回时,上下文、计划和文件仍在原处。实际上,会话列表就是你在这个界面上的工作日志。
ChatGPT Work 的会话会在 Web、桌面和移动端之间进行云同步:从笔记本电脑开始,再从手机重新打开,看到的是同一个会话、状态和文件。两项功能扩展了这条脊柱。Projects 把相关聊天、文件与指令汇入一个持久空间,在会话之间共享上下文,是重复性工作的自然归宿(内置了概念 6 的持久工作区观念)。启用记忆后,它可以携带过去聊天中的相关上下文,并提供可审阅的摘要和可检查、可纠正的来源。会话列表、Projects 与记忆共同构成脊柱,设备只是窗口。Cowork 标签页对数据保管的所有说明在这里同样成立:这条脊柱位于 OpenAI 的服务器上,采用 OpenAI 的格式。
3 个小习惯能让脊柱帮助你,而不是妨碍你。按工作成果为会话命名,不要按聊天命名。 「Acme 续约简报,5 月发票运行」在 3 个月后仍能被找到,「快速问题」永远不能。每个会话只放一条工作流。 把客户报告与假期计划混在同一会话,会让上下文相互渗透;你已经在 Foundations 中学过陈旧上下文如何损害质量。清理已失效内容。 长会话会在每一轮携带全部历史,而上下文在这个界面上的成本与聊天中完全一样。有意选择的少量上下文,胜过习惯性拖入的大量上下文。
在聊天标签页里,你每天晚上把文件带回家,第二天早上再带回来。Agent 界面则像一张带抽屉的办公桌:所有东西留在原处,随时都能从任何地方取用。这张桌子非常实用,但别忘了,它放在厂商的大楼里,不在你的楼里。
检查自己
请各用一句话说明账户脊柱带来的好处与代价。
查看答案
好处:无需自行构建的连续性,会话和文件在标签页关闭、一天结束和设备切换后仍会保留。代价:这种连续性位于厂商保管之下,采用厂商格式;任何只存在于那里的内容都依赖你的套餐、对方的产品与规则。下一个概念会把这项代价转化为工作纪律。
5. 三层文件:交付物究竟住在哪里?
这是本课程最具代表性的概念。把 agent 触碰的每个文件看作位于 3 层之一。它是模型,不是物理定律,但在实践中很可靠,能把模糊问题变成清晰问题。每制作一份交付物,都要决定它落在哪一层。
第 1 层:任务文件系统。 远程会话工作时,会使用厂商服务器上的临时空间,存放草稿、中间计算和未完成文件。工作结束后会清理,各厂商的具体保留规则不同,因此绝不能视为存储。第 1 层对自己的性质很诚实:任何明天还需要的内容都不应以它为家。
第 2 层:平台存储。 永久保存到厂商平台账户中的文件。任务、标签页与一周结束后仍会存在。这就是概念 4 的账户脊柱在文件上的应用,也是自然默认值:除非送往别处,工作会落在这里。第 2 层是安全的,但也处于厂商保管之下,采用厂商格式,并位于厂商登录之后。
第 3 层:出口。 文件离开平台,落入你控制的地方:通过 connector 保存到 Drive、发送邮件或 Slack 消息、直接下载到自己的机器、写入本地文件夹,或提交到仓库。出口有很多,具体哪扇门并不重要。关键是目的地:只有第 3 层会让交付物进入你的记录系统,也就是公司、客户或未来的自己真正会寻找它的地方。

整项纪律可以写成一行,也是这门课程最值得记住的一句话:
完成的工作离开平台,其他内容可以留下。
把各层当作风险阶梯,这句话就不言自明。只存在于第 1 层的交付物已经丢失:清理不是 bug,而是该层的定义。只存在于第 2 层的交付物今天安全,明天可能成为人质:它会保留,所以今天安全;却只在那里保留,处于他人保管之下,只能通过他人的登录访问,所以明天可能受制于人。第 3 层的交付物属于你:位于 Drive 版本历史、公司事项文件夹或仓库中,受你的保留规则治理,同事可以找到;即使下季度厂商产品改变形状,它仍然存在。
Cowork Web 会话在临时任务文件系统(第 1 层)中工作,把输出随会话保存到账户(第 2 层),也可以通过已连接服务保存或发送文件,例如 Drive、Gmail、Slack(第 3 层)。通往第 3 层的路径经过你授权的 connector,因此下一个概念会更严肃地对待 connector 范围。
这里同样有 3 层。第 1 层是 Work 任务运行时使用的隔离工作环境,包含只为该任务启动的独立文件系统。具体实现由 OpenAI 管理,不属于你控制的界面。第 2 层是任务生成的完成文件:文档、电子表格、幻灯片、仪表盘和 Sites,与云同步会话及 Projects 一同保留。第 3 层是出口:完成文件离开平台,进入你控制的地方。在这个浏览器界面上,主要自动出口是通过 Plugin Directory 的 connector 保存到 Drive、Gmail 或 Slack。下载是手工出口;连接桌面桥接后,还可以增加本地写入。这里有一项值得肯定 OpenAI 的功能:Sites 可以把完成的 Web 应用或仪表盘发布到可共享 URL,确实很实用。但要用概念 5 来理解。托管在平台上的 Site 仍然是带有公开入口的第 2 层,不是由你保管的第 3 层。具体保留与导出规则只有几周历史,请对照实时文档核验。底层的三层结构不会变化,这才是要学习的部分。
完整示例。 Ayesha 为一位客户进行月度开票。草稿数字位于第 1 层:agent 的临时计算与临时 CSV。它们在那里产生并消失,这是正确做法,因为没人审计草稿纸。发票模板下个月还会复用,所以保存到第 2 层的平台存储,并附在 30 天后会重新打开的会话上。完成的发票 PDF 会两次进入第 3 层:保存到公司的 Drive 文件夹,同时通过邮件 connector 发给客户。为什么要两次?为什么一定是第 3 层?因为有一天,审计师、合伙人或 11 月的 Ayesha 会问:「3 月发票在哪里?」答案必须是「公司的记录中」,不能是「在我 Cowork 账户的某个地方」。记录系统属于公司,只有第 3 层能进入那里。
每份会生成交付物的任务说明都应以一条指令结束,这样层级决定会自然完成:
End by listing every file you created and where each one landed:
temporary working space, platform storage, or a system I control (connector save, download, local write, or repo commit).
这一行会把看不见的默认值变成看得见的决定,项目 2 会让你在真实工作中实践。
一张纸可以放在 3 个地方。放在工作人员的草稿板上:当天结束就扔掉。放在工作人员自己的抽屉里:很安全,但在对方桌子里,不在你的桌子里。放在你的文件柜中:属于你,适用你的规则,你的人也能找到。规则很简单:所有成品都进入你的文件柜,草稿可以留在草稿板或抽屉中。
深入理解:这项纪律以后还会成长
检查自己
一位律师在 Web 会话中制作比较备忘录,并把平台链接分享给客户。如果就此停止,有哪两个问题?
查看答案
第一,数据保管:备忘录只存在于第 2 层的厂商平台,不在公司的事项文件夹与保留系统中,因此公司自身的委托记录出现缺口。第二,访问:链接的共享与权限机制属于平台,不属于公司;公司无法治理自己没有持有的内容。解决办法是进入第 3 层:把备忘录保存到文档管理系统,再按照公司的规则从那里分享。平台链接只是一扇窗口,客户拿到的是窗口,不是文件。
6. Web 上的 Connector:访问与出口合二为一
你已经在 Foundations 中见过 connector:在权限范围内访问真实服务,例如通过 MCP 标准访问 Drive、Gmail 与 Slack。你授予范围,AI 在其中工作。这个定义在这里没有变化。变化的是,当持有 connector 的是 agent 而不是聊天时,它承载的分量。
在这个界面上,信任控制归结为两根杠杆:connector 范围与审批。后面的 Cowork 桌面课程会介绍桌面 agent,它们增加第三根杠杆(agent 可以查看哪些本地文件夹),并围绕它建立完整纪律。仅浏览器会话没有自己的本地文件系统,因此不存在这根杠杆。它的职责由刚学过的层级决定与授予的 connector 范围共同承担。
这就引出了本概念要明确陈述的事实:在 Web 上,connector 承载双重分量。 Connector 一直是 agent 访问服务的方式;在仅浏览器会话中,它还是文件的主要自动出口。概念 5 通往第 3 层的路径大多经过已经授权的 connector。下载是手工出口,支持时桌面桥接还能增加本地写入,但无人值守工作主要依靠 connector 这扇门。连接服务时看到的同一个权限页面,如今既治理 agent 可以读取什么,也治理成品能够去哪里。因此,Foundations 中的习惯从良好实践升级为规则:点击连接前先阅读范围,并只授予完成工作所需的最小范围。
第一次执行真实任务前,有两项具体细节值得了解:
- 读取范围不等于发送范围。 授予邮件 connector 读取权限,可以让 agent 总结邮件串。写入或发送属于不同且更大的授权。从你的地址发出的消息无法收回,其他人会据此行动。不要假设存在安全默认值。Connector 差异很大:有些只能读取,有些只能创建草稿,有些则能真实写入或发送,具体取决于应用、套餐与工作区设置。因此,请检查所启用 connector 的实际操作和权限。对任何有后果的动作要求审批,并把任何能够发送的配置视为单独、更高信任级别的决定
- 不可信内容始终使用谨慎模式。 这是 Cowork 课程会完整讲解的一条规则的简版。别人写的文字可能携带隐藏指令,例如收到的邮件、厂商 PDF 或陌生网页。对你而言只是普通句子,对 agent 而言却可能像命令。这种手法称为提示词注入,是真实攻击,不是理论。现阶段的防御很简单:任务触碰并非由你编写的内容时,保持「行动前先询问」模式。在计划中寻找从未要求的步骤。如果计划提出未请求的 connector 操作,不要批准;应当重定向或重新开始
授权纪律与 Foundations 相同,但在风险升高的地方值得重复:特定工作流需要服务时再连接,不要提前猜测。每个 connector 都是访问能力,如今也是一扇门。
Connector 是交给工作人员的一把钥匙。在这个界面上,同一把钥匙打开两种东西:工作人员可以进入哪些房间取信息,以及成品通过哪个投递口离开大楼。钥匙打开的范围超过任务所需,不是便利,而是你选择的风险。交出前先读清每把钥匙能打开什么。
检查自己
在桌面环境中(下一门课程),信任杠杆是文件夹、connector 与审批。Web 上只有两项。第三项去了哪里?什么接管了它的职责?
查看答案
文件夹杠杆消失了,因为仅浏览器远程会话没有自己的本地文件系统可供限定。(桌面应用打开时,桌面桥接可以借出范围受限的本地访问,但这是桌面的杠杆,不是标签页的。)它的职责由两项内容接管:层级决定(概念 5)治理文件住在哪里,connector 范围治理 agent 可以访问什么,以及文件能从哪里退出。正是这种继承,让 connector 在这个界面上承载双重分量。
7. 口袋里的关口
本书中的每个 agent 产品都遵守一项承诺:真正需要人的决定会交给人。本书称之为人工关口。这个界面改变的不是关口,而是关口在哪里找到你。
使用桌面 agent 时,审批卡出现时你通常正坐在屏幕前;关口与视线偶然位于同一处。这个界面消除了这种偶然。工作会在你吃午饭、开会或睡觉时运行,这正是它的目的,因此审批不能停在标签页里等待,而要发送到手机:一条通知、一张审批卡、一项可在任何地方用 30 秒读完并处理的决定。
请准确理解手机的角色,因为两种错误都很常见。手机是关口,不是工作台。 你可以在手机上审阅计划、批准步骤、用一句话重定向或停止任务;不要在那里起草任务说明,也不要在那里审阅 40 页交付物。设计工作属于大屏幕。手机存在的目的,是避免会话为了 10 秒的决定停滞 6 小时。
现在进入本概念的核心提醒。它借自后面才会学习的课程,因为太重要,不能等待:关口没有移动,门铃必须移动。 在屏幕前工作时,升级事项自然落到眼前。如今工作在视线之外运行,审批可能无人看到。看不见的升级会延迟决定,有时等于默认作出决定。会话在一项你从未看到的审批上暂停 3 天,并没有大声失败,而是静默失败,情况更糟。
因此,在信任任何无人值守工作前,有一个不可协商的习惯:有意让关口响一次。 设计一项需要 1 次审批的小任务,例如要求把无害测试文件保存到已连接的测试文件夹,这类步骤会暂停等待确认。启动后离开计算机,确认通知确实到达手机:应用已安装、登录同一账户、通知已开启,并且没有被专注模式屏蔽。然后从手机批准。没有听过的警报只是传闻。项目 3 会带你完成这项测试。
Cowork 远程会话的审批会发送到 Claude 移动应用。执行第一项离开后继续的任务前,请确认应用已安装、登录同一账户并启用通知,然后把上面的有意审批测试从头到尾运行一次。
OpenAI 直接构建了移动关口。ChatGPT 移动应用让你与运行中的工作保持连接。离开办公桌时,仍可回答问题、审阅输出并批准重要操作。OpenAI 把 Work 描述为:在你跟随进度、回答问题、改变方向并批准重要操作的同时,将目标拆成多个步骤。因此,关口按设计就会到达手机。预检与 Cowork 相同:安装应用、登录同一账户并开启通知。信任任何无人观察的工作前,也要把有意审批测试从头到尾运行一次。(一些最详细的移动审批文档针对主机 Mac 上的 Codex 工作。请在实时页面确认 Work 模式的具体行为。不过,移动关口本身属于官方设计。)
你离开后,工作人员仍会继续,偶尔必须向你提问。在这个界面上,问题会发送到手机。两条规则:第一,在手机上回答问题,但真正的设计应在办公桌完成;第二,信任这种安排之前,有意让工作人员问一次,并确认问题真的到达。没听过响声的门铃可能已经坏了,而你毫不知情。
检查自己
计划在周一早晨生成的简报已经连续 2 周没有产出,你也从未收到错误。第一项和第二项检查分别是什么?
查看答案
第一,关口是否能到达你:是否有会话停在一项从未送达手机的审批上?关口静默未送达是本概念的失败模式,会产生完全相同的症状:没有输出,也没有错误。第二,任务是否实际运行:计量使用量与套餐限制(概念 9)可能在预算用尽时让计划任务暂停、无法运行或需要干预,而且不能依赖系统一定报错。请注意两项检查的共同点:在这个界面上,沉默本身含义不明,除非你让它具有明确含义。离开笔记本电脑 会用工程化方法再次讲解这个观念。
第 3 部分:无人观察时工作
你已经了解这个界面。现在学习让它发挥价值的技能:交接你不会全程观察的工作。本部分讲解委派循环,也就是本书后续每门课程默认你已经掌握的 4 个步骤。随后讲解这个界面专为其构建的能力:无需任何设备在线,工作按时钟自行启动。
8. 委派循环:交代、计划、批准、审阅
这是本书第一次讲解委派,也可能是你人生中第一次。Foundations 中的一切都是对话:你提问、阅读、再提问,没有任何事情在你看不到时发生。委派不同。你描述结果,agent 完成多步骤工作,你再查看成品。结果的质量几乎完全由 4 个时刻决定,其中只有 1 个是提示词。
第 1 步:交代任务。 像向一位聪明、积极,却不了解背景的新同事说明工作一样描述任务:结果、限制、受众与原因。这是 Foundations 课程 2 的任务说明纪律,但风险更高,因为模型不再只是针对说明中的空白回答,而会针对空白采取行动。
一组对比就能说明差别:
- 查询:「总结这份 PDF。」
- 任务:「阅读这 3 个文件,标出每个截止日期和所有未完成承诺。为经理制作一页简报:语气直接,截止日期优先,不写引言。」
查询在聊天中完全适用,任务则适合这个界面。请注意任务比查询多出的内容:要制作什么、依据什么、给谁阅读、采用什么形式、遵守哪些规则。否则,每一项都会变成 agent 在你看不到的任务中途替你默默作出的决定。
第 2 步:计划。 每份非简单任务说明都以一行结束:
Lay out your plan first, and pause for my approval before doing anything.
这句话在这个界面上比任何其他地方都重要。使用桌面 agent 时,你常会观察运行过程,并在某一步中途打断。这里的目的恰恰是让你离开。因此,计划通常是意图与成品之间唯一的拦截点。 跳过它,第一次发现错误时已经太迟:错误已经跑遍任务中的所有文件。
第 3 步:批准或重定向。 批准前先阅读计划。只需 2 分钟检查 4 件事:
- 范围:它是否只触碰你指定的内容,还是任务已经悄悄扩大?
- 顺序:是否有任何行动发生在验证之前?
- 触达:它是否提出使用未要求的 connector 或发送操作?(如果是,而且任务包含他人编写的内容,请停止并重读概念 6。)
- 假设:它对你从未说明的格式、受众或规则作了哪些假设?
发现问题时,不要从头开始。用一句话重定向:「在第 2 步中,使用现有模板的标题,不要自行发明。」Agent 会改写计划并再次询问。在计划阶段用一句话纠正几乎没有成本;错误运行被自信执行后再清理,会耗掉一个下午。
第 4 步:审阅。 交付物会在你身处别处时到达,因此要把审阅直接写进任务说明。每项会生成交付物的任务末尾,都加上这些内容:
Before you start: ask me 1–2 clarifying questions.
If any sources contradict each other on a material point, flag the
contradiction in the deliverable. Do not silently pick one.
When done: list every file you created and where each one landed —
temporary working space, platform storage, or a system I control (connector save, download, local write, or repo commit).
第一行会暴露原本可能变成缺陷的假设。第二行存在的原因是:模型训练会把它推向消除冲突并给出自信答案,但对律师或会计师而言,在两个矛盾来源中默默选择一个,才是最重要的失败。第三行自动执行概念 5 的层级纪律。阅读结果时,如果 90% 都正确,可以手工编辑最后一句;如果结构有问题,应告诉 agent 哪里不对并要求修订。与 agent 迭代会教会它你的偏好,自己重写则什么也教不会。

现在运行第一项任务(10 分钟,无需连接任何服务)。 取一份真实且杂乱的输入,例如会议记录、项目计划,或粘贴到文件中的 3 封相关邮件。打开 agent 界面,附加或粘贴这些内容,然后发送一项完整的 4 步任务:写明结果、限制与受众,加入先看计划的那一行,再加入 3 行审阅要求。阅读计划;有意重定向一件小事,亲自感受重定向如何运作;批准后离开,喝杯茶再回来;最后对照任务说明阅读交付物。这一次运行比本概念剩余文字教得更多,而且正是后续每门课程都会原样使用的循环。
明确指出反模式。 这个界面最常见的失败,是把它当成拥有超能力的聊天框:用一行提示词启动无人观察的多步骤工作。算式很无情:任务说明越模糊,agent 独自作出的决定越多;无人观察的运行越长,这些决定在你看见前叠加得越多。聊天中的模糊查询浪费一条回复;这个界面上的模糊任务会浪费你一整个下午去清理。
每次都用 4 个步骤。完整说明想要什么:结果、规则与读者。工作开始前要求先看计划。阅读计划,若有错误就用一句话纠正,再对照要求检查结果。计划是最重要的步骤。修正计划只需 1 分钟,修正已经完成的错误工作则需要一个下午。
深入理解:这个循环就是整节内容的缩影
检查自己
你交代了一项使用多个来源的任务,跳过「先展示计划」这一行,然后去开会。回来时,交付物已经完成,却建立在对某个来源的误读上。使用桌面 agent 时,也许能在运行途中发现。为什么这里从来没有这张安全网?哪一句话能替代它?
查看答案
安全网是你盯着屏幕的双眼,而这个界面的目的正是无人观察,所以双眼从一开始就不会在那里。你无法在运行途中拦截,唯一剩下的拦截点位于运行之前:「Lay out your plan first, and pause for my approval.」在这个界面上,这句话不只是良好实践,而是安全网。
9. 无需设备在线的计划任务
到目前为止,一切仍由你按下启动按钮。本概念连这一步也会移除,正是这项能力让 2026 年 7 月值得单独开一门课程。
计划任务是只需描述一次并设置频率的任务,之后会按照自己的时钟在厂商服务器上运行:笔记本电脑合上,手机放在口袋里,你的所有设备都可以离线。每周一 8 点,在你坐下前,本周简报已经等待阅读。这是真实承诺。本概念还会加入一套纪律,防止它悄悄变成混乱。
每项计划任务都由 4 个答案组成。 创建之前,按以下顺序写下来:
- 它应该做什么? 永久任务说明。包含概念 8 的全部要求,并增加一点:现场没有人澄清,因此说明必须在你缺席时仍能成立,包括空结果。「如果本周没有新项目,生成一行说明」能区分平静的一周与无法辨别的静默失败
- 它可以触碰什么? 按名称列出范围内的文件与平台存储。范围模糊的计划任务每周都会越扩越大,而且无人观察
- 它能触达什么? 列出 connector。Connector 是权限,不是建议:没有邮件 connector 的任务无论说明怎么写,都无法发送邮件,这是一项优点。完全按照概念 6,只授予工作所需的最小触达范围,不多给任何权限,因为它会在无人观察的情况下按计划无限期使用授权
- 何时启动? 频率。还要诚实承认所有计划器都存在的事实:「周一 8 点」意味着大约周一 8 点。计划器会错峰,有时也会延迟。如果输出有严格截止时间,计划本身并非保证,离开笔记本电脑 会妥善讲解这个主题

第一次设置计划前有 3 条规则,每一条都有人付出代价才学会:
- 永远不要计划一项你尚不敢离开它的工作。 计划是梯子的最后一级,不是第一级。先手工运行并观察至少几次,再无人观察地运行几次。只有经受住离开考验的任务,才配得到时钟。只运行过 1 次就设置计划,不是自动化,而是订阅了每周惊喜
- 把计量算式写下来。 在他人服务器上执行无人值守工作总有预算:每天的运行次数,或每个套餐的小时数;按层级分阶段开放,而且每家公司不同。在多个计划任务于同一周冲突前,先对照套餐限制计算。达到使用量或任务限制后,任务可能暂停、无法运行或需要干预。不要把没有错误消息当作依据,应查看 Scheduled 页面与通知。这正是概念 7 警告的失败:在你赋予沉默明确含义之前,它什么也不代表
- 运行完成不等于任务成功。 计划器的职责止于「已经运行」,工作是否正确不属于它的职责。因此,要把成功信号写进任务自身输出:任务说明以一行明确内容结束,例如处理项目数、生成文件及其层级,或显式的空结果说明;你要检查这一行。绿色只表示「运行过」,只有这一行表示「有效」
Cowork 的计划任务使用自然语言描述并设置频率,在 Web 上远程运行:无需你的任何设备在线就会触发,结果留在会话中等待你。访问与运行限制按套餐分阶段开放并计量,请根据套餐的实时限制计算,不要依赖这里印出的数字。有一项值得尽早知道的细节,它与限制恰恰相反:即使计算机休眠或桌面应用关闭,Cowork 计划任务仍会远程运行。它们可以使用 connector、插件和保存到 Claude 账户的文件,却无法绑定计算机上的文件夹。因此,如果重复工作流依赖本地文件或桌面应用,需要另一种依赖桌面的设置。让计划工作只使用 connector 与账户存储,承诺就能成立。
按照 OpenAI 的说法,ChatGPT Work 的 Scheduled Tasks 覆盖刚学过的全部 4 种 heartbeat:执行一次操作、按计划重复、在事件发生时重复,或长期监控变化。(在这个 Web 界面上,「出现新文件」等事件式触发通过定期监控处理,不是即时推送,因此这里可以把「触发」与「监控」视为同一家族。)发布示例同时包含两类。一些负责报告:每天早晨检查仪表盘,总结发生的变化;另一些负责行动:收到新反馈时更新演示文稿,或把重复出现的反馈主题转成按优先级排序的产品想法。因此,产品不只会报告。尽管如此,这门初学者课程仍有意停在报告这条线。会行动的计划具有更大的爆炸半径(更多事情可能出错,并触达更远),应当等你在后续课程学会检查器设计、状态、幂等性与恢复。那是本课程选择的规则,不是产品限制。4 个答案(做什么、触碰什么、触达什么、何时)与 3 条规则在这里原样适用。任务在云端针对你的账户运行,通过 Plugin Directory 授予触达权限。使用量会消耗套餐的 agent 配额,因此这里同样必须进行计量计算。请在实时页面确认当前配额。
还有一项明确限制:在包含上传文件的 Project 内创建 Scheduled Task 后,该任务无法访问这些 Project 文件。因此,请使用受支持的 connector 或任务能够访问的其他来源,不要围绕上传到 Project 的文件设计计划工作流。这就是概念 3 的实践:同一种 6 部分结构,另一家公司的按钮。
还要诚实说明边界。 只用本概念,你能构建的是报告型计划:读取来源、综合信息、制作简报并放入正确层级。这确实很有价值,许多人在这个界面的第 1 年价值正是如此,也是本课程有意设置的上限。你还不能安全构建会行动的计划,也就是按频率发送、归档、更新和决定。无人观察的行动需要尚未掌握的组成部分:为工作评分的检查器、机器可验证的停止条件,以及在多次运行之间记忆的状态文件。循环工程 会教你设计全部内容,离开笔记本电脑 则讲解经过验证的结果应该住在哪里。本概念打开了门,那些课程会穿门而过。
计划任务是一项永久指令:无需再次要求,工作人员每周一都会执行;即使笔记本电脑关闭也一样。写下 4 件事:工作、可以触碰什么、可以触达什么,以及何时运行。还有 3 条规则:只计划那些你离开时已经能做好的工作;触及限制前先计算套餐预算,并查看 Scheduled 页面,不要相信沉默;让工作报告自己的结果,因为「运行过」与「有效」是两个不同事实。
检查自己
Ayesha 想设置两项计划:周一早晨总结客户未付发票(从 Drive 读取,简报保存到账户),以及周五自动向每位逾期客户发送付款提醒。哪一项属于本课程,哪一项必须等待?二者的一词区别是什么?
查看答案
周一总结属于这里:它是报告型计划,读取、综合并放入一个层级;某周出错只需重写。周五提醒必须等待:任务会在无人观察时按计划对外部世界采取行动,一次错误运行就会给真实客户发送邮件,而本课程没有任何东西会在发送前检查。用一个词概括差别:行动(相对于报告)。报告型计划是本课程的上限。行动型计划需要循环工程讲解的检查器、停止条件与状态;即使如此,提醒邮件也正是人工关口存在的原因。
第 4 部分:选择与开放路径
现在,你已经能够在这个界面上指挥 agent,让文件落入正确层级,并按时钟安排报告任务。还剩 3 个诚实问题:什么时候这个界面是错误选择?完全没有厂商云的开源路径是什么样?无论产品多优秀,这个界面永远无法替你完成什么?本部分会回答全部 3 个问题,然后把你交给本节余下课程。
10. Web、桌面还是终端:根据工作会触碰什么来选择
刚学过的界面只是多个选项之一。成熟习惯是按任务选择,而不是宣誓只忠于一种。区分所有情况的规则很短:根据工作会触碰什么来选择。
| 工作需要…… | 界面 | 本书在哪里讲解 |
|---|---|---|
| Connector 与文档工作、跨设备连续性、无需安装 | Web | 本课程 |
| 机器关闭后仍必须继续的工作 | Web(仓库工作可使用云端 Routine,属于后续主题) | 本课程;循环工程 |
| 本地文件、桌面应用、已经登录账户的浏览器 | 桌面 | Cowork 与 OpenWork,知识工作者的下一门课程 |
| 代码、仓库、命令行 | 编程 agent | Agentic Coding,工程师的下一门课程 |
| 有保管要求的受监管数据(PHI、享有特权的材料、受监管财务数据) | 目前以上都不适用。 先取得合规团队的书面答复 | Cowork 课程包含完整的受监管工作负载指南 |

把表格读两遍,因为它承担两项工作。作为任务路由器,它回答今天的问题:这份报告应该使用哪个界面。作为课程路由器,它回答本节的问题:下一门同事型 agent 课程该选什么。每天都在处理文档与 connector 的知识工作者继续学习 Cowork 课程,它会增加 Web 无法访问的一切;工程师继续学习 Agentic Coding。没有人必须放弃这个界面,健康设置会长期按任务混用多种界面。
有一行风险最大,值得单独说明:受监管数据。 记住概念 5 的内容:第 1、2 层按定义处于厂商保管之下。远程会话的工作文件与平台存储位于厂商机器上,这正是界面能够工作的原因,也是合规制度关心的重点。因此,对 PHI、客户享有特权的材料或受监管财务数据,问题不是「这个界面是否谨慎」,而是「在这个套餐与这些文件条件下,是否允许数据处于这种保管状态」。只有合规团队能够书面回答。Cowork 课程会完整讲解。在取得书面答案前,受监管数据不能触碰这个界面。
还有一条熟悉的规则,可以避免多界面组合变成混乱:知道每份交付物落入了哪一层。 位于第 3 层的交付物,无论在 Drive、仓库还是公司记录中,都不在意由哪个界面生成。这正是第 3 层的全部意义。
不同工作需要不同场所。文档与已连接服务,或机器关闭时仍要运行的工作:用 Web。自己的文件与桌面程序:用下一门课程中的桌面应用。代码:用编程 agent。敏感受监管数据:停止,先取得合规团队的书面同意。可以同时使用多个场所,只需确保每份完成的文档最终进入自己的文件柜,无论由哪个场所制作。
检查自己
3 项任务来到桌面:(a)根据 Slack 与 Notion 制作每周总结,即使旅行也需要;(b)整理笔记本电脑某个文件夹中的 200 个文件;(c)综合客户享有特权的文档制作备忘录。请为每项任务选择界面,并指出决定性事实。
查看答案
(a)Web:只触碰 connector,而且机器关闭后仍要继续,两项事实指向同一个方向。(b)桌面:工作触碰本地文件系统,仅浏览器远程会话无法自行直接访问。这属于 Cowork 课程。(c)目前两者都不适用:享有特权的材料是数据保管问题,第 1、2 层按定义处于厂商保管之下。任何界面接触数据前,合规团队必须书面答复。3 项任务、3 个答案、1 条规则:工作会触碰什么,就决定使用什么。
11. 开放路径:没有厂商云
先承认本课程结构上的一件事,再说明它要求的坦诚。
本书每门同事型 agent 课程都把厂商工具与开源孪生工具配对:Claude Code 配 OpenCode,Cowork 配 OpenWork。本课程打破了这种模式,标签页中配对的是两个闭源产品:Web 版 Cowork 与 ChatGPT Work。这是有意的。两个竞争者相隔几天便发布了同一种结构:一个作为远程会话,另一个作为聊天应用中的模式。这正是本书论点的证据,因此你需要并排看到。但若默默打破模式,就会形成偏见。缺少的开源标签页本应回答这个问题:完全没有厂商云时,还能拥有这个界面吗?
可以,但需要自己动手。今天有两条开放路径。其中一些词(self-hosted、cron、GitHub Actions)属于工程师的词汇;现在不必掌握,只需知道路径存在。
OpenWork:远程与共享工作区。 OpenWork 是下一门课程会正式介绍的开源桌面同事型 agent。它可以连接到不在你笔记本电脑上运行的 worker,例如通过 URL 和访问令牌访问自己托管的 OpenWork worker,或一步连接组织的共享云 worker。这正是本课程的核心观念:执行工作的机器不是你正在看的机器。不过,这里的工作运行在你或组织控制的基础设施上。窗口属于你,大楼也属于你。
OpenCode:使用你自己的计划器。 对于连接仓库的工作,概念 9 的开放答案是由你自己的时钟触发编程 agent:在自己运行的机器上使用 cron,或使用计划执行的 GitHub Actions 作业。没有厂商云、套餐层级与分阶段开放。完整模式由 循环工程 讲解。今天只需知道它存在,而且并不罕见。
现在把交换条件清楚说一次。它也是本书每项开放与托管选择最终归结的交换。公司向你出售脊柱,开放路径要求你自己构建。 在厂商界面上,第一天就会得到可用的一切:会话、文件、同步、手机关口与计划器。但它们处于对方保管之下,采用对方格式,按对方价格,遵守对方规则。在开放路径上,每一项都要由你设置、运行与修复。作为交换,你得到厂商无法出售的两样东西。第一,数据保管:数据位于你控制的机器。第二,选择:决定哪个模型看到提示词,并能自由切换。没有哪一边天然高尚。概念 10 的受监管数据属于保管能力彻底胜出的情况;必须在周五交付简报的独立顾问,则属于现成脊柱彻底胜出的情况。大多数读者会同时保留两种答案,每项任务选择一种。现在应该已经很熟悉这种思路。
厂商界面像一间配好家具的办公室:桌子、抽屉、门铃第一天就能工作,但位于对方的大楼里。开放路径像一间需要自行布置的空房:工作更多,却属于你的大楼、规则和选择。两者没有简单的优劣。敏感工作往往需要自己的大楼,快速工作往往需要现成办公室。你可以同时租一间,也拥有一间。
检查自己
一家 NGO 请你设置每周捐赠者报告自动化。其数据政策禁止把捐赠者记录放在第三方消费平台,但团队没有工程师。政策迫使它选择哪条路径?团队失去什么?承诺前应坦诚说哪一句话?
查看答案
政策迫使它选择开放路径:捐赠者记录不能进入消费级厂商平台的第 1、2 层,而这两层正是厂商界面的基础。团队失去免费脊柱、同步、手机关口与托管计划器;现在必须有人构建并持续维护。坦诚的话是:「这条路径用运维人员替代订阅费。必须有人负责设置、更新,以及系统出故障的那个早晨。团队没有工程师,因此真正的决定是这项成本,而不是软件。」数据保管不是免费的,要用运维来支付。
12. 这个界面不能做什么,以及下一步去哪里
像本书每门课程一样,在诚实边界处结束。
界面不会改善工作。 远程会话只会让薄弱的任务说明变成无人观察的工作,不会让它变好。你见过的每根质量杠杆都位于屏幕这一侧:任务说明(概念 8)、计划审阅(唯一拦截点)、层级决定(概念 5)、有意进行的关口测试(概念 7),以及先离开测试再设置计划的规则(概念 9)。2026 年 7 月把 agent 搬进浏览器,却没有搬走你的任何责任。
这个界面只有几周历史,按额度计量、分阶段开放,并带有厂商形状。 本页每项机械事实,包括套餐层级、运行限制、按钮名称甚至产品名称,都是本书中老化最快的材料。离开时应带走持久层:停止输入测试、窗口而非运行时的架构、三层文件及其一行纪律、6 部分阅读透镜、4 步循环和计划任务的 4 个答案。它们能经受每次更名。还有一项纪律能同时保护你免受所有变化影响,请最后再听一次:重要内容绝不能只存在于平台。 任何不愿丢失的内容都要进入第 3 层。
这个界面是起点,不是终点。 你现在已经能够继续走完本节。下面是每门课程为刚学到的内容增加的部分:
- Cowork 与 OpenWork 是知识工作者的下一门课程,把委派循环扩展到真实文件和桌面,并加入 Web 不需要的完整信任模型:文件夹杠杆、自主阶梯与受监管工作负载纪律
- Agentic Coding 是工程师的下一门课程,在终端和代码上使用同一循环
- 规格驱动开发 会磨利第 1 步,直到任务说明成为足够精确、可以检查工作的规格,也能在这个界面上运行
- 循环工程 构建概念 9 暂时挡住的东西:会行动的计划,并加入让行动保持安全的检查器、停止条件与 state spine
- Harness 工程 与 信任检查器 先让循环安全,再让它可测量
- 离开笔记本电脑 以运行时决策结束本节,说明经过验证的工作应该住在哪里;刚学过的界面就是其中一些住所的前门
最后用 3 句话概括整门课程。聊天框用于设计,agent 界面用于运行。2026 年 7 月,两者搬到同一个地址,分工因此更清晰,而不是更模糊。学习结构,地址还会再次改变。
这个界面改变工作在哪里运行、何时运行,却不改变工作质量。质量仍来自任务说明、计划审阅与检查。本页产品会多次更名并改变限制,本页观念不会。把成品保存在自己的存储中,并把这些观念带入下一门课程。
检查自己
一位读者学完课程后说:「既然 agent 已经在 Web 上运行,桌面和终端课程都过时了。」请使用概念 10 的规则与本概念的边界,用两句话纠正。
查看答案
界面按工作会触碰什么划分,不按谁最后发布。仅浏览器远程会话无法自行直接访问本地文件、桌面应用与仓库,而这些都是真实工作,因此桌面和终端课程讲解的是这个界面没有覆盖的领域。无论新旧,没有任何界面会改善工作本身;技能在于任务说明、计划审阅与检查,本节余下内容会让这些技能更加深入。
本书在哪里使用这个界面(内部实践)
截至 2026 年 7 月中旬,诚实答案是:本书自己的无人值守循环不在这个界面上运行,原因正是概念 10 正确发挥作用。本书是一个仓库,循环与仓库连接,审阅关口在 CI 中位于合并关口旁边,完全如 离开笔记本电脑 的内部实践部分所述。工作触碰的是仓库,因此路由到另一个界面。
这个界面在本书生产中确实有两类价值。第一,每个循环之前的聊天侧设计工作:起草任务说明、测试审阅提示词、手工运行一个 heartbeat。第二,围绕本书的 connector 与文档任务。第二类就是概念 9 所说的报告工作,也是本课程上限。这种分工不是妥协,而是本课程讲解的劳动分配:在聊天框设计,在工作会触碰的界面运行。你现在读到的正是这种安排的产物。
🚀 项目
6 个项目,由易到难。使用真实但低风险的工作,例如笔记、计划和草稿;绝不要使用受监管数据(概念 10 的规则也适用于练习)。
📱 项目 1 · 15 分钟 · 合盖测试。 难度:简单 · 使用:概念 2。操作。 启动一个小型多步骤会话(把粘贴的 3 份文档总结成一份简报)。运行中途关闭标签页,再从手机重新打开。完成标准:你看到同一会话在第二台设备上继续,并能用一句话说明运行时究竟在哪里。
🗂️ 项目 2 · 30 分钟 · 三层审计。 难度:简单 · 使用:概念 5、8。操作。 运行一项会产出交付物的真实任务。使用概念 8 的完整任务说明,包括末尾列出每个文件及其层级的那一行。完成标准:能说出任务创建的每个文件属于哪一层,而且交付物本身存在于第 3 层,也就是你的 Drive、收件箱或记录中,而不只在平台上。
🔔 项目 3 · 20 分钟 · 有意让关口响起。 难度:简单至中等 · 使用:概念 7。操作。 设计一项需要 1 次审批的任务,然后完全离开计算机。审批行为因产品、connector 与工作区而异,因此使用安全、低风险的触发条件:要求 agent 把无害测试文件保存到已连接的测试文件夹,或准备一项需要确认的操作草稿。本练习不要使用发送、删除、购买或账户变更。如果没有触发审批,这本身也是发现:检查审批模式与 connector 设置,并记录如何才能让关口响起。完成标准:审批到达手机,你从手机处理,回来时成品正在等待。没听过的警报只是传闻,这个项目让你听一次。
⏰ 项目 4 · 30 分钟 + 1 周 · 第一项报告计划。 难度:中等 · 使用:概念 9。操作。 使用 1 个 connector 与 1 个文件来源创建周一早晨简报。先写 4 个答案(做什么、触碰什么、触达什么、何时),在任务说明中加入空结果行与成功信号,并写下套餐的计量算式。厂商注意事项:ChatGPT 中,在包含上传文件的 Project 内创建 Scheduled Task 后,该任务无法访问这些 Project 文件。请使用支持的 connector 或任务能够访问的其他来源,不要围绕上传到 Project 的文件构建计划工作流。完成标准:在你的所有设备都离线时触发 2 次,并且每次结果都包含成功信号,而不只是运行完成。
🔁 项目 5 · 45 分钟 · 一项任务,两家厂商。 难度:中等 · 可选,需要同时访问两种产品 · 使用:概念 3。操作。 在 Web 版 Cowork 与 ChatGPT Work 模式中运行同一项任务。两边都需要付费套餐,而且分阶段开放可能意味着暂时无法同时访问。如果如此,可以与拥有另一种产品的人合作比较结果,或只在现有产品上运行,并根据概念 3 的表格预测另一边。把对比表放在旁边实际测试:每行是否仍然成立?自 2026 年 7 月中旬以来,某次开放或更名是否改变了内容?完成标准:拥有一页保存在第 3 层的笔记,说明确认了哪些对比行、哪些已经漂移(机械层实时老化),以及双方是否都出现全部 6 个共享部分。最后一项发现才是重点,而不是差异。
🧳 项目 6 · 45 分钟 · 出口演练。 难度:综合项目 · 使用:概念 5、11。操作。 假设平台本季度消失。只使用第 3 层,也就是 Drive、邮件和记录,重建工作状态:模板、永久任务说明与交付物。完成标准:写下无法重建的内容列表。这份列表就是第 2 层暴露面,也是下周要执行的保存纪律。(学习 离开笔记本电脑 时,会再次遇到这项演练,但增加工程要求。)
附录:后续课程在 Web 上的对应关系
通用 agent 部分的其余课程使用 Claude Code 与 OpenCode 教授技能:这些本地工具从终端运行,并处理自己机器上的文件。本课程讲解 Web 界面:Web 版 Cowork 与 ChatGPT Work,二者都远程运行,都位于浏览器标签页中。
这些附录就是桥梁。它们会针对每门后续课程提出一个问题:无需安装任何内容时,能从 Web 界面完成多少?答案从来不是「全部」,也不是「完全不能」。有些观念可以换一个名称后完整迁移,有些以较弱形式迁移,还有一些完全无法跨越,因为需要 Web 界面不具备的本地机器或真实代码执行。最后一个附录会完全退后一步,描绘整个行业的 harness 之战。
最后一类不是 Web 界面的缺口,而是本节要求你离开浏览器的准确界线。因此,请用两种方式阅读这些附录:既把它们当作今天已经能做什么的地图,也当作下一批课程为何存在的预告。
有一条规则贯穿所有附录。在 Web 上,你租用完成的 harness;在后续课程中,你亲自构建。 当某个主题属于厂商 harness 已经替你完成的事情时,它可以「迁移」;当它需要你自行连接时,则「无法迁移」。把这条线保持在视野中,每个附录都会以同样方式呈现。

再补充一条框架说明,让下面的边界保持诚实。附录说 Web「无法访问本地文件」或「没有本地仓库」时,指的是仅浏览器会话:一个标签页,不安装任何东西。本课程讲的就是这种界面。它之外紧邻两样东西。桌面桥接(概念 2)可以在桌面应用打开时,借给远程会话有限的本地访问。本地 agent(桌面与编程课程)则从一开始就在你的机器上运行。因此,应把「无法迁移」各行理解为「仅浏览器」:它们标出标签页的终点,也正是下一批课程的起点。
附录 A · Web 上的 Agentic Coding
Agentic Coding 课程 通过 15 个概念讲解 Claude Code 与 OpenCode,也是本书的上下文工程课程。大多数观念都围绕管理模型看到什么,以及让工作可以检查。由于 6 个部分相同,其中相当多内容能迁移到 Web。无法迁移的,是所有假定存在终端、本地文件系统和自行运行代码的内容。
可以完整迁移:
| 那门课程讲解 | 在 Web 上对应 |
|---|---|
| 计划模式(先读,批准后再行动) | 概念 8 的委派循环。运行前先要求计划。同一种观念,无需快捷键 |
| 规则文件(CLAUDE.md / AGENTS.md),永久项目指令 | Project 保存的指令,加上概念 6 的持久工作区观念。Agent 每次会话都会读取的永久规则 |
| 上下文管理(保持窗口精简,重新开始还是继续) | 选择新会话或继续现有会话。概念 4 的 state spine 是同一套栈,只是由厂商管理 |
| 让模型与任务匹配 | Web 上较弱:得到界面指定的模型,不是菜单。习惯仍然存在,即「了解这个界面运行哪个模型」 |
| MCP:连接记录系统 | 正是 connector。概念 6。底层标准相同,两边目录不同 |
| 技能(打包且可复用的知识) | 在符合条件的套餐中,两个产品家族都允许从聊天创建技能、在编辑器中构建,或上传包含指令、资源与代码的包。格式可以迁移 |
| 验证循环(尝试、检查、修复、重复) | 检查条件并告诉你变化的计划报告,也是概念 9 的上限。你得到由平台替你执行的检查,但尚未得到自动修复 |
| 提示词注入:上下文就是门 | 概念 6 的不可信内容规则,逐字相同。任何界面上的风险与习惯都一样 |
以较弱形式迁移:
| 那门课程讲解 | Web 上的受限版本 |
|---|---|
| 斜杠命令与技能周围的运行时 | 技能本身可以迁移(见上文)。较弱的是编程 agent 设置的其余部分:自行编写的斜杠命令,以及对技能运行时的控制,包括生命周期 hook、模型路由、文件系统与强制执行层。你得到技能,得不到运行它的机器 |
| 子 agent(拥有独立上下文窗口的单独 worker) | Web 界面可以自行把大型任务展开成多个子步骤,但你不能自行创建使用指定模型与受限工具集的子 agent。你得到厂商的编排,不是自己的编排 |
| 恢复、撤销、回退 | 会话可以恢复,但没有 /rewind 回到先前步骤,也没有基于 Git 的 /undo 撤销 agent 编辑,因为工作不在你的仓库中发生。撤销方式是「把旧文件保存在第 3 层」 |
无法迁移,这正是重点:
| 那门课程讲解 | Web 无法做到的原因 |
|---|---|
| Hook 与插件(每次都由代码强制执行的规则) | Hook 是在你的机器上运行、用于阻止或检查操作的代码。Web 界面不运行你的代码,也不暴露这些生命周期事件。这是整门课程最清楚的「离开浏览器」界线。当需要模型无法靠说辞绕过的保证时,就需要自行构建的 harness,也就是 Harness 工程 |
| 处理本地仓库、运行终端命令 | 仅浏览器会话运行在公司的服务器上,不在你的磁盘上。它无法自行打开终端或编辑本地项目。桌面桥接可以借出有限的本地访问,但终端与仓库工作流属于本地工具。这是概念 2 的重述:运行时位于远程 |
| 通过模型路由控制成本(用前沿模型规划,用廉价模型执行) | 强模型规划、廉价模型执行的拆分需要你选择两个模型,并能在任务中途切换。Web 界面替你选择模型 |
诚实小结。 如果工作是文档、connector 与计划报告,Web 界面以不同名称覆盖了 Agentic Coding 课程的大部分价值。工作一旦触碰自己的代码、文件,或必须由代码强制执行的规则,就到达 Web 界面的边缘。这不是缺陷,而是下一批课程的入口;现在你已经知道它准确位于哪里。
附录 B · Web 上的 Cowork 与 OpenWork
这一项与其他附录不同。Cowork 与 OpenWork 课程 是本课程最近的亲属。它讲解同一种面向知识工作者的通用 agent 同事,建立在同一委派循环上,区别在运行时。那门课程在桌面上讲解两种产品:Claude Desktop 内的 Cowork,以及开源孪生工具 OpenWork。本课程则在 Web 上讲解 Cowork。同一家族,不同住所。因此,这里的地图不问「能迁移多少」,因为几乎全部可以迁移,而是问「桌面提供哪些 Web 没有的能力,以及为什么」。
可以完整迁移,因为属于同一产品家族:
| 那门课程讲解 | 在 Web 上对应 |
|---|---|
| 委派,不要查询(把工作交给同事) | 概念 1、8 的内容,逐字相同。这是最重要的单一习惯,在任何界面都一样 |
| 任务循环(交代、计划、批准、执行、审阅) | 概念 8 的委派循环。同样 6 个步骤,计划处同样是拦截点 |
| 计划就是杠杆 | 概念 8 的核心,也是委派循环图突出计划步骤的原因 |
| 把 Connector 作为信任杠杆(最小范围,读取不等于发送) | 正是概念 6。同样的 connector、范围纪律与「读取范围不等于发送范围」规则 |
| 审批模式(行动前询问、不询问直接行动) | 概念 7 的手机关口。Web 把同一项审批发送到手机,而不是显示内嵌卡片 |
| 技能(agent 按描述选择的已保存操作手册) | Web 版 Cowork 携带同一套技能系统:目录、/skill-creator 与 SKILL.md 格式属于产品,不属于桌面。这是 Web 界面比前面附录暗示得更强的一个地方 |
| 自主阶梯(每类任务只升一级) | 概念 8、9 的纪律:绝不要计划一项你不敢离开的工作。阶梯关乎信任,不关乎使用哪个界面 |
| 提示词注入与不可信内容 | 概念 6 的不可信内容规则。含隐藏指令的厂商 PDF 故事在 Web 上完全相同 |
| 计划任务(Cowork 内置频率) | 概念 9。Cowork 的 /schedule 与 Scheduled 视图在 Web 上使用方式相同 |
| 分层指令栈(全局、文件夹、会话) | 概念 4、6:全局设置、Project 指令与会话提示词。「文件夹」层变成 Project 层 |
可以迁移,但 Web 会改变形状:
| 那门课程讲解 | Web 上的区别 |
|---|---|
| 3 根信任杠杆:文件夹、connector、审批 | 其中 2 根相同,第 1 根改变。桌面上,你授予一个本地文件夹的访问权限;仅浏览器会话没有本地文件夹可授予。工作区是概念 5 的任务文件系统与平台存储。范围纪律仍然存在,但「在磁盘上建立专用工作文件夹」变成「把工作放进自己的 Project」。(桌面桥接可以访问本地文件夹,但那是桌面应用的工作,不是标签页的。) |
| 子 agent(批量任务中的并行 worker) | Web 版 Cowork 仍可自行把批次展开给并行 worker。失去的是桌面对每个 worker 更完整的可见性,以及任何依赖本地文件的控制。模式仍在,本地文件版本无法迁移 |
持久工作区(一个文件夹加 CLAUDE.md) | 变成概念 6 的 Project 加已保存指令。同一种观念,但磁盘上没有文件夹。上下文文件变成 Project 的指令字段 |
| 模型路由(强模型思考,廉价模型搬运) | 与附录 A 一样,Web 上更弱。每项任务得到界面的模型选择器,不是 OpenWork 的完整厂商选择 |
无法迁移,而这正是桌面存在的全部原因:
| 那门课程讲解 | Web 无法做到的原因 |
|---|---|
| 把本地文件作为执行界面 | 这是桌面课程的核心。Agent 在你机器上的文件夹中读写文件,例如事项文件夹、结账周期文件夹、营销活动文件夹。远程 Web 会话运行在公司服务器上,无法自行访问本地硬盘。这是概念 2,也是 Cowork 必须作为独立桌面课程存在的最大原因 |
| OpenWork 本身(开源、自带模型的孪生工具) | OpenWork 是要安装的桌面应用,连接你选择的模型厂商,文件保留在自己的机器上。这种交换没有 Web 版本。概念 11 已经点名开放路径,但它不是浏览器界面 |
| 「本地优先」隐私(文件永不离开机器) | 在 Web 上,agent 读取的文件内容按定义位于公司服务器。桌面最核心的隐私承诺「文件保留在本地」,无法存在于远程界面。对受监管数据而言,这是决定性区别,概念 10 已经画出界线 |
| 把 Cowork 插件作为角色包(Legal、Finance、Sales) | 桌面课程的插件会把技能、connector、斜杠命令与子 agent 打包成一个角色。完整插件系统是否能从 Web 使用,正是需要查看实时页面的几周历史细节;但它最初就是为桌面运行构建的 |
| 基于备份的恢复(Time Machine、Git、Drive 历史) | 桌面课程的恢复方式是「本地备份回滚文件」。Web 上没有本地文件可回滚,恢复依赖概念 5 的纪律:把先前版本保存在第 3 层 |
诚实小结。 Cowork 课程与本课程是通往同一房间的两扇门。如果工作是文档与 connector,并希望以最低摩擦开始,Web 界面已经提供那门课程的大部分能力,包括技能系统。工作一旦必须触碰自己机器上的文件、让数据离开厂商服务器,或使用 OpenWork 的自带模型路径,就需要桌面。这不是 Web 的缺陷,而是桌面课程成为下一门课程的原因:工作回到自己的机器时,就去那里。
附录 C · Web 上的循环工程
循环工程课程 教你构建一个替你向 agent 发提示词的系统:自行启动、完成工作、检查结果、记住做过什么,只在选择真正需要人时才呼叫你。课程使用 Claude Code 与 OpenCode,并采用本课程作为阅读透镜的同一套 6 部分结构:1 个 heartbeat、4 个工作部分和 1 条 spine。
诚实的分界如下。那门课程自己就画出了这条线,有一整节标题是「循环可以在哪里运行?」答案很直接:普通聊天框不能运行循环,Claude Code、OpenCode 和 Cowork 可以。因此,Web 界面位于中间:能触发简单 heartbeat,却无法完成让循环在真实运行时值得信任的工程工作。
可以用简单形式迁移:
| 那门课程讲解 | Web 上的简单版本 |
|---|---|
| 计划 heartbeat(每天早晨运行,笔记本电脑关闭) | 概念 9 的计划任务。这是 Web 擅长的一种 heartbeat。按时钟触发报告,正是 Cowork 的 /schedule 与 ChatGPT Work Scheduled Tasks 提供的能力 |
| 事件 heartbeat(有内容到达时作出反应) | 部分可以。ChatGPT Work Scheduled Tasks 能监控变化,属于轻量事件触发器;但无法得到课程中的 GitHub 事件与 API 触发机制 |
| Spine(多次运行之间的记忆,让今天承接昨天) | 较弱形式。账户会保留会话与 Projects,因此部分记忆能够延续;但没有课程中的真实 spine:仓库里的 progress.md 与规则文件,每次运行开始先读,结束再更新 |
| 技能(写一次,每次运行都读取的知识) | 如附录 A 所述,两种产品家族都在符合条件的套餐中提供打包技能。因此,「没有运行从零开始」在两边都能迁移到 Web |
| Heartbeat 菜单(任务会结束、重复,还是只发生一次?) | 概念 9 的自我检查。选择最轻量循环的纪律不依赖界面,是一种思维方式,不是一条命令 |
无法迁移,而这正是课程真正讲解的内容:
| 那门课程讲解 | Web 无法做到的原因 |
|---|---|
| 制造者与检查器分离(一个 agent 编写,由另一个独立 agent 评分) | 这是那门课程最重要的单一观念,Web 无法实现真实版本。Web 提供界面自己的 run-until-done,由厂商决定何为「完成」。你不能创建拥有独立模型与书面评分标准的检查 agent。附录 A 的验证循环在这里再次遇到同一堵墙 |
| Worktree(隔离,避免并行 agent 相互冲突) | Worktree 是机器上的独立 Git 检出。Web 没有本地仓库,因此没有可以隔离的东西。整个概念都假定存在 Web 不具备的本地文件系统 |
仓库中的 spine(循环读写的 progress.md 与规则文件) | 真实 spine 以文件形式存在于自己的仓库中,每个 heartbeat 开始时读取,结束时更新。Web 会话记忆属于厂商并采用厂商格式。「没有 spine 就没有循环」这条规则正说明严肃循环为何需要拥有仓库的工具 |
/goal、/loop、有上限的 shell 循环(由你控制的 run-until-done) | 这些是 Claude Code 命令与 OpenCode shell 模式。Web 界面给你厂商版 run-until-done,不是课程版本;后者由你设置停止条件、重试上限与无进展检查 |
| 动态工作流(把完整编排写成可重新运行的脚本) | 这是循环 body 的最深形式:多个子 agent 经过检查并受上限控制,再打包成一个脚本。即使在本地工具中,也只有 Claude Code 支持,远超任何 Web 界面 |
| Cloud Routines 与 GitHub Actions(无人值守运行时) | 课程中的真实无人值守 heartbeat 在 Anthropic Routines 或 GitHub runner 上针对仓库运行,并有分支规则与运行上限。Web 计划任务只是较轻的亲属:它负责报告,不会在 claude/ 分支上打开经过审阅的拉取请求 |
诚实小结。 Web 界面能够运行循环最简单 heartbeat 的形状:在你睡觉时触发的计划报告。这是真实能力,对许多人已经足够。但循环工程的重点不在 heartbeat,而在让无人值守循环保持安全的组成部分:独立检查器、隔离、属于你的 spine,以及由你控制的停止条件。每一项都需要拥有仓库并能运行代码的工具。因此,这个附录标出整节最清晰的晋级路线:当计划报告必须变成一个可以在你睡觉时放心改变事物的循环,你已经超出 Web 界面,循环工程会在那里接住你。
附录 D · Web 上的 Harness 工程
整门课程一直指向这个附录。概念 3 与 harness 之战说明已经讲清分工:在 Web 上租用完成的 harness,后续课程教你构建。Harness 工程课程 就是构建发生的地方。它讲解模型周围那层把原始智能变成可信 agent 的结构:决定 agent 可以做什么、知道什么、如何证明工作,以及出错后会发生什么的一切。
因此,这个附录的界线最清楚。几乎没有任何构建内容能迁移到 Web,但课程的思维方式,即 5 个动词,可以完整迁移。这是 Web 用户看清一件事的最佳透镜:租用的 harness 替你做了什么,又没有做什么。
把 5 个动词作为透镜(这种思维可以迁移):
课程用 5 个动词组织 harness 的全部工作。在 Web 上,你不会构建其中任何一项,但能够看到全部 5 项;理解它们,就知道自己信任厂商完成什么。
| 动词 | 含义 | 在 Web 上由谁完成 |
|---|---|---|
| 约束(限制 agent 可以做什么) | 权限规则、拒绝列表、sandbox | 厂商替你完成。你能控制的小部分是 connector 范围与审批模式(概念 6、7) |
| 告知(提供所需信息) | 规则文件、技能、工具设计 | 部分由你完成。Project 指令与打包技能(符合条件的 Cowork、ChatGPT 套餐均支持)是你的告知界面,其余属于厂商 |
| 验证(工作通过证明后才算数) | Hook、测试、类型化输出 | 厂商内置的 run-until-done。无法添加自己的 hook 或检查 |
| 纠正(恢复,然后修复系统) | 检查点、棘轮 | 由厂商完成。唯一「回去」的方式是概念 5 的第 3 层副本 |
| 升级(交给人处理) | 人工关口、醒目日志 | 双方共享。概念 7 的手机关口是你的升级界面,日志属于厂商 |
这张表就是诚实图景。在 Web 上,5 个动词中有 2 个真正留给你一部分:通过 Projects 与打包技能告知,通过手机坐在升级关口。另 3 个让无人值守 agent 保持安全的动词由厂商替你完成,方式不可见,也无法改变。
无法迁移,因为构建 harness 就是整门课程:
| 那门课程讲解 | Web 无法做到的原因 |
|---|---|
| 权限规则(按爆炸半径允许、询问、拒绝) | 拒绝规则是 settings.json 或 opencode.json 中由工具强制执行的一行。Web 提供审批模式,不提供规则语言。你无法在 Web 界面写下「拒绝读取 .env」 |
| 核心规则:护栏存在于 harness,绝不只写在提示词里 | 这是课程最重要的一句话,也恰好是 Web 上无法执行的内容。要把规则从提示词移入强制执行层,必须能够访问该层,Web 不会暴露。在 Web 上,所谓护栏是厂商的护栏,加上 Project 指令中能说的内容;课程会把后者称为请求,不是护栏 |
| Sandbox(文件系统、网络与分支围栏) | Sandbox 是操作系统层的墙,限制 agent 能触达什么。它假设存在你控制的机器与可以围住的运行时。Web 会话运行在厂商服务器和厂商 sandbox 中,条件无法由你设置 |
| Hook(操作前后自动运行的代码) | Hook 是你的代码,由 harness 在固定时刻运行,可以阻止或检查操作。Web 不运行你的代码。这是附录 A 的同一堵墙,从 harness 一侧观察:严肃控制需要本地工具的最清晰单一原因 |
| 类型化输出(由机器检查并由你验证的判定) | 你编写一个验证器,循环在信任结果前运行。它需要你控制的运行时。Web 给你厂商验证,不提供添加自己验证的位置 |
| 棘轮与 4 类失败(把每个错误变成永久修复) | 棘轮把每项教训写入你拥有的 harness 界面:规则、hook 或围栏。Web 没有这样的写入位置。你可以学习分类失败的习惯,却无法把修复安装到课程要求的位置 |
| 内外分离、可观测性、harness 耦合 | 这些是工程师长期构建与调优 harness 的纪律,假设你拥有 harness。Web 用户按设计不拥有它。这正是 harness 之战说明已经指出的交换:租用意味着无法调优 |
诚实小结。 Harness 工程是本节最明确要求「离开浏览器」的课程,也是本课程从概念 3 开始一直指向的课程。它的完整主题,就是你在 Web 上租用、在桌面上构建的那一层。今天可以带过界线的只有一件事:5 个动词,作为观察租用 harness 替你做什么的透镜;以及一条规则,真正的护栏是强制执行的,不是口头请求的。但一旦需要设置护栏、写拒绝规则、添加 hook、围住 sandbox 或把修复写入棘轮,就到达整门课程一直描绘的准确边缘。在 Web 上信任 harness,在那门课程中构建 harness。这就是租用盒子与设计盒子的区别。
附录 E · Web 上的信任检查器
信任检查器课程 会追问循环与 harness 课程一直推迟的问题:如何知道检查器够好? Agent 为自己的工作评分,或审阅 agent 返回 PASS 时,判定只是模型的意见。这门课程讲解评测:测试测试者的纪律,让「检查器说 PASS」变成一个可以辩护的数字。它建立一组黄金案例文件,以无头方式运行,对照你自己的评分校准裁判,并让每次变更都必须通过结果关口。
这是本节最需要「仓库与 shell」的课程。完整方法由文件夹、runner 脚本与 jq 构成,Web 上不存在这些机制。不过,课程还教一种看待测量的方式。它会改变你阅读任何 agent 输出的方式,包括 Web agent,而且可以完整迁移。
作为判断迁移(这是 Web 上的真正价值):
| 那门课程讲解 | 在 Web 上成为一种思维习惯 |
|---|---|
| Agent 是分布,不是函数(评价比率,不评价单次运行) | 最值得带走的观念。计划报告成功运行 1 次,只代表 1 次运行,不是证明。如果工作重要,应在多次运行中检查后再信任。无需工具,只需拒绝相信单个绿色结果的纪律 |
| 裁判也是模型(PASS 是需要校准的意见) | Web agent 说「完成」或「已经检查」时,要记住这是主张,不是证明。Web 提供厂商检查器,却无法由你校准。因此,你仍是人工校准:尤其在早期,要抽查判定 |
| 先看哪些失败,再看失败多少(比率会隐藏严重度) | 审阅一批 agent 工作时,错误的 3 项比高总分更重要。这种阅读习惯适用于任何界面的任何输出 |
| 门槛是决定,不是发现 | 作为指挥 agent 的人,由你决定多好才算足够,以及哪些任务适用。任何界面上,这项判断都在你手中;它是概念 8 的计划审阅纪律应用到结果上 |
| 演示是最弱的证据 | 「我试过,它有效」只是 1 次运行,任务往往因容易成功而被选择,观察者也希望它成功。当你决定是否把重要工作交给 Web agent 时,这种警惕会保护你 |
无法迁移,因为构建评测套件需要仓库与 shell:
| 那门课程讲解 | Web 无法做到的原因 |
|---|---|
| 黄金集(受版本控制的案例文件夹) | 案例是仓库中的 JSON 文件,像代码一样经过审阅并标注日期。Web 没有保存它们的仓库,也没有版本化位置 |
Runner(在 shell 循环中使用 claude -p / opencode run 与 jq) | 整个 runner 都是无头命令行执行与 shell 评分。Web 既不运行你的 shell,也不运行脚本。这与此前每个附录遇到的是同一堵墙 |
| 校准裁判(盲测 20 项协议、4 格表) | 可以手工完成其中的思考,但课程版本会测量一个可以检查和替换的模型裁判。Web 裁判属于厂商并被密封,无法对它执行协议 |
| 回归套件与 CI 关口(每次变更都重新运行,低于基线即失败) | 这是一项连接到 CI 的评测作业,具有分支保护与已提交基线。CI、分支、基线每一项都是 Web 不具备的仓库工具 |
| 按计划监控漂移(每晚运行,下降时告警) | 课程把完整套件作为计划循环针对基线运行。Web 可以计划一份报告,却无法针对已提交基线运行一套测试,因为没有套件与基线的存放位置 |
| 古德哈特定律防御(agent 永远看不到的密封保留集) | 保留案例放在 agent 无法访问的文件夹中。这假设存在你控制并能隔离的文件系统。Web 既没有文件夹,也没有围墙 |
诚实小结。 信任检查器是所有这些课程中最难从 Web 构建的一门,因为完整方法就是文件、shell 与仓库。Web 界面无法构建评测套件。但它可能最值得提前阅读,因为这种思维无需工具。每次依赖 Web agent,都是在信任一个从未测试过的检查器。那门课程教你感受其中分量:评价比率而非单次运行,先读严重度再读数量,并继续充当厂商检查器永远得不到的人工校准。到达仓库时,你会构建真实套件。此前先保持这种心态:只有经过诚实观察的历史记录才能赢得信任,而在 Web 上,保存记录的人就是你。
附录 F · Web 上的离开笔记本电脑
这是最后一个课程映射附录,用整门课程依赖的边界闭合循环。从一开始,本课程就称自己为前门,把 离开笔记本电脑 称为平面图。现在可以看出原因。那门课程回答本节最后一个问题:不是 agent 做什么,而是住在哪里,由谁维持运行。它把每种选择分入 4 个住所;本课程讲解的 Web 界面并不在地图之外,而是其中一个有具体限制的住所。
因此,这个附录与前 5 个不同。前面都问:那门课程的哪些内容可以在 Web 上完成?这里问:Web 界面位于那门课程地图的哪里?答案会澄清整门课程在本节的位置。
把 Web 界面放入 4 个住所:
离开笔记本电脑用一个问题划分运行时:谁操作循环,工作在哪里运行?Web 界面位于如下位置。
| 那门课程的住所 | Web 界面的位置 |
|---|---|
| 住所 1:你的会话(一切由你负责,合盖即停止) | 最接近由你手工驱动的普通 Web 会话。你启动、观察,完成后停止。Web 版本甚至移除了「合盖即停止」,因为会话运行在公司服务器上,不在笔记本电脑中 |
| 住所 2:云端计划(时钟移出,笔记本电脑可以关闭) | Web 界面在这里达到上限,而且表现很好。Cowork Scheduled Task 或 ChatGPT Work Scheduled Task 正是知识工作的这个住所。课程直接把 Cowork Scheduled Tasks 列为住所 2 示例。概念 9 的计划报告就是住所 2 循环 |
| 住所 3:托管运行时(你发送定义,由厂商运行循环) | 作为作者无法从 Web 触达。住所 3 意味着通过 API 向厂商交付 agent 定义,并围绕它运营业务。这是构建者使用 SDK 与平台文档完成的动作,不在浏览器聊天中完成 |
| 住所 4:你自己的进程(harness 作为服务器上的库) | 完全无法触达。这是模式 2,由你编写并运行运行时,是全书距离 Web 界面最远的事物 |
作为决定性判断迁移的内容:
课程真正的礼物不是机械步骤,而是选择住所的 4 个问题,全部依赖判断。它们适用于包括本界面在内的任何界面。
| 那门课程讲解 | 在 Web 上仍要提出的问题 |
|---|---|
| Q1:用户是谁?(只有你,还是其他人?) | 最重要的问题,完全由你提出。如果答案是只有你,Web 计划任务通常已经是完整答案;课程也明确指出,住所 2 是大多数人的上限。一旦其他人依赖输出,就会开始感受到 Web 的边缘 |
| Q4:一个糟糕夜晚会造成多少损失?(爆炸半径决定速度) | 这是概念 9 的报告与行动界线,也是 harness 课程的预算问题,只是针对运行时提出。它依赖判断,而判断在任何界面都属于你 |
| 无头执行是桥梁 | 无法从 Web 跨过这座桥,这正是识别信号。每次离开 Web 搬向更强住所,都要经过 Web 不提供的无头命令(claude -p、opencode run)。桥梁真实存在,起点就在浏览器终点 |
| 行李箱测试(纪律会迁移,机械部分需重建) | 永久任务说明、Project 指令、对「完成」的理解,这些属于纪律,换到更强工具时会一起迁移;Web 自己的按钮和设置不会。把工作知识保存在自己的笔记中并保持可移植,就是 Web 用户版本的「仓库保存真相」 |
无法迁移,因为离开笔记本电脑意味着离开浏览器:
| 那门课程讲解 | Web 无法做到的原因 |
|---|---|
无头调用(claude -p、opencode run) | 每次搬迁都会跨过的桥。Web 没有无头命令,正因如此无法到达住所 3、4,也只能部分到达住所 2 |
| 托管运行时(通过 API 使用 agent 定义、环境与会话) | 构建者使用代码与平台文档驱动的运行时,没有浏览器路径 |
| 最小无人值守套件(幂等性、漏跑检测、并发锁) | 围绕自己运行的循环连接的 6 项控制。在 Web 上由厂商运行循环,因此你不构建套件,只继承厂商提供的内容,也无法添加 |
| 到达协议与重新建立基线(用评测套件证明迁移) | 在新住所运行黄金集,需要附录 E 的套件,而套件需要仓库。没有套件,就没有到达协议 |
| 拥有运行时(住所 3、4) | 课程整个后半部分。拥有运行时的任何部分都意味着运营基础设施,恰好与租用 Web 界面相反 |
诚实小结,也是课程映射附录的结尾。 离开笔记本电脑告诉你:Web 界面有真实位置,也有上限。Web 是手工驱动工作的良好住所 1,也是按计划运行知识工作报告的真实住所 2。这覆盖大量真实工作,对许多人就是全部故事。但工作一旦需要跨过无头桥梁、针对仓库运行、拥有自己的 sandbox,或从受你控制的运行时服务其他人,就到达本课程从第一页开始描绘的边缘。这是本课程与离开笔记本电脑共同负责的边界:本课程是前门,后者是整栋房子的平面图。现在你知道哪些房间能从浏览器打开,哪些需要拿起钥匙并安装工具。这就是 Web 界面的诚实形状:真实的起点、清晰的终点,以及终点之后一切事物的地图。
附录 G · 整个行业的 Harness 之战
前 6 个附录逐一把本课程映射到后续课程,最后一个则向外看。概念 3 点出两家公司之间的 harness 之战。到 2026 年,参与者已不只两家,而是整个行业;几乎所有严肃实验室都接受同一种框架:竞争已经从原始模型转移到模型周围的 harness。
这是这里最值得看清的一件事。阅读新闻时,标题都在谈模型:这个得分更高,那个价格更低。但产品真正竞争的是外壳:计划、connector、记忆、关口与运行时。本附录是一份战场指南,说明谁在哪里竞争。目的不是背诵。正如课程反复强调,产品按周老化;重点在于学过的 6 部分结构能够读懂每一种产品。
行业快照——事实核验日期:2026 年 7 月 21 日。 本附录比课程其他部分老化更快,设计上就应单独更新。下面许多内容只宣布尚未发布,竞争格局每月变化。请把它当作带日期的快照,不是持久事实;依赖任何一行前,都要对照来源核验。
参与者分布在 3 条战线。前述附录的租用与构建界线贯穿整个行业。
战线 1:消费级工作界面(租用完成的 harness)。 本课程讲的就是这场竞争:聊天框旁边、面向日常知识工作的 agent 界面。
| 参与者 | 界面 | 当前状态 |
|---|---|---|
| OpenAI · ChatGPT Work | ChatGPT 内的一种模式 | 本课程主题,2026 年 7 月发布 |
| Anthropic · Claude Cowork | claude.ai 上的远程会话 | 本课程主题,2026 年 7 月扩展到 Web 与移动端 |
| Google · Gemini Spark | Gemini 应用中的 24/7 云端 agent | 在 I/O 2026 宣布:个人 agent 在 Google 云机器上运行,即使设备关闭也能跨 Gmail、Docs 与 Workspace 工作。与本课程讲解的结构相同,纪律也相同:主打护栏是在花钱或发邮件前询问。2026 年中仅在美国提供早期访问。通过 Search、Workspace 与 Chrome,它拥有最深资金与最广分发 |
| Microsoft · Copilot Tasks | Microsoft 365 中统一的任务界面 | Auto、Researcher、Analyst 模式,加上计划功能:组成部分相同,直接面向企业 Office 工作。Microsoft 的优势是分发。正如一位分析师所说,战斗不再是谁拥有最好的聊天机器人,而是谁拥有工作界面 |
| Meta · Meta AI | WhatsApp、Messenger、Instagram 内的 agent | 竞争重点是覆盖面,不是能力:harness 住在数十亿人已经聊天的地方,更新后的模型系列 Muse Spark 显示出一次严肃重建。据报道,Meta 曾试图以 20 亿美元收购 agent 初创公司 Manus,但中国监管机构在 2026 年要求撤销交易。这提醒我们,竞争还有地缘政治战线 |
请带着概念 3 的 6 个部分阅读这张表。每一种都有 heartbeat(计划)、connector、run-until-done loop、state spine、human gate 与 body。名称不同、所有者不同、结构相同。这就是本课程的完整论点,同时在 5 家公司展开。
战线 2:托管运行时(租用运行时,不租用界面)。 消费级界面下一层是企业平台:你向厂商交付 agent 定义,由厂商运行循环。这就是附录 F 的住所 3,被作为产品出售。
| 参与者 | 平台 | 它是什么 |
|---|---|---|
| Google Cloud · Gemini Enterprise Agent Platform | Vertex AI 的演进 | 构建、运行与治理 agent,并提供编排、运行时、记忆以及 Agent Identity、Agent Gateway 等治理原语。Google 现在把整个企业 agent 路线图归入这个品牌 |
| Microsoft · Copilot / Agent 365 | 横跨 Microsoft 365 的企业 agent 层 | 同一种治理推进,与 Office、Teams、Windows 绑定 |
| Alibaba Cloud · Wukong、Qwen Cloud | AI 原生企业平台 | 使用多个 agent 自动化业务任务,并提供技能门户,把 60 多种云产品转成兼容 MCP 的技能 |
战线 2 的主线是治理,不是能力。这一层的难题不是制作能工作的 agent,而是制作企业可以信任的 agent:身份、政策与审计。一项调查发现,多数公司已经在生产环境运行 agent,却只有少数能真正治理。这道差距正是 Harness 工程与信任检查器所讲的内容,只是被打包成企业产品。
战线 3:开放引擎(构建自己的 harness)。 在租用消费级界面的最远端,是开放权重模型:完全没有界面,只有一个放进自己构建并运行的 harness 中的引擎。这是租用与构建界线的构建端。
| 参与者 | 引擎 | 为何与本课程有关 |
|---|---|---|
| DeepSeek · V4 | 开放权重、工具原生、兼容 Anthropic API | 预先调优,可直接放入 Claude Code、OpenCode 与其他编程 agent。采用情况真实:发布不到 1 个月,快速模型已经占 DeepSeek agent 流量的大多数;2026 年中,中国开放模型的整体 token 份额超过美国模型 |
| Alibaba · Qwen 3.6 / 3.7 | 开放权重系列(Apache 2.0),另有专有旗舰「Agent Frontier」 | 原生支持 MCP,拥有 100 万 token 上下文,并展示 35 小时自主运行、调用工具超过 1000 次(该运行属于专有 Agent Frontier 旗舰,不是 Apache 许可的开放系列)。开放系列是自行托管的选择 |
| Meta · Llama | 开放权重 | 仍是最知名的开放系列,不过 Meta 自己的战略正在从纯模型发布转向购买并发布 agent(Manus) |
战线 3 承载本书最深的承诺。只有开放权重引擎能让你拥有整个 harness:模型、运行时、sandbox 与数据。来源清楚说明原因,也再次回到概念 10:托管版 DeepSeek API 在中国运行,因此对受监管或敏感数据,自行托管开放权重是清晰路径。拥有引擎,也就拥有数据保管。这是本课程打开前门的房子中最远的墙。
诚实小结。 3 条战线,1 场战争。消费级界面上,5 家公司争相把最好的完成版 harness 租给你。托管运行时上,同一批巨头把 harness 租给企业,并围绕治理竞争。开放引擎上,开放权重实验室把零件交给你自行构建。模型不同、价格不同、分发不同,结构不变。3 条战线上的每种产品都由 heartbeat、connector、loop、spine、gate 与 body 构成。在本课程最平缓的界面上学一次结构,就能读懂任何年份、任何战线的整个行业。因此,本书讲结构,不讲工具。工具正在战争,结构是你带着穿行其中的和平条约。
来源与延伸阅读
本书内部
- 技能与 Connector,本课程从浏览器运行的两项升级。Foundations 课程 5
- Cowork 与 OpenWork,从桌面深化本课程的委派循环:文件夹、信任杠杆、自主阶梯、受监管工作负载
- 循环工程,本课程作为阅读透镜的 6 个部分,在那里成为由你设计的事物;还会讲解会行动的计划如何安全实现
- 离开笔记本电脑,这个界面背后的运行时决策。本课程是前门,那门课程是平面图
产品(实时页面,也是当前数字的唯一来源)
ChatGPT Work(OpenAI):
- 发布公告、可用性与示例:ChatGPT 现在成为你最有雄心工作的伙伴(2026 年 7 月 9 日)
- ChatGPT Work 与 Codex:Work 与 Codex 的关系、使用结构,以及桌面与 Web/移动端的区别
- ChatGPT 中的 Scheduled Tasks:频率类型(一次、计划、事件、监控),以及 Project 文件限制
- ChatGPT 与 Codex 中的插件:本课程称为 connector 的连接层
- ChatGPT 中的技能:打包技能、创建方式与符合条件的套餐
Cowork(Anthropic):
- 在 Web、桌面和移动端使用 Claude Cowork:远程会话、各界面功能,以及本地文件的桌面桥接规则
- Claude Cowork 架构概览:远程与本地会话如何隔离,以及各自能访问什么
- 在 Claude Cowork 中安排重复任务:频率以及无需设备在线的远程执行
- 安全使用 Claude Cowork:概念 6、7 背后的信任模型
- Claude Code(独立编程界面)与连接仓库的云端运行:code.claude.com/docs
OpenWork(Cowork 的开源孪生工具):
- OpenWork:由 OpenCode 驱动的开源 Cowork 替代方案及其文档
更广泛的行业(附录 G),主要来源与发布来源:
- Google:Gemini Enterprise Agent Platform(Google Cloud,I/O 2026);I/O 2026 发布的消费级 agent 是 Gemini Spark,一款 24/7 云端 agent(截至 2026 年中,仅在美国提供早期访问)
- Microsoft:带有 Auto、Researcher 与 Analyst 模式的 Copilot Tasks(Microsoft 365 Copilot);Researcher agent 采用「只能看到你能看到的内容」权限模型
- Meta:Manus 收购案 被中国监管机构要求撤销,Meta 在 2026 年开始逆转交易;任何基于 Manus 的战略说法都应视为未定
- DeepSeek:V4 agent 采用情况(OpenRouter)与 V4 编程 agent 集成指南
- Alibaba:Qwen3.7,Agent Frontier 与 Qwen-Agent 框架(开放、MCP 原生)
依赖任何数字前,请对照这些页面核验。这是本书中老化最快的一页:两种 Web 工作界面都在 2026 年 7 月发布或大幅扩展(Cowork 的 Web 与移动界面扩展了现有产品,ChatGPT Work 作为新模式发布);各套餐分阶段开放,配额按额度计量,名称也会改变。这里的一切都在 2026 年 7 月 21 日核验。易变事实(开放层级、配额、connector 操作与 Project 文件限制)也会在出现位置附上来源标记。
一句话小结
聊天框会等待,而且永远如此。改变的是旁边的界面:你离开后,工作仍在公司的服务器上运行;需要你时,问题会来到手机。
所有习惯集中在一处
完整交代任务。在计划阶段发现问题,不要等到完成后。把成品送到出口(第 3 层)。只安排负责报告的工作,而且必须先经历过离开测试。用 6 个部分阅读每款新产品。依赖这一切前,把运行时问题带到离开笔记本电脑课程。