04 第一次工作区会话


文档摘要

04 第一次工作区会话 本节摘要:Agent 接进来了,本节发起第一次工作区会话,亲眼看看「多进程协作」是什么样。这一节既是第 1 章的收尾,也是第 2 章「三进程模型」的预告片——你会在一次会话里观察到:界面发起请求、服务端处理、引擎干活、结果返回的完整流程。读完本节,你不仅完成了「能用」这一关,还会带着一堆「为什么」进入第 2 章——而那些「为什么」,正是后续十二章要回答的。 一、准备工作:打开一个工作区 发起会话前,先确保你有一个打开的工作区。工作区是 OpenWork 的基本单元(一个项目目录)。如果你还没创建,现在创建一个——可以是你正在做的某个项目,也可以是一个临时目录。

04 第一次工作区会话

本节摘要:Agent 接进来了,本节发起第一次工作区会话,亲眼看看「多进程协作」是什么样。这一节既是第 1 章的收尾,也是第 2 章「三进程模型」的预告片——你会在一次会话里观察到:界面发起请求、服务端处理、引擎干活、结果返回的完整流程。读完本节,你不仅完成了「能用」这一关,还会带着一堆「为什么」进入第 2 章——而那些「为什么」,正是后续十二章要回答的。

一、准备工作:打开一个工作区

发起会话前,先确保你有一个打开的工作区。工作区是 OpenWork 的基本单元(一个项目目录)。如果你还没创建,现在创建一个——可以是你正在做的某个项目,也可以是一个临时目录。

💡 为什么强调工作区:OpenWork 的几乎所有操作都在工作区语境下——服务端按工作区路由、引擎按工作区托管、权限按工作区隔离(第 2、4、5 章)。没有一个打开的工作区,后面什么都做不了。

二、发起会话:在界面里发起

桌面形态下,在会话区发起一条消息。比如:

「看看这个项目的目录结构,告诉我它是做什么的」

这条消息会触发一次完整的「多进程协作」旅程。我们追踪它:

你在界面输入消息 │ ▼ 渲染进程(前端) │ ▼ IPC 桥接到主进程 │ ▼ 主进程调服务端 API │ ▼ 服务端代理到引擎(或执行能力) │ ▼ 引擎干活(读文件、调模型) │ ▼ 结果原路返回 │ ◄─ 你在界面看到结果

这就是第 2 章「三进程模型」要详讲的旅程。第一次,你只需要有个直观感受:你敲一条消息,背后有一串进程在协作

三、观察:Agent 调用 OpenWork 能力

更有意思的观察是看 Agent 如何调用 OpenWork 的能力。如果你接入了 OpenWork MCP,并且能力库里有一些能力(比如一个「读 PDF」的技能),你可以这样触发:

「用 OpenWork 的能力,帮我读一下这个 PDF」

这时你会观察到(如果 Agent 足够透明地展示它的动作):

Agent 思考:我需要读 PDF ──► OpenWork 有这能力吗? │ ▼ 调用「检索能力」工具 检索:「我要读 PDF」 ──► OpenWork 返回 [读PDF技能] │ ▼ 调用「执行能力」工具 执行:「执行读PDF技能」 ──► OpenWork 跑这个技能,返回 PDF 内容 │ ▼ Agent 拿到内容,组织回答

这就是第 7 章「meta-MCP 两工具脊柱」的实际运行——Agent 用两个工具(检索 + 执行),调用了你能力库里的任意能力。

⚠️ 第一次可能不完美:如果你能力库是空的,或 Agent 没有很好地展示它的动作,这次观察可能不明显。没关系——重点是理解「Agent 通过两个工具调用任意能力」这个机制,第 7 章会把它讲透。

四、观察:实时性——改了能力,Agent 立刻知道

OpenWork 还有一个值得观察的特性——实时性。如果你在会话进行中,去能力库加了一个新技能,然后回到会话再问,Agent 应该能发现这个新技能。

这背后是第 8 章「Reload 事件系统」:能力变更触发 Reload 事件,经 SSE 推送,驱动引擎重载,新能力立刻可用。第一次接触你不用深究原理,只要知道「改了能力,Agent 不用重启就能用上」——这是 OpenWork 实时协同的体现。

五、观察:权限——写操作会问

如果这次会话里 Agent 要执行写操作(改文件、跑命令),你会看到它停下来请求授权——这是第 4 章「权限三态」的「询问」态在起作用。

Agent:我想执行命令 `npm install` │ ▼ 权限求解:规则 = 询问 │ ▼ 暂停,问你:允许吗? ├─ 允许 ──► 执行 └─ 拒绝 ──► Agent 改用别的方法

这是设计如此,不是 bug。OpenWork 不让 Agent 擅自做危险操作,每次写都要你点头。理解这一点,你就能理解第 4 章为什么要有那么细致的权限模型。

六、第 1 章收尾:你现在站在哪

读完第 1 章,你应该处于这个状态:

  • ✅ 知道 OpenWork 的环境要求(多包仓库、pnpm、Bun+Node)
  • ✅ 装好了、桌面形态跑起来了
  • ✅ 把你的 Agent 通过 MCP 接进来了
  • ✅ 发起了第一次工作区会话,观察到多进程协作、能力调用、实时性、权限询问

换句话说,「能用」这一关你过了,而且你带着一堆直觉性的观察——「为什么有这么多进程?」「为什么只两个工具?」「为什么改了能力立刻生效?」「为什么写操作要问?」。

这些「为什么」,正是后续十二章要回答的。从第 2 章开始,我们退一步看整体架构——先回答最基础的:这套能跑的东西,内部到底有几个进程、它们怎么协作?

本节要点回顾

  1. 先打开工作区:OpenWork 的一切操作都在工作区语境下,没有工作区什么都做不了。
  2. 一次会话是多次程协作:界面→主进程→服务端→引擎→返回——这是第 2 章的预告片。
  3. Agent 用两个工具调能力:检索 + 执行,调用任意 OpenWork 能力(第 7 章详讲)。
  4. 实时性:改了能力不用重启,Agent 立刻知道(第 8 章 Reload 事件)。
  5. 权限询问:写操作会停下来问,这是设计不是 bug(第 4 章权限三态)。
  6. 第 1 章结束:你已「能用」,并带着一堆「为什么」——后续十二章就是回答这些为什么。

第 1 章结束。下一章退一步看全局——这套东西到底有几个进程,它们如何协作,贯穿其中的「服务端消费优先」是什么哲学。


发布者: 作者: 灏天文库 转发
评论区 (0)
U