常见的使用说明大多在讲「有什么功能」。这份经验总结解决的是另一个问题:为什么我按直觉去用它,结果和预期不一样。
它的组织逻辑是「常见误解 → 实测真相」。每一节几乎都对应一次真实的误判——先说说大部分人(包括我)会怎么想,再给实测结果,最后给出判据。这样写的理由很简单:功能清单记不住也没关系,用的时候查得到;但判断错了,后面每一步都跟着错。
关于文中数字
文中所有「实测」「xx KB」「xx 个」这类数量,都来自某一台真实机器的快照。请把它们当作方法示范,不要当作通用阈值——你应当在自己的环境里用同样的方法测一遍。真正通用的是判据与因果关系,不是具体数值。
WorkBuddy 不是一个「聊天工具」。把它当成一个七层可编排系统来理解,很多困惑会立刻有解。
层 | 名称 | 解决什么问题 | 配置在哪 |
|---|---|---|---|
L0 | 身份与记忆 | 跨会话的「我是谁、你是谁、我们做过什么」 | 用户目录下的四件套 .md + 三层记忆 |
L1 | 技能 Skills | 把重复工作流固化成可复用能力 | ~/.workbuddy/skills/ |
L2 | 工具与执行 | 读写文件、跑命令、搜索、生成多模态 | 内置,无配置 |
L3 | 连接器 / MCP | 打通外部系统(邮箱、表格、数据库、知识库) | 连接器管理页 + mcp.json |
L4 | 资料库 | 在线文档、数据表、看板、网盘 | 云端空间 |
L5 | 自动化与编排 | 定时触发、多 Agent 分工 | automation + Agent / Team |
L6 | 专家 Experts | 领域角色与方法论封装 | 专家中心 / 专家包 |
L7 | 多设备同步 | 配置跨机器保持一致 | 自建版本库(git) |
最关键的一条认知
这七层不是并列的功能菜单,而是层层向上依赖的:L1 技能会调用 L2 工具和 L3 连接器;L5 自动化执行的是一段提示词,而这段提示词的质量取决于 L0 记忆和 L1 技能。
所以「用得零碎」的根因往往不在功能不熟,而在于这些层各自独立成长,从未被显式串起来。
多数使用者会停在 L1–L2:会用对话、会读写文件、偶尔会攒几个常用操作。真正决定效率差距的是三件事,而它们分别落在三层:
症状 | 本质 | 该在哪层解决 |
|---|---|---|
「每次都得重说一遍」 | 该下沉的信息留在了会话里 | L0 记忆 / L1 技能 |
「换台电脑就不一样了」 | 该同步的没进同步范围,或内容绑死了本机 | L7 同步 / L1 可移植性 |
「明明配好了却用不上」 | 配置存在 ≠ 已启用;两套配置只看了一套 | L3 连接器 / L5 自动化 |
「不知道什么该固化成流程」 | 缺信息放置的判据,固化等于固化错误 | L0 记忆的判定规则 |
误解
「先学会最强大的那个功能(通常是自动化),其他慢慢补。」
真相
学习顺序有硬约束:不知道该固化什么,自动化就是把错误的流程定时化。 实测中曾出现 15 个自建技能里 12 个写死了本机绝对路径——如果先把这些流程自动化,等于把 12 个定时炸弹设成定时运行。
正确顺序:先学会「放哪」→ 再学「让它自己跑」→ 最后清理「数据从哪来」。
定义
智能体 = 大模型 + 目标 + 工具 + 记忆 + 自主循环
五个要素缺一不可,但决定「是不是智能体」的是第五条:自主循环。
维度 | 普通聊天 | 智能体 |
|---|---|---|
输入 | 一个问题 | 一个目标 / 结果 |
能否动手 | 不能,只输出文字 | 能——读写文件、跑命令、调接口 |
有无状态 | 无(或仅会话内) | 有,跨轮次、跨会话 |
谁决定停止 | 模型吐完即停 | 它自己判断目标是否达成 |
产物 | 一段文字 | 文件、数据、系统状态变更 |
执行循环是这样的:
观察 → 思考 → 行动 → 观察 → …… → 达成 → 停止这个过程不是人一步步指挥的。判断一段交互是不是智能体,看三条:① 能自己决定下一步;② 能动手(调接口、读写文件、跑命令);③ 能连着干多步直到完成目标。 缺一条就不算。
误解
「我建了一个专门的工作空间,就等于养了一个专属智能体。」
实测的结果不支持这个推论。打开某个工作空间的目录,里面躺着的是一个个独立的会话文件——实测某个工作空间下有 22 个独立的 .jsonl 会话文件。
如果「一个工作空间 = 一个智能体」,那它应该是一个持续的个体。但事实是:每次开新对话,就产生一条新的会话记录。 工作空间目录下装的是会话,不是智能体。
概念 | 本质 | 类比 |
|---|---|---|
智能体 Agent | 干活的主体,有身份、记忆、工具、技能 | 一位工程师 |
工作空间 Workspace | 工作目录 + 项目级记忆 + 项目级技能 | 一间办公室 |
会话 Session | 一次对话线程,上下文的边界 | 一次具体谈话 |
一句话记住
换工作空间 = 工程师走进另一间办公室。 脚下的地(工作目录)变了,手边的档案(项目记忆)变了,但人没变——身份文件和用户级记忆跟着工程师走,不跟着房间走。
这是概念混乱的主要来源。同一个词在三个不同粒度上被使用,必须分清。
层级 | 是什么 | 关键性质 | 实测观察 |
|---|---|---|---|
主智能体 | 唯一、常驻,人格由身份文件定义 | 拥有全部工具与技能,你日常对话的对象 | 就是你现在面对的这一个 |
专家 Expert | 不是独立个体,是叠加在主智能体上的角色滤镜 | 换的是方法论、术语体系、关注点,不是换一个人 | 它与主智能体共享同一份记忆库(详见第 8 篇) |
子代理 Subagent | 主智能体临时派生的执行体 | 有独立上下文,干完就消失,结果回传主智能体,可并行 | 常用于复杂任务拆分 |
顺带记住一条:子代理与主智能体是同一套工具能力,区别只在上下文是否隔离。 这决定了它适合「并行侦察」而不是「换个人格」。
根因
因为会话就是上下文的边界。 开新会话 = 上下文清空,智能体对你的了解全部依赖记忆文件补位。
内容 | 何时生效 |
|---|---|
用户级记忆(身份四件套) | 一直生效——所以换任何会话它都知道你的基本背景 |
项目级记忆 MEMORY.md | 只在对应工作空间生效——换空间就「失忆」 |
会话内上下文 | 关掉就没了 |
这意味着:你反复交代的东西,应该下沉到记忆文件或技能里,而不是每次在对话里重说。这正是第 2 篇(记忆)和第 3 篇(技能)要解决的问题。
另一个推论:项目级记忆默认不在同步范围内(只有用户目录被同步),所以换设备时项目级记忆会丢失——这是第 8 篇(多设备同步)要处理的盲区。
本节可带走的判据
文中所有「实测」「xx KB」「xx 个」这类数量,均来自某一台真实机器的快照,请当作方法示范而非通用阈值;真正通用的是判据与因果关系。
原创声明
本文系「当月光落下」原创,首发于腾讯云开发者社区。内容来自作者在实际使用中的逐条实测整理, 所有结论均有本机实机验证或真实接口调用支撑;文中出现的数量均为特定环境下的实测快照, 仅作方法示范,不作为通用阈值。
如需转载,请注明作者「当月光落下」及首发出处,未经许可不得用于商业用途。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。