首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >七层能力模型:把 AI 助手从「能用」拆到「会搭」

七层能力模型:把 AI 助手从「能用」拆到「会搭」

原创
作者头像
当月光落下
修改于 2026-09-28 13:22:51
修改于 2026-09-28 13:22:51
440
举报

《WorkBuddy 七层实操笔记》系列第 1 篇 · 作者:当月光落下 · 首发于腾讯云开发者社区。 全系列基于一台真实机器的逐条实测,记录哪些机制符合直觉、哪些相反,以及每条结论是在踩过什么坑之后才成立的。 系列目录:

  1. 七层能力模型:把 AI 助手从「能用」拆到「会搭」 ← 本篇
  2. 信息该放哪:七个存放位置与一条晋升阶梯
  3. 技能装了却不被调用:触发机制与四十条清单上限
  4. 让 AI 够得着外部数据:连接器、MCP 与一次自建实践
  5. 资料库不是网盘(上):七种节点、三层 block 与 database
  6. 资料库不是网盘(下):page 发布、检索与 doc 修订流
  7. 到点自己干活:自动化的三条执行链与五条军规
  8. 专家是角色滤镜,不是记忆分片:兼谈多设备同步的盲区
  9. 四十一条实测踩坑清单:每条都标了根因和正解
  10. 按收益排序的上手路径,与五份可直接复制的模板

导言:这份经验总结怎么用

常见的使用说明大多在讲「有什么功能」。这份经验总结解决的是另一个问题:为什么我按直觉去用它,结果和预期不一样。

它的组织逻辑是「常见误解 → 实测真相」。每一节几乎都对应一次真实的误判——先说说大部分人(包括我)会怎么想,再给实测结果,最后给出判据。这样写的理由很简单:功能清单记不住也没关系,用的时候查得到;但判断错了,后面每一步都跟着错。

三条阅读建议

  1. 第一次读,从本篇开始按顺序读。 这几节是后续内容的地基——不理解「信息该放哪」,后面学自动化只会把错误流程定时化。
  2. 遇到问题,直接跳到第 9 篇《四十一条实测踩坑清单:每条都标了根因和正解》。 那张表是全系列密度最高的部分,每条都注明了根因和正确做法。
  3. 准备动手时,看第 10 篇《按收益排序的上手路径,与五份可直接复制的模板》。 上手路径按收益排序,模板可直接复制。

关于文中数字

文中所有「实测」「xx KB」「xx 个」这类数量,都来自某一台真实机器的快照。请把它们当作方法示范,不要当作通用阈值——你应当在自​​己的环境里用同样的方法测一遍。真正通用的是判据与因果关系,不是具体数值。

一张地图:七层能力模型

WorkBuddy 不是一个「聊天工具」。把它当成一个七层可编排系统来理解,很多困惑会立刻有解。

层

名称

解决什么问题

配置在哪

L0

身份与记忆

跨会话的「我是谁、你是谁、我们做过什么」

用户目录下的四件套 .md + 三层记忆

L1

技能 Skills

把重复工作流固化成可复用能力

~/.workbuddy/skills/

L2

工具与执行

读写文件、跑命令、搜索、生成多模态

内置,无配置

L3

连接器 / MCP

打通外部系统(邮箱、表格、数据库、知识库)

连接器管理页 + mcp.json

L4

资料库

在线文档、数据表、看板、网盘

云端空间

L5

自动化与编排

定时触发、多 Agent 分工

automation + Agent / Team

L6

专家 Experts

领域角色与方法论封装

专家中心 / 专家包

L7

多设备同步

配置跨机器保持一致

自建版本库(git)

最关键的一条认知

这七层不是并列的功能菜单,而是层层向上依赖的:L1 技能会调用 L2 工具和 L3 连接器;L5 自动化执行的是一段提示词,而这段提示词的质量取决于 L0 记忆和 L1 技能。

所以「用得零碎」的根因往往不在功能不熟,而在于这些层各自独立成长,从未被显式串起来。

常见的成熟度分布

多数使用者会停在 L1–L2:会用对话、会读写文件、偶尔会攒几个常用操作。真正决定效率差距的是三件事,而它们分别落在三层:

症状

本质

该在哪层解决

「每次都得重说一遍」

该下沉的信息留在了会话里

L0 记忆 / L1 技能

「换台电脑就不一样了」

该同步的没进同步范围,或内容绑死了本机

L7 同步 / L1 可移植性

「明明配好了却用不上」

配置存在 ≠ 已启用;两套配置只看了一套

L3 连接器 / L5 自动化

「不知道什么该固化成流程」

缺信息放置的判据,固化等于固化错误

L0 记忆的判定规则

误解

「先学会最强大的那个功能(通常是自动化),其他慢慢补。」

真相

学习顺序有硬约束:不知道该固化什么,自动化就是把错误的流程定时化。 实测中曾出现 15 个自建技能里 12 个写死了本机绝对路径——如果先把这些流程自动化,等于把 12 个定时炸弹设成定时运行。

正确顺序:先学会「放哪」→ 再学「让它自己跑」→ 最后清理「数据从哪来」。

三个概念:智能体 / 工作空间 / 会话

智能体的工程定义

定义

智能体 = 大模型 + 目标 + 工具 + 记忆 + 自主循环

五个要素缺一不可,但决定「是不是智能体」的是第五条:自主循环。

维度

普通聊天

智能体

输入

一个问题

一个目标 / 结果

能否动手

不能,只输出文字

能——读写文件、跑命令、调接口

有无状态

无(或仅会话内)

有,跨轮次、跨会话

谁决定停止

模型吐完即停

它自己判断目标是否达成

产物

一段文字

文件、数据、系统状态变更

执行循环是这样的:

代码语言:txt
复制
观察 → 思考 → 行动 → 观察 → …… → 达成 → 停止

这个过程不是人一步步指挥的。判断一段交互是不是智能体,看三条:① 能自己决定下一步;② 能动手(调接口、读写文件、跑命令);③ 能连着干多步直到完成目标。 缺一条就不算。

工作空间 ≠ 智能体

误解

「我建了一个专门的工作空间,就等于养了一个专属智能体。」

实测的结果不支持这个推论。打开某个工作空间的目录,里面躺着的是一个个独立的会话文件——实测某个工作空间下有 22 个独立的 .jsonl 会话文件。

如果「一个工作空间 = 一个智能体」,那它应该是一个持续的个体。但事实是:每次开新对话,就产生一条新的会话记录。 工作空间目录下装的是会话,不是智能体。

三个概念的正确对应

概念

本质

类比

智能体 Agent

干活的主体,有身份、记忆、工具、技能

一位工程师

工作空间 Workspace

工作目录 + 项目级记忆 + 项目级技能

一间办公室

会话 Session

一次对话线程,上下文的边界

一次具体谈话

一句话记住

换工作空间 = 工程师走进另一间办公室。 脚下的地(工作目录)变了,手边的档案(项目记忆)变了,但人没变——身份文件和用户级记忆跟着工程师走,不跟着房间走。

「Agent」这个词的三层用法

这是概念混乱的主要来源。同一个词在三个不同粒度上被使用,必须分清。

层级

是什么

关键性质

实测观察

主智能体

唯一、常驻,人格由身份文件定义

拥有全部工具与技能,你日常对话的对象

就是你现在面对的这一个

专家 Expert

不是独立个体,是叠加在主智能体上的角色滤镜

换的是方法论、术语体系、关注点,不是换一个人

它与主智能体共享同一份记忆库(详见第 8 篇)

子代理 Subagent

主智能体临时派生的执行体

有独立上下文,干完就消失,结果回传主智能体,可并行

常用于复杂任务拆分

顺带记住一条:子代理与主智能体是同一套工具能力,区别只在上下文是否隔离。 这决定了它适合「并行侦察」而不是「换个人格」。

为什么总觉得「每次都得说一遍」

根因

因为会话就是上下文的边界。 开新会话 = 上下文清空,智能体对你的了解全部依赖记忆文件补位。

内容

何时生效

用户级记忆(身份四件套)

一直生效——所以换任何会话它都知道你的基本背景

项目级记忆 MEMORY.md

只在对应工作空间生效——换空间就「失忆」

会话内上下文

关掉就没了

这意味着:你反复交代的东西,应该下沉到记忆文件或技能里,而不是每次在对话里重说。这正是第 2 篇(记忆)和第 3 篇(技能)要解决的问题。

另一个推论:项目级记忆默认不在同步范围内(只有用户目录被同步),所以换设备时项目级记忆会丢失——这是第 8 篇(多设备同步)要处理的盲区。

本节可带走的判据

  1. 智能体是执行者,工作空间是场所,会话是上下文边界——三个不同维度,不能互相换算。
  2. 「每次都要重说」不是记性问题,是信息没有下沉。
  3. 判断交互是否为智能体,看三条:自主决策、能动手、能连续多步。

文中所有「实测」「xx KB」「xx 个」这类数量,均来自某一台真实机器的快照,请当作方法示范而非通用阈值;真正通用的是判据与因果关系。


原创声明

本文系「当月光落下」原创,首发于腾讯云开发者社区。内容来自作者在实际使用中的逐条实测整理, 所有结论均有本机实机验证或真实接口调用支撑;文中出现的数量均为特定环境下的实测快照, 仅作方法示范,不作为通用阈值。

如需转载,请注明作者「当月光落下」及首发出处,未经许可不得用于商业用途。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 《WorkBuddy 七层实操笔记》系列第 1 篇 · 作者:当月光落下 · 首发于腾讯云开发者社区。 全系列基于一台真实机器的逐条实测,记录哪些机制符合直觉、哪些相反,以及每条结论是在踩过什么坑之后才成立的。 系列目录:
    • 导言:这份经验总结怎么用
      • 三条阅读建议
    • 一张地图:七层能力模型
      • 常见的成熟度分布
    • 三个概念:智能体 / 工作空间 / 会话
      • 智能体的工程定义
      • 工作空间 ≠ 智能体
      • 三个概念的正确对应
      • 「Agent」这个词的三层用法
      • 为什么总觉得「每次都得说一遍」
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档