四个层次
| 层 | 存放内容 | 何时被读取 |
|---|---|---|
| 对话记忆 | 这一段对话中说过的所有内容 | 那段对话的每一轮 |
| 长期记忆 | 关于你和工作的稳定事实与偏好 | 每一段对话的每一轮 |
| 知识库 | 你上传的文档和保存的网页 | 只有智能体搜索时才读取 |
| 技能 | 流程——如何完成一项重复性任务 | 当手头的任务与某项技能匹配时 |
前两层始终在起作用,所以每一轮都要花点开销;后两层是按需查找的,用到之前不花任何开销。这个差别正是为什么要认真考虑东西该放在哪一层。
对话记忆
每一段对话都是一条持久的线索。关掉浏览器,下周再回来,从 Chat 栏重新打开——智能体依然记得上下文。对话按最新的排在最前面列出,配有易读的标签、它们来自哪个渠道、消息数量,以及累计花费。
长对话不会垮掉:随着接近模型的上限,较早的轮次会被就地压缩,让这条线索继续走下去,而不是分叉出去。 上下文条 在聊天头部显示当前对话有多满,而 /context 命令会打开一张明细卡片——系统提示词、工具、记忆文件、技能和消息各自占用了多少空间,还剩多少空闲空间。
这里有两个重要的命令。 /new 会开启一段全新的对话,每次换话题时这么做都是对的——一条干净的线索比拖着一堆不相关历史的长线索更省成本、也更犀利。 /compact 会立刻请求压缩,而不是等到触及上限。
长期记忆
该 记忆 板块是直接查看智能体长期记忆文档的视图,这份文档每一轮都会被注入它的指令中。有三种阅读模式可选: 大纲 (分区和事实,可筛选、可折叠), 阅读 (渲染后的)以及 原始 (Markdown 源文件)。 复制 和 下载 顾名思义,做的就是字面上的事。
你可以用两种方式写入。快速添加表单会追加一条事实:选一个分区,它就落进长期记忆;把分区留空,它就转而进入今天的每日日志。 编辑 按钮会打开整份文档供编辑—— 保存 会用一次原子写入覆盖整个文件。
智能体自己也在维护这份记忆。一个后台循环会把最近的对话提炼成带日期的每日日志,并定期把这些日志里稳定的部分折叠进主记忆文档。这就是为什么记忆会自己长大,不需要任何人去手动输入。
整篇文档编辑器会整体替换文件。编辑期间实时更新会暂停;如果智能体在你不知情的时候改动了文件,就会弹出一条横幅提醒你,保存会覆盖更新的版本,并建议改为重新加载。保存前请先读一下那条横幅。
让长期记忆保持简短。它每一轮都会被读取,所以里面该放的是稳定不变的东西——客户是谁、公司的行文风格是什么、偏好哪家供应商——而不是上周二那次对话的记录。
你的知识库
该 知识 板块会用你提供的文档和网页建一个可搜索的集合。可以添加单个文件、添加网址、建立带名称的存储库让不同的资料各自分开、同步整个目录、查看已建立索引的内容列表,以及移除不再需要的来源。搜索会跨知识库、智能体的工作区、它的记忆,或者某个自定义存储库进行。
产品手册、价目表、政策、过往的提案和参考 PDF 都该放在这里。智能体不会把这些东西背在脑子里;它只在问题需要时才去搜索,并引用找到的内容。这让答案立足于你的资料,而不是模型的通用训练内容,也让保有一大批语料的成本在真正用到之前始终为零。
通过聊天输入框上传的文件会落进智能体的工作区,并且在 文件 板块下的 uploads/。智能体产出的任何东西——生成的图片、一份报告、一张截图——也都会落到那里,这让 Files 成了你想要那个成果本身、而不是关于它的对话时该去找的地方。
索引建立在后台进行,并且被刻意限速,好让它绝不拖慢正在进行的对话。一次大的上传会在完成后不久就能被搜到,但不是立刻。
笔记
该 笔记 板块是一个由智能体读写的、互相链接的 Markdown 维基。每篇笔记都有标题、标签、别名和来源,笔记之间彼此链接;阅读窗格会把这张链接图的两个方向都显示为 链接到 和 被引用于 标签,让你能在一个想法的周边走一走。搜索框会在整个集合里做关键词搜索。
有一个标记值得了解: auto-inject。被标记为 auto-inject 的笔记,其片段会像长期记忆一样,每一轮都被塞进智能体的上下文——这对值得单独成文的常驻指令很有用,而且限定在最近的五篇这类笔记以内,免得它悄悄膨胀。其余的都是按需查找。
技能
技能是一种教过的流程:一个文件夹,里面是写好的说明,还可以选配要运行的脚本。系统提示词说的是智能体是谁,而技能说的是某项具体工作该怎么做——步骤、格式、检查项。任务匹配时,智能体就会拿出对应的技能。你在每个智能体的详情页里通过 技能 标签页里打开或关闭它们。
技能来自三个地方:随平台一起打包的、为你的部署专门写的,以及智能体通过 Cortex 自学得来的(见 第 7 章)。输入 /skills 就能列出当前智能体实际拥有的技能,按类别分组。如果某个技能被安全审计拦下了,它也会连同原因一起列在那里,而不是悄无声息地消失。
有步骤的事情,技能就是它该待的地方。“把上周的任务抓出来,按客户分组,再套用这个模板,写成每周客户更新”,这就是一项技能;要是硬把它塞进系统提示词的一段话里,反而会把提示词在其他所有方面都变差。
这个该放进哪一层?
- 一个应该影响每一次回复的事实 ——我们的营业时间、CEO 的名字、我们说话的语气——放进长期记忆。
- 一份可能有人会问起的文档 ——那份 40 页的政策文件、产品目录、去年的报告——放进知识库。
- 一种可重复的方法 ——我们怎么筛选销售线索、怎么给摘要排版——放进一项技能。
- 只跟这段对话有关的事情 ——直接在对话里说出来就行。它会被记住,只要那段对话还在。
常见的错误是把文档一股脑倒进长期记忆。这样撑一周还行,之后每次回复都会变慢、变贵、变得更混乱,因为智能体在每一段对话里都得拖着一整个文件柜。让文档待在文档该待的地方。