章节摘要:常驻层定型之后(第 3 章),进入动态层的第一站。记忆是四成分中唯一"系统在运行中自己长出来"的成分——开发者不写它,应用在每一轮对话里生产它;也因此它是唯一不能靠人裁剪、只能靠运行时策略管住的成分(1.2 节)。本章把记忆拆成三层:会话内记忆(当前对话的历史,记忆的最小形态,驱逐与压缩的主战场)、跨会话记忆(用户偏好、事实与约定,让下一次会话"认得出人")、知识库(组织级长期知识,量大到只能按需检索供给)。4.1 给出三层对照表与各自的供给时机,并澄清一个高频混淆:知识库检索结果进入窗口的那一刻,身份是素材而非记忆。4.2 讲跨会话记忆两端的手艺——写入门槛三问、三种写入时机、召回的量与位置——恰好对应 LangChain 四操作中 write 与 select 在记忆成分上的落地,并附
ce_memory.py最小分层记忆示意。记忆机制的实现纵深(存储引擎、遗忘策略、产品级实现)由 同站教程库记忆系教程承担,本章只管决策层。
阅读完本章,你应当能够:
ce_memory.py,把分层记忆接到自己的应用上。(文字流程图) M ──▶ "跨会话记忆(4.1 / 4.2)·偏好 / 事实 / 约定:·会话开始召回,预算小而值钱" M ──▶ "知识库(4.1)·组织知识:全量装不下·只能按需检索(第 5 章)" "跨会话记忆(4.1 / 4.2)·偏好 / 事实 / 约定:·会话开始召回,预算小而值钱" ──▶ "写入策略(4.2)·什么值得记 · 何时写入 · 记成什么形态" "跨会话记忆(4.1 / 4.2)·偏好 / 事实 / 约定:·会话开始召回,预算小而值钱" ──▶ "召回策略(4.2)·何时召回 · 召回多少 · 注入哪里"
一句话金句:会话内记忆管"接得上话",跨会话记忆管"认得出人",知识库管"答得出事"——三层各有各的供给时机,混为一谈是记忆事故的第一来源。
💡 本章与第 5 章共用一个背景:动态层是预算的主战场(2.1 节),而记忆在动态层里份额不大(会话历史常见 15% 上下,跨会话召回 1%~5%,示意)、事故却最多——因为它在长,而会话进行中没有人在场盯它。
三层记忆的对照表与判别口诀;各自的供给时机与预算位置;三个混层事故案例;与 LangGraph state / store 概念的对照翻译。
本节产出全书第二张核心表——记忆三层对照表,记忆设计的第一张图。
写入门槛三问;三种写入时机与三种写入形态;召回的量、位置与格式;ce_memory.py 最小分层记忆示意;记忆卫生(过期、冲突、遗忘)。
本节把跨会话记忆从"一个愿望"变成一条可运维的管道。
4.1 三层地图(是什么:记忆分几层、各自何时供给、跟素材怎么划界) │ 层划清了,问"跨会话那层的两端怎么做" ↓ 4.2 写入与召回(怎么管:进什么 · 何时进 · 怎么出、出多少) │ 记忆成分的决策齐了 ↓ 第 5 章 素材成分(动态层的另一半:按需供给与片段组装)
4.1 是空间维度的拆解(记忆装在哪几层、各层何时进窗口),4.2 是时间维度的操作(一条信息何时写入、何时召回、以什么形态存在);前者划辖区,后者定流程。会话内记忆的运行时治理——驱逐与压缩——已由 2.1 节立规、第 6 章收尾,本章不重复展开。
读毕自检:为你手上的应用列一张三栏清单——会话历史现在靠什么治理、跨会话库里存了什么、知识库从哪取。说不出话的那一栏,就是本章要替你补的。
前置知识:1.2 节四成分表与三问(记忆的归位,及"知识库检索结果是素材"辨析的判据);2.1 节分配表与驱逐顺序(会话内历史是驱逐顺位的常客);2.2 节位置效应(召回的记忆注入窗口哪一段,直接用它的推论)。
建议边读边把自己的记忆现状画成三栏表,章末对照 4.1 的对照表补全空栏。
为后续奠定基础:4.1 的知识库一层直接铺向第 5 章检索式上下文——RAG 正是知识库的供给形态;4.2 的写入与召回是第 7.1 节 write / select 两操作在框架组件上的落地对象;跨会话记忆的召回额度在 7.2 节客服案例的预算表里占一行。记忆机制的纵深——分层存储引擎、遗忘曲线、产品级实现——深潜见 《腾讯 Agent Memory 记忆系统》与《memU 记忆框架》教程(纯文字互引,不在此展开)。