本节摘要:把 Letta 与同类框架区分开的是三大特性:自我演进——模型在推理中读写自己的记忆,行为随交互持续改变;模型无关——智能体状态与底层模型解耦,换模型不换记忆;开源生态——白盒化的自托管架构与开放的扩展协议。本节逐项拆解这三者的技术含义,并诚实地核算每项特性的收益与代价。读完本节,你能对"看中它什么、忍受它什么"给出有依据的答案。
绝大多数智能体框架的行为在部署后是冻结的:提示词写死在配置里,技能是开发者预编排的流程,模型再多交互也不会改变明天的表现。Letta 走了另一条路——智能体的提示词构成物中有一块区域是模型自己的管辖地,模型在推理循环中可以随时改写它。
具体机制由一组内置记忆工具承载:core_memory_append 向核心记忆追加一条事实,core_memory_replace 替换其中的旧表述,archival_memory_insert 把值得长期保存但不必常驻上下文的信息写入档案库。当用户说"我最近换到上海办公了",模型的推理链会识别出这是对既有认知的修订,主动发起 core_memory_replace,把 human 块里的旧居住地替换掉。没有外部代码参与判断,写与不写、怎么写,都是模型在当前上下文里做出的决策。
这就是"自我演进"四个字的准确含义:不是模型权重发生了变化(参数始终冻结),而是智能体的行为受一份持续更新的状态支配。效果上近似在线学习——今天纠正过的事实,明天不会再犯;用户反复强调的偏好,会沉淀为稳定的响应倾向。⚠️ 值得警惕的是演化的双向性:错误的认知同样会被模型郑重其事地写进记忆,一次误判可能固化为长期的偏见。这正是第 5 章要讨论记忆膨胀治理的原因。
第二大特性关乎投资保护。Letta 的架构把"智能体"定义为一份数据库中的状态——记忆块、工具清单、对话历史——而把模型降格为这份数据的处理器。切换模型的操作小到只是一次参数变更:
# 同一个智能体,把引擎从一家云模型换成另一家 client.agents.update( agent_id=agent.id, model="anthropic/claude-sonnet-4-5", ) # 也可以指向本地部署的开源权重(经 vLLM 或 Ollama 暴露服务) client.agents.update( agent_id=agent.id, model="ollama/llama-3.3-70b", )
模型切换后,核心记忆、档案库、工具配置原样保留。这份解耦在两种时刻显出价值:一是模型市场剧烈波动的时刻,新的性价比之王出现时,你可以把存量智能体整体迁过去,此前积累的记忆资产毫发无损;二是合规敏感的时刻,金融、医疗场景可以把日常任务放在内网开源模型上,记忆照常积累,复杂任务再切换云端旗舰。
代价也要说清:模型无关是"可运行"意义上的无关,不是"表现一致"意义上的无关。不同模型对函数调用协议的遵循度差异很大,同一套记忆管理指令,在强模型上执行得干脆利落,在弱模型上可能出现该写不写、写错位置、甚至幻觉出工具名的情况。经验法则是:记忆管理越激进,越需要函数调用能力强的模型兜底。
第三大特性是许可证之外的开放。Letta 服务端完全开源,可以自托管在你的基础设施里——智能体状态存自家的数据库,记忆不出内网。与黑盒托管服务相比,白盒意味着三件具体的事:
开源同样有它的账单:你需要自己跑服务、自己管数据库、自己升级版本,社区方案的质量参差也需要自行甄别。一句话概括这笔交易的实质——你用运维责任,换来了完全的控制权。
| 特性 | 直接收益 | 需要支付的代价 | 何时最划算 |
|---|---|---|---|
| 自我演进 | 行为随交互持续改善,个性自然沉淀 | 需防错误认知固化,调参门槛高 | 长期陪伴型、需持续学习的产品 |
| 模型无关 | 记忆资产跨模型存续,成本与合规灵活 | 不同模型表现需重新验证调优 | 模型频繁迭代、数据敏感的场景 |
| 开源生态 | 可审计、可自托管、深度可定制 | 自担运维、升级与版本适配 | 有基础设施团队的企业与研究者 |
单看每一项都不算独门绝技,合在一起才是 Letta 的辨识度。设想一条时间线:你的客服智能体自托管在内网,日常用本地开源模型处理高频简单工单,记忆照常积累;半年后某家新模型在函数调用评测上大幅领先,你把智能体引擎整体切换,此前沉淀的用户偏好与业务知识原样带过去;又因为每一步记忆演化都有审计日志,合规部门拿到了完整的变更史。自我演进负责"变好",模型无关负责"活得久",开源生态负责"信得过"——三者在同一条生命周期里各司其职。
💡 一个实用的判断口诀:如果你的应用是"一次性问答",三大特性都不值钱;只要应用预期生命周期超过数周、且交互有积累价值,就值得为它们认真搭一次台。
问:自我演进会不会让智能体越学越偏,最后不可控? 会偏离,但偏离不是失控——因为每一笔"学到的东西"都落在可检查的记忆块里,且有完整的编辑轨迹。治理的抓手始终存在:发现偏离,改记忆块即可纠偏;担心漂移,把 5.6 节的巡检清单跑起来。真正不可控的是黑盒系统里的隐性漂移,白盒架构反而是三种形态里最可控的。
问:模型无关是不是意味着换模型零成本? 架构成本接近零(改一个模型绑定),验证成本是实打实的(5.2 节的对照流程值得完整走)。把"零成本"理解为"无需验证",是切换引擎时最常见的翻车姿势——记忆资产无损,行为表现待验,两件事必须分开说。
问:不开源的话,这套架构还有价值吗? 有,但价值构成不同。开源生态贡献的是审计、自托管与深度定制三类能力;即便你用的是托管形态、完全不碰运维,记忆自我编辑与模型无关这两大特性依然完整成立——它们是架构层的贡献,与许可证无关。
下一节把这些特性放回真实世界,看哪类场景最需要一台记忆会进化的智能体,并用一个完整案例走通从需求到落地的路径。