第四章:高级特性与定制化开发


第四章:高级特性与定制化开发

本章跟着一条线走:在第三章能跑的 Crew 之上,叠加让它"跑得久、跑得稳、跑得懂人话"的进阶能力。这条线从记忆出发,经人机协作、动态任务,再到可观测与持久化——每一项都对应一个生产系统绕不开的真实痛点。

主线只有一句话:多智能体从 Demo 到生产,差距不在功能多,而在有没有状态、有没有人在环、有没有日志、有没有断点续跑。

沿途站点五个:

  • 站点一,Memory:让角色跨任务记得前文,避免重复劳动。
  • 站点二,Human-in-the-Loop:在关键决策把人拉回环。
  • 站点三,动态任务生成:面对不确定输入现场补任务。
  • 站点四,可观测性:让每次运行有迹可循、可度量。
  • 站点五,持久化与恢复:长任务崩了能从断点续。

拐点与结论出现在站点二:你会意识到"全自动化"不是终局,关键节点的人工确认往往比更复杂的模型更保命。CrewAI 把人当成一种特殊的"工具/闸门",而不是系统的对立面。

读完你应该能回答:Memory 的三种类型分别存什么?human_input 该加在哪些 Task 上?动态任务用哪个钩子生成?答不清回看对应节。

下一章接力:第五章把这些能力收进工程规范,讲设计原则、测试、部署与安全。本章给你"进阶零件",下一章给你"使用这些零件的纪律"。

04-3ac5-fig01

本章可考核知识点:

  1. 区分短期记忆、长期记忆、实体记忆各自存什么、何时生效。
  2. 说出 human_input 的适用边界(哪些 Task 该加、哪些不该)。
  3. 描述用 CrewAI 的钩子或 planning 实现动态任务生成的机制。
  4. 列举三类必须被观测的信号(token、延迟、每步产出)。
  5. 解释持久化的两个层面:中间产出落库与断点恢复。

为什么单独开这一章

第三章让你"能跑",第四章让你"跑得久、跑得稳、跑得可控"。这一章的五个能力——记忆、人机协作、动态任务、可观测、持久化——任意一个缺席,系统都只能在演示里好看、在生产里翻车。读完这一章,你该能回答:怎么让 Agent 记住客户偏好、怎么在关键节点拦人、怎么在崩了之后续上。

各节分工与产出

节 主题 读完后你能产出的能力
4.1 Memory 给 Agent 开跨任务记忆
4.2 人机协作 在高风险节点插入人工确认
4.3 动态任务 运行时按需生成子任务
4.4 可观测优化 定位慢点并并发提速
4.5 持久化恢复 把状态落盘、断点续跑

本章常见误区

⚠️ 误区一:记忆一直开着不清理,过期事实误导 Agent。

⚠️ 误区二:human_input 到处开,人变审批机器,流于形式。

与邻章边界

本章是"让它稳",第五章是"把它做对、送上线的工程纪律"。能独立给 Crew 加记忆、加人工闸门、做持久化,即可离开本章。

本章能力清单(再细化)

读完第四章,你应该能独立交付以下能力,作为离开本章的验收:

  • 给 Agent 开启跨任务记忆,并知道何时该清理以免过期事实误导;
  • 在投资、对外口径等高风险节点插入 human_input,把价值判断留给真人;
  • 在既定白名单内让 Crew 运行时动态生成子任务,应对未知分支;
  • 用 verbose + 计时 + async_execution 定位慢点并提速;
  • 把 Crew 状态按版本化格式落盘,进程崩了能断点续跑。

与邻章的更细边界

和第三章的区别:第三章的 Crew 跑一次就结束;第四章关心"跑一次之后"——记忆要不要留、人要不要介入、崩了怎么续。和第五章的区别:第四章是框架提供的能力开关,第五章是用这些开关时该守的工程纪律(比如记忆清理频率、人工闸门开在哪些节点)。

⚠️ 再强调两个高频误用:记忆长期不清理会积累错误经验;human_input 铺太广会让人工审核流于形式。两者都是"开了比不开更糟"的典型。


作者与出处
原作者: 灏天文库
来源:平台策划编纂
整理: 灏天文库整理
由灏天文库平台收录,内容或由平台用户上传,仅供学习交流
发布者: 作者: 灏天文库 转发
评论区 (0)
U