第四章你跑通了协作,但那是在你笔记本上、一两个 Agent、几次往返的规模。真实生产里,并发一上来、上下文一长、外部依赖一抖,问题全冒头。这一章是工程化放大与加固,我们谈缓存、并发、资源管理、错误处理、安全合规和外部集成。每一节都给你能落地的开关和参数,而不是泛泛而谈。我们见过太多 demo 跑得欢、一上生产就崩的项目,崩的法子惊人地一致:要么同一句提示反复烧钱(没缓存),要么一个慢调用卡死整条链路(没并发隔离),要么出错后完全无法还原现场(没日志),要么 Agent 越权访问了不该碰的数据(没沙箱)。这些都不是"框架 bug",而是"你没把隐含假设显式化"。demo 隐含的假设是:模型永远在线、输入永远合法、出错无所谓。生产里这三个假设全要被打破,而打破的方式就是这一章的每一节——缓存把"模型永远在线"变成"命中就别调",校验把"输入永远合法"变成"不合法就拦",兜底把"出错无所谓"变成"出错能回放"。可以说,第一章到第四章教你把系统搭起来,第五章教它活过生产的第一周。这章内容不性感,但它是区分"玩具"和"产品"的那道坎。
读完这一章,你能拿到几项让系统"扛造"的能力:第一,你能给高频调用开启大模型响应缓存,用命中率验证省了多少推理,直接降低重复开销;第二,你能用并发方式同时跑多个独立对话,并用资源隔离避免一个慢任务拖垮全局;第三,出错时你能从带轮次和发言者标记的日志还原现场,而不是靠猜;第四,你能给函数执行做沙箱化并说明理由(隔离故障面、限制权限外溢);第五,Agent 调外部 API 时你能做最小鉴权——密钥不进提示、权限按需收窄。第四章给你会动的系统,第五章让它扛造。这些能力不性感,但没有它们系统走不出你的电脑,更走不到生产环境。我们反复说"稳定性是堆出来的",这一章就是那堆稳定性的砖。
| 节 | 标题 | 解决什么 | 这一节能交付的产出 |
|---|---|---|---|
| 5.1 | 性能优化与效率提升 | 缓存、并发、减少重复推理 | 一份缓存命中与并发配置 |
| 5.2 | 可扩展性与资源管理 | 多实例、资源隔离 | 一套资源隔离方案 |
| 5.3 | 错误处理、调试与日志 | 异常捕获与回放 | 一段带追踪的日志配置 |
| 5.4 | 安全性、隐私与合规 | 沙箱、数据脱敏 | 一张安全边界检查单 |
| 5.5 | 外部系统与服务集成 | 数据库、API、Web 服务 | 一个带鉴权的集成样例 |
生产化的本质是"把demo里的隐含假设显式化":demo 假设模型永远在线、假设输入永远合法、假设出错无所谓;生产里这些都要变成显式的缓存、校验、兜底。本章每一节,都是在帮你把一个隐含假设变成一段代码。别嫌琐碎,稳定性就是这么一点一点堆出来的。

这一章最常被低估的是"先跑通再加固"的反面——很多人一上生产就堆满缓存、并发、沙箱,结果问题反而难查。正确顺序是:先让系统在小流量下把错误暴露出来,再针对真实瓶颈加加固。另一个误区是认为安全合规是"上线前补一张单",其实数据脱敏和权限边界要在集成设计阶段就定,事后打补丁既贵又漏。还有人把日志当成"出错再开",等真出错时现场早已被覆盖,回放无门。
第五章只解决"已能跑的系统如何扛住生产",不重新讲协作模式(第四章)、不进入业务落地与生命周期(第六章)、不碰社区贡献(第七章)。如果你在读本章时还在纠结"两个 Agent 怎么轮转",说明你该回第四章,第五章假设协作已经跑顺,只关心它在规模下的表现。
第六章把这一切装进真实项目:从立项到部署、从监控到伦理。详见第六章。