章节摘要:前两章讲「设计」,本章讲「造出来」——从理论图纸到可运行、可评估的智能体。先盘点开发工具与平台(通用框架、对话平台、领域工具、低代码),再走完整开发流程(需求→设计→环境建模→核心算法→集成测试→部署监控),接着讲性能评估的维度、指标与方法,最后用三个真实案例(客服机器人、推荐系统、分类评估)把前面所有环节串起来。读完本章,你应当能独立把一个智能体从需求做到上线并评估。
阅读完本章,你应当能够:

金句:开发智能体 60% 的时间在定义问题和建环境,40% 才在写智能体本身——把环境建得足够真实,智能体才值得训练。
四类工具盘点 + LangChain 深度拆解(模型/提示词/链/代理/工具/记忆),给出工具选型对照表。
六阶段全流程:需求文档怎么写、设计怎么定、环境怎么建、算法怎么选、测试怎么排、部署监控怎么搞。
评估维度(功能/性能/体验/可靠性)、五类指标、六种方法,及分类智能体评估的完整代码。
智能客服、商品推荐、分类评估三个案例,用「问题→设计→实现→评估→启示」框架拆解。
工具(用什么造) → 流程(怎么造) → 评估(造得好不好) → 案例(完整走一遍)
工具提供零件,流程规定工序,评估给出验收标准,案例则是把前三者完整跑一遍的「样板间」。先有工具视野才知道流程里用什么,先有流程才知道评估该在哪个环节插入,案例则验证整套方法论的可操作性。四节是一套「从零件到成品再到质检」的完整生产链。