第8章 · 最优控制与学习 本章要回答的三个问题:控制器能不能"算"出来而不是"调"出来——LQR 如何用二次代价换出最优增益?状态测不到时怎么办——卡尔曼滤波如何从噪声观测里最优地重构状态?模型完全未知时怎么办——MDP 与强化学习如何让最优控制延伸到试错学习的世界?本章是两条主线的会师章。 为什么会有这一章 第 7 章的 PID 靠反馈的鲁棒性吃饭,但整定终究是手艺活。 会员。《第8章 最优控制与学习》收录于灏天文库文集《运筹学与控制论》,原作者/来源:灏天文库,整理自「灏天文库」,提供技术教程、实践指南与问题解决方案,支持在线阅读、全文检索与知识沉淀,助力开发者系统化学习。本站整理收录,版权归原作者/开源协议所有。