6.3 伦理、安全与可解释性 本节摘要:在本文集的坐标系里,伦理与安全首先是目标与合法集的问题:哪些结果不可被效用买通,谁有权改目标,失败时默认行动是什么。可解释性是追溯:能否从一次行动回到当时的状态字段、命中的规则或计划、以及学习版本。偏见来自数据与目标代理指标,落点在 4.1 与 3.1。事故编年与治理流程让位伦理专集;这里只把义务焊回循环接口,避免把「负责任」写成海报。 会员。《6.3 伦理安全与可解释性》收录于灏天文库文集《AI 智能体基础:认知、决策与学习》,原作者/来源:灏天文库,整理自「灏天文库」,提供技术教程、实践指南与问题解决方案,支持在线阅读、全文检索与知识沉淀,助力开发者系统化学习。本站整理收录,版权归原作者/开源协议所有。