7.4 安全与对齐:提示注入、越权与数据外泄 本节摘要:护栏防误伤,安全防蓄意。本节正面分析智能体的三大攻击面——提示注入(含更隐蔽的间接注入)、权限越界、数据外泄——给出每一项的攻击样例与防线配置,并把伦理层面的责任归属说清:出事时,责任链条怎么划。 护栏(7.3 节)假设错误是无意的;安全要对付的是有意的。智能体的攻击面比聊天应用大一个量级,原因在于它有工具——攻击者不再满足于骗模型说错话,而是要骗它做事。三大攻击面逐个拆。 会员。《7.4 安全与对齐:提示注入、越权与数据外泄》收录于灏天文库文集《大模型驱动的智能体构建与应用》,原作者/来源:灏天文库,整理自「灏天文库」,提供技术教程、实践指南与问题解决方案,支持在线阅读、全文检索与知识沉淀,助力开发者系统化学习。本站整理收录,版权归原作者/开源协议所有。