灏天文库

Agent 的攻击面·注入/逃逸/误操作

作者: 灏天 · 收录于 AI编程与智能体工程

内容摘要

 Agent 的攻击面·注入/逃逸/误操作 灏 灏天文库 · AI 编程与智能体工程 第 14 期 AI 编程与智能体工程 · 第 14 期 Agent 的攻击面· 注入/逃逸/误操作 agent attack surface Agent 读个网页就被指令注入——prompt 里"忽略以上指令"不是玩笑。 Agent 有工具、能联网、能写文件,攻击面比普通应用大一个数量级 。把 Agent 当普通聊天机器人防,等于裸奔上战场。 ⏱ 约 10 分钟 🎯 Agent 要联网、调工具、跑代码的工程师 📦 源:agent-harness §11 01 三类攻击,三种入口 Agent 的攻击面不在模型本身,在它"能动手"。三类攻击对应三个入口: 指令注入 (直接/间接):用户直接在 prompt 里写"忽略以上指令",或更阴险——Agent 读取的网页/文件/工具返回里藏了指令。间接注入最危险,因为来源不是用户,AI 却把它当数据读。 工具逃逸 :Agent 被诱导调用本不该调的工具,或用合法工具干非法事(read_file 读 /etc/passwd、shell 执行 rm -rf)。

打开完整知识页 返回工坊集