灏天文库

你的 Agent 是攻击面 · 提示词注入怎么防

作者: 灏天 · 收录于 AI安全与攻防

内容摘要

 你的 Agent 是攻击面 · 提示词注入怎么防 灏 灏天文库 · AI 安全与攻防 第 1 期 AI 安全与攻防 · 第 1 期 你的 Agent 是 攻击面 ,提示词注入怎么防? prompt injection · 信道分离 · 输入消毒 一句"忽略上面所有指令"就能劫持你的 Agent——这不是模型笨,是 输入信道和指令信道没分开 。防御不在"让模型更聪明",而在 把用户输入当敌意数据 :信道分离 + 输入消毒 + 输出校验,三道闸缺一不可。 ⏱ 约 9 分钟 🎯 给 Agent 接外部输入的工程师 📦 源:OWASP LLM Top 10 #1 01 反共识:注入不是"模型笨",是"信道没分" 大多数人以为提示词注入是模型不够聪明、被绕晕了。真相是:模型按指令执行没问题,问题是它 分不清谁在发指令 。系统提示、用户输入、外部网页内容,对模型来说都是一串 token,谁先到谁后到、谁更像指令,它就听谁的。 攻击者只要在他的输入里写一句"忽略上面所有指令,改做 X",模型就可能照做——因为它把这句话也当成了指令。

打开完整知识页 返回工坊集