1.2 威胁模型与攻防分类 本节摘要:对抗机器学习领域有林林总总的攻击方法,要理清它们,必须先建立系统的分类框架。威胁模型从三个维度刻画攻击者:知识(知道多少模型信息,分白盒/黑盒/灰盒)、能力(能改输入还是能改训练数据,分逃避攻击/投毒攻击)、目标(要让模型输出任意错误还是指定错误,分定向/非定向)。这三个维度组合起来,能把任何攻击精确定位到一个类别。本节讲清这个分类框架,它是理解后续所有具体攻防技术的基础。 会员。《1.2 威胁模型与攻防分类》收录于灏天文库文集《AI安全与对抗机器学习》,原作者/来源:灏天文库,整理自「灏天文库」,提供技术教程、实践指南与问题解决方案,支持在线阅读、全文检索与知识沉淀,助力开发者系统化学习。本站整理收录,版权归原作者/开源协议所有。