国内刊号:11-2560/TP
国际刊号:1000-9825
发布日期:
作者:高梦楠,陈伟,吴礼发,张伯雷
单位:高梦楠,南京邮电大学 计算机学院、软件学院、网络空间安全学院, 江苏 南京 21002311,陈伟,南京邮电大学 计算机学院、软件学院、网络空间安全学院, 江苏 南京 210023;江苏省大数据安全与智能处理重点实验室 (南京邮电大学), 江苏 南京 21002302,吴礼发,南京邮电大学 计算机学院、软件学院、网络空间安全学院, 江苏 南京 210023;江苏省大数据安全与智能处理重点实验室 (南京邮电大学), 江苏 南京 21002303,张伯雷,南京邮电大学 计算机学院、软件学院、网络空间安全学院, 江苏 南京 21002304
关键词:深度学习;后门攻击;后门防御;人工智能安全
基金:国家自然科学基金(62202238); 江苏省重点研发项目(BE2022065-5)
深度学习模型是人工智能系统的重要组成部分, 被广泛应用于现实多种关键场景. 现有研究表明, 深度学习的低透明度与弱可解释性使得深度学习模型对扰动敏感. 人工智能系统面临多种安全威胁, 其中针对深度学习的后门攻击是人工智能系统面临的重要威胁. 为了提高深度学习模型的安全性, 全面地介绍计算机视觉、自然语言处理等主流深度学习系统的后门攻击与防御研究进展. 首先根据现实中攻击者能力将后门攻击分为全过程可控后门、模型修改后门和仅数据投毒后门. 然后根据后门构建方式进行子类划分. 接着根据防御策略对象将现有后门防御方法分为基于输入的后门防御与基于模型的后门防御. 最后汇总后门攻击常用数据集与评价指标, 并总结后门攻击与防御领域存在的问题, 在后门攻击的安全应用场景与后门防御的有效性等方面提出建议与展望.
来源:2025年第7期
《软件学报》期刊编辑部