软件学报

北大核心,INSPEC,JST,Pж(AJ),EI

国内刊号:11-2560/TP

国际刊号:1000-9825

软件学报杂志2023年第9期:深度学习模型中的公平性研究

发布日期:

作者:王昱颖,张敏,杨晶然,徐晟恺,陈仪香

单位:王昱颖,华东师范大学 软件工程学院, 上海 200062;上海市高可信重点实验室(华东师范大学), 上海 20006211,张敏,华东师范大学 软件工程学院, 上海 200062;上海市高可信重点实验室(华东师范大学), 上海 20006202,杨晶然,华东师范大学 软件工程学院, 上海 200062;上海市高可信重点实验室(华东师范大学), 上海 20006203,徐晟恺,华东师范大学 软件工程学院, 上海 200062;上海市高可信重点实验室(华东师范大学), 上海 20006204,陈仪香,华东师范大学 软件工程学院, 上海 200062;上海市高可信重点实验室(华东师范大学), 上海 20006205

关键词:深度学习;模型偏见;个体公平;群体公平

基金:国家自然科学基金(61672012); 科技部重点研发项目(2020AAA0107800); 国家自然科学基金中以国际合作项目(62161146001)

近几年深度神经网络正被广泛应用于现实决策系统, 决策系统中的不公平现象会加剧社会不平等, 造成社会危害. 因此研究者们开始对深度学习系统的公平性展开大量研究, 但大部分研究都从群体公平的角度切入, 且这些缓解群体偏见的方法无法保证群体内部的公平. 针对以上问题, 定义两种个体公平率计算方法, 分别为基于输出标签的个体公平率(IFRb), 即相似样本对在模型预测中标签相同的概率和基于输出分布的个体公平率(IFRp), 即相似样本对的预测分布差异在阈值范围内的概率, 后者是更严格的个体公平. 更进一步, 提出一种提高模型个体公平性的算法IIFR, 该算法通过余弦相似度计算样本之间的差异程度, 利用相似临界值筛选出满足条件的相似训练样本对, 最后在训练过程中将相似训练样本对的输出差异作为个体公平损失项添加到目标函数中, 惩罚模型输出差异过大的相似训练样本对, 以达到提高模型个体公平性的目的. 实验结果表明, IIFR算法在个体公平的提升上优于最先进的个体公平提升方法. 此外IIFR算法能够在提高模型个体公平性的同时, 较好地维持模型的群体公平性.

来源:2023年第9期

《软件学报》期刊编辑部

查看软件学报杂志2023年第9期

联系我们

  • 地址:北京8718信箱
  • 电话:010-62562563
  • E-mail:jos (a) iscas. ac. cn

咨询工作人员