国内刊号:11-2560/TP
国际刊号:1000-9825
发布日期:
作者:陈曙,叶俊民,刘童
单位:陈曙,华中师范大学 计算机学院, 湖北 武汉 43007911,叶俊民,华中师范大学 计算机学院, 湖北 武汉 43007902,刘童,华中师范大学 计算机学院, 湖北 武汉 43007903
关键词:软件缺陷预测;软件缺陷度量元;机器学习;迁移学习;领域适配
基金:国家科技支撑计划(2015BAK33B00)
软件缺陷预测旨在帮助软件开发人员在早期发现和定位软件部件可能存在的潜在缺陷,以达到优化测试资源分配和提高软件产品质量的目的.跨项目缺陷预测在已有项目的缺陷数据集上训练模型,去预测新的项目中的缺陷,但其效果往往不理想,其主要原因在于,采样自不同项目的样本数据集,其概率分布特性存在较大差异,由此对预测精度造成较大影响.针对此问题,提出一种监督型领域适配(domain adaptation)的跨项目软件缺陷预测方法.将实例加权的领域适配与机器学习的预测模型训练过程相结合,通过构造目标项目样本相关的权重,将其施加于充足的源项目样本中,以实例权重去影响预测模型的参数学习过程,将来自目标项目中缺陷数据集的分布特性适配到训练数据集中,从而实现缺陷数据样本的复用和跨项目软件缺陷预测.在10个大型开源软件项目上对该方法进行实证,从数据集、数据预处理、实验结果多个角度针对不同的实验设定策略进行分析;从数据、预测模型以及模型适配层面分析预测模型的过拟合问题.实验结果表明,该方法性能优于同类方法,显著优于基准性能,且能够接近和达到项目内缺陷预测的性能.
来源:2020年第2期
《软件学报》期刊编辑部