国内刊号:11-2560/TP
国际刊号:1000-9825
发布日期:
作者:吴月明,张笑睿,李志,刘恺麟,邹德清,金海
单位:吴月明,大数据技术与系统国家地方联合工程研究中心, 湖北 武汉 430074;服务计算技术与系统教育部重点实验室, 湖北 武汉 430074;大数据安全湖北省工程研究中心, 湖北 武汉 430074;华中科技大学 网络空间安全学院, 湖北 武汉 43007411,张笑睿,大数据技术与系统国家地方联合工程研究中心, 湖北 武汉 430074;服务计算技术与系统教育部重点实验室, 湖北 武汉 430074;大数据安全湖北省工程研究中心, 湖北 武汉 430074;华中科技大学 网络空间安全学院, 湖北 武汉 43007402,李志,大数据技术与系统国家地方联合工程研究中心, 湖北 武汉 430074;服务计算技术与系统教育部重点实验室, 湖北 武汉 430074;大数据安全湖北省工程研究中心, 湖北 武汉 430074;金银湖实验室, 湖北 武汉 430074;华中科技大学 网络空间安全学院, 湖北 武汉 43007403,刘恺麟,分布式系统安全湖北省重点实验室, 湖北 武汉 430074;大数据安全湖北省工程研究中心, 湖北 武汉 430074;华中科技大学 网络空间安全学院, 湖北 武汉 43007404,邹德清,大数据技术与系统国家地方联合工程研究中心, 湖北 武汉 430074;服务计算技术与系统教育部重点实验室, 湖北 武汉 430074;大数据安全湖北省工程研究中心, 湖北 武汉 430074;金银湖实验室, 湖北 武汉 430074;华中科技大学 网络空间安全学院, 湖北 武汉 43007405,金海,大数据技术与系统国家地方联合工程研究中心, 湖北 武汉 430074;服务计算技术与系统教育部重点实验室, 湖北 武汉 430074;大数据安全湖北省工程研究中心, 湖北 武汉 430074;集群与网格计算湖北省重点实验室, 湖北 武汉 430074;华中科技大学 计算机科学与技术学院, 湖北 武汉 43007406
关键词:漏洞分类;少样本;对比学习
基金:国家自然科学基金(62202191)
为了对漏洞进行细粒度检测, 理想的模型必须确定软件是否包含漏洞, 并确定漏洞的类型(即进行漏洞分类). 一系列深度学习模型在漏洞分类任务中取得了良好的整体性能. 然而, 观察到不同漏洞类型之间存在严重的数据不平衡. 许多漏洞类型只有少量的漏洞样本(称为少样本类型), 这导致了对少样本类型的分类性能和泛化能力较差. 为了提高少样本漏洞类型的分类性能, 实现VulFewShot. 这种基于对比学习的漏洞分类框架通过使相同类型的漏洞样本“接近”, 同时使不同类型的漏洞样本彼此“远离”, 从而为仅有少数漏洞样本类型赋予了更多的权重. 实验结果表明, VulFewShot可以提高对所有类型漏洞的分类性能. 类型包含的漏洞样本数量越少, 改进就越显著. 因此, VulFewShot可以提高样本不足的漏洞的分类性能, 并减少样本量对学习过程的影响.
来源:2025年第12期
《软件学报》期刊编辑部