国内刊号:11-2560/TP
国际刊号:1000-9825
发布日期:
作者:周植,张丁楚,李宇峰,张敏灵
单位:周植,计算机软件新技术国家重点实验室(南京大学), 江苏 南京 21002311,张丁楚,计算机软件新技术国家重点实验室(南京大学), 江苏 南京 21002302,李宇峰,计算机软件新技术国家重点实验室(南京大学), 江苏 南京 21002303,张敏灵,东南大学 计算机科学与工程学院, 江苏 南京 21009604
关键词:开集识别;测试时适应;分布偏移;图像识别;流数据
基金:科技创新2030—“新一代人工智能”重大项目(2022ZD0114803); 国家自然科学基金(62176118)
开集识别旨在研究测试阶段突现未见类别对于机器学习模型的挑战, 以期学习模型既能分类已见类别又可识别/拒绝未见类别, 是确保机器学习模型能够在开放世界中高效稳健部署的重要技术. 既有开集识别技术通常假设已见类别的协变量分布在训练与测试阶段维持不变. 然而在实际场景中, 类别的协变量分布常不断变化. 直接利用既有技术不再奏效, 其性能甚至劣于基线方案. 因此, 亟需研究新型开集识别方法, 使其能不断适应协变量分布偏移, 以期模型在测试阶段既能稳健分类已见类别又可识别未见类别. 将此新问题设置命名为开放世界适应问题(AOW), 并提出了一种开放测试时适应方法(OTA). 该方法基于无标注测试数据优化自适应熵损失与开集熵损失更新模型, 维持对已见类的既有判别能力, 同时增强了识别未见类的能力. 大量实验分析表明, 该方法在多组基准数据集、多组不同协变量偏移程度下均稳健地优于现有先进的开集识别方法.
来源:2024年第4期
《软件学报》期刊编辑部