国内刊号:11-2560/TP
国际刊号:1000-9825
发布日期:
作者:田加林,徐行,沈复民,申恒涛
单位:田加林,电子科技大学 计算机科学与工程学院, 四川 成都 61173111,徐行,电子科技大学 计算机科学与工程学院, 四川 成都 61173102,沈复民,电子科技大学 计算机科学与工程学院, 四川 成都 61173103,申恒涛,电子科技大学 计算机科学与工程学院, 四川 成都 61173104
关键词:零样本草图检索;零样本学习;跨模态检索;知识蒸馏
基金:国家自然科学基金(61976049, 62072080, 61632007)
零样本草图检索将未见类的草图作为查询样本, 用于检索未见类的图像. 因此, 这个任务同时面临两个挑战: 草图和图像之间的模态差异以及可见类和未见类的不一致性. 过去的方法通过将草图和图像投射到一个公共空间来消除模态差异, 还通过利用语义嵌入(如词向量和词相似度)来弥合可见类和未见类的语义不一致. 提出了跨模态自蒸馏方法, 从知识蒸馏的角度研究可泛化的特征, 无需语义嵌入参与训练. 具体而言, 首先通过传统的知识蒸馏将预训练的图像识别网络的知识迁移到学生网络. 然后, 通过草图和图像的跨模态相关性, 跨模态自蒸馏将上述知识间接地迁移到草图模态的识别上, 提升草图特征的判别性和泛化性. 为了进一步提升知识在草图模态内的集成和传播, 进一步地提出草图自蒸馏. 通过为数据学习辨别性的且泛化的特征, 学生网络消除了模态差异和语义不一致性. 在3个基准数据集, 即Sketchy、TU-Berlin和QuickDraw, 进行了广泛的实验, 证明了所提跨模态自蒸馏方法与当前方法相比较的优越性.
来源:2022年第9期
《软件学报》期刊编辑部