软件学报

北大核心,INSPEC,JST,Pж(AJ),EI

国内刊号:11-2560/TP

国际刊号:1000-9825

软件学报杂志2026年第4期:面向开放世界持续学习的任务敏感提示驱动混合专家模型

发布日期:

作者:李昱洁,吴晗,孟丹,李天瑞,杨新

单位:李昱洁,西南财经大学 管理科学与工程学院, 四川 成都 611130;智能金融教育部工程研究中心 (西南财经大学), 四川 成都 61113011,吴晗,西南财经大学 计算机与人工智能学院, 四川 成都 61113002,孟丹,西南财经大学 管理科学与工程学院, 四川 成都 611130;智能金融教育部工程研究中心 (西南财经大学), 四川 成都 61113003,李天瑞,西南交通大学 计算机与人工智能学院, 四川 成都 61420204,杨新,西南财经大学 计算机与人工智能学院, 四川 成都 61113005

关键词:开放世界持续学习;持续学习;任务敏感;混合专家模型;知识传输

基金:国家自然科学基金(62476228)

开放世界持续学习(OWCL)旨在模拟现实环境中任务不断演化、类别动态变化且遇到未经训练的未知样本的情景. 一个良好的开放世界持续学习模型不仅需要在学习新任务的同时保持对已学任务的记忆, 还需具备识别未知类别的能力, 进而实现持续且鲁棒的知识积累与泛化. 然而, 现有持续学习方法普遍建立在封闭世界假设之上, 无法有效应对开放类别带来的类别不确定性与任务间干扰, 尤其在知识稳定性与知识可塑性之间的权衡上表现出明显不足. 因此, 在开放世界持续学习问题的形式化定义基础上, 提出一种任务敏感提示驱动的混合专家模型TP-MoE (task-aware prompt-driven mixture of experts), 以实现对任务语义的动态建模与专家模块的高效调度, 从而帮助模型进行知识传输和知识更新. 具体而言, TP-MoE引入一种即插即用的任务提示聚合机制并改进门控机制用以专家网络路由, 在任务增量过程中持续融合历史与当前任务知识; 同时结合一种自适应开放边界阈值策略, 可根据新旧知识的迁移动态调整开放类别的判别边界, 从而提升开放类别检测能力与已知类别分类准确性. 实验结果表明, TP-MoE在Split-CIFAR100和Open-CORe25基准数据集上对各类指标的测试均取得领先性能, 展现出良好的稳健性与泛化性, 为开放世界持续学习任务中的知识建模与任务调度提供了一种可扩展、可迁移的新框架.

来源:2026年第4期

《软件学报》期刊编辑部

查看软件学报杂志2026年第4期

联系我们

  • 地址:北京8718信箱
  • 电话:010-62562563
  • E-mail:jos (a) iscas. ac. cn

咨询工作人员