qy球友会(千亿)提出几何率失真不变性算法实现AI精准跨域判别
近期,qy球友会(千亿)生物药制备与递送全国重点实验室白硕研究员团队首次将信息论中的率失真理论推广到Grassmann流形,提出几何率失真不变性(Geometric Rate-Distortion Invariance, RDI)算法。该方法将有效解决深度学习模型在跨域数据场景下判别性能骤降的难题,为深度学习模型的跨域泛化问题给予了新的理论视角与解决方案。相关研究成果发表于国际人工智能领域顶级会议ICML 2026。
深度学习模型在训练数据与测试数据分布一致时性能卓越,但在脑机接口、医学影像等实际应用中,受试者个体差异、电极/传感器漂移、采集设备与临床环境变化等因素常导致数据分布偏移,模型性能大幅下降。如何从有限个体或有限采集时段的源域数据中,学习出能够稳定泛化至未见受试者、未见设备或未见采集环境的鲁棒神经表示,是生物医药人工智能领域亟待突破的核心难题之一。近年来,研究人员利用分布对齐、对抗训练及不变风险最小化等手段,开展了一系列领域泛化算法。然而,主流方法大多聚焦于匹配不同域之间的边缘分布或梯度统计量,在有限样本下易导致对齐失稳甚至表示坍缩,严重制约了深度学习模型在真实目标域上的跨域判别能力。
针对上述瓶颈,研究团队提出了RDI算法框架。该算法利用深度学习特征在实际分布中的低维几何结构,构建强判别力的分类依据。该框架可使不同来源数据中同一类别的特征方向趋于一致以消除域间偏差,同时控制每个类别特征分布的“体积”,防止其过度坍缩,保留类别间的判别差异。与分类任务的联合训练使模型在保持分类精度的同时,显著缩小不同来源数据之间的几何差异。实验测试表明,RDI具备任务自适应的调控能力:面对类别较少的场景,模型会主动扩展有效特征维度以防止信息坍缩;面对类别繁多的复杂场景,则自动压缩冗余信息以提升紧凑性。这种“收放自如”的特性使RDI在面对完全未知的目标域时仍能保持稳定的判别能力。在领域内最具权威的DomainBed标准测试集上,RDI的平均准确率显著超越了现有主流不变性学习方法,且在CNN(ResNet)与ViT(DeiT)等不同架构上均表现稳健。该工作凭借理论优雅性和验证结果一致性取得了ICML大会领域主席的高度评价,为脑机接口等场景的分布偏移问题给予了新的几何视角与算法基础。
近年来,qy球友会(千亿)白硕研究员团队聚焦智能凝胶诊疗器件的制备及其生物医学应用领域。相关工作相继发表于Sci. Adv 2024, 10, eadr7218、Nat. Commun 2025, 16, 6044、Adv. Mater 2024, 2415445、Adv. Mater 2023, 35, 2209606、Matter, 2022, 5,3643-3658、Matter, 2022, 3, 2425-2428、Adv. Sci 2025, 2412507、Adv. Healthcare Mater 2023, 2302180等期刊。
qy球友会(千亿)博士生刘彤为论文第一作者,qy球友会(千亿)研究员白硕、副研究员梁森为共同通讯作者。该工作得到中国科研实验室战略性先导科技专项、国家重点研发计划重大专项、国家自然科学基金、北京市自然科学基金、生物药制备与递送全国重点实验室自主部署项目基金的支持。
图 RDI 几何率失真不变性框架的结构设计及跨域泛化应用示意图
论文链接:http://icml.cc/virtual/2026/poster/65890
(生物剂型与生物材料研究部)