← 最新论文
💻 computer science

CARE: Class-Adaptive Expert Consensus for Reliable Learning with Long-Tailed Noisy Labels

本文提出了 CARE,这是一个参数高效框架,它利用基于类别的专家共识机制,借助视觉 - 语言模型信号,通过对尾部类别施加更严格的共识要求、对头部类别采用更宽松的共识要求,从而有效应对长尾分布与噪声标签交织的复合挑战。

原作者: Mengke Li, Haiquan Ling, Lihao Chen, Yang Lu, Yiqun Zhang, Hui Huang

发布于 2026-05-25
📖 1 分钟阅读☕ 轻松阅读

原作者: Mengke Li, Haiquan Ling, Lihao Chen, Yang Lu, Yiqun Zhang, Hui Huang

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,你正在教一名新学生(一个 AI 模型)如何从一本巨大的相册中识别动物。但这本相册存在两个大问题:

  1. “长尾”问题:相册里充满了狗和猫的照片(“头部”类别),但像霍加狓或穿山甲这样的稀有动物,却只有寥寥几张模糊的照片(“尾部”类别)。
  2. “噪声标签”问题:给照片写名字的人犯了错。他们把狗标成了猫,或者把稀有的穿山甲标成了常见的松鼠。

大多数以往的方法试图分别解决这些问题。它们要么试图平衡照片数量,要么试图找出并修正错误的名称。但论文指出,这种“一刀切”的方法是行不通的。这就像用同一套严格的规则手册去要求一个精通所有狗类知识的学生,和一个第一次见到穿山甲的学生。严格的规则会让初学者感到困惑,而宽松的规则则会让专家犯下粗心大意的错误。

解决方案:CARE(基于专家类的自适应校正)

作者提出了一种名为 CARE 的新方法。不妨将 CARE 想象成不是单一的老师,而是一个由三位专家法官组成的评审团,他们共同投票决定每张照片里是什么。

以下是这三位“专家”的工作方式:

  1. 文本专家:这位法官读过所有关于动物的书籍。它看着照片说:“根据对‘穿山甲’的描述,这看起来像穿山甲。”它利用语言知识来推测标签。
  2. 图像专家:这位法官是一位视觉艺术家,研究过成千上万张照片。它观察形状和颜色,然后说:“从视觉上看,这与穿山甲相符。”
  3. 原始标签专家:这就是照片上原本写着的、有缺陷的标签。尽管它经常出错,但它仍包含一些有用的线索,尤其是对于像狗这样的常见动物。

秘诀:“类自适应共识”

CARE 的魔力不仅仅在于拥有三位法官,更在于他们如何投票

  • 对于常见动物(“头部”类别):有数千张狗的照片。法官们可以稍微放松一些。如果文本专家和图像专家都同意这是狗,他们就会接受,即使原始标签写的是“猫”。他们不需要 100% 确定,因为有海量数据作为后盾。
  • 对于稀有动物(“尾部”类别):穿山甲的照片寥寥无几。这些情况很棘手。如果原始标签说是“松鼠”,那么文本专家和图像专家必须极其自信且彼此达成一致,才能推翻该标签。如果他们哪怕有一丝不确定,CARE 就会保留原始标签或对其持谨慎态度。

类比
想象一个城镇会议,决定一条新街道的名字。

  • 头部类别(常见):如果有 100 个人说“主街”,而一个人说“橡树街”,我们会相信那 100 个人。我们不需要极其严格的投票计数。
  • 尾部类别(稀有):如果房间里只有 3 个人,其中 2 人说“橡树街”,但第 3 个(原始标签)人说“主街”,我们就不能简单地跟随多数派。我们需要非常小心。也许第 3 个人是对的,也许那 2 个人是对的。CARE 会说:“只有当那 2 位专家大声达成一致时,我们才更改名字。如果他们只是低声细语,我们就坚持原名或等待更多证据。”

为什么这更有效

以往的方法试图同等地修正所有错误的名称。这往往会让稀有动物的情况变得更糟,因为 AI 会被噪声搞糊涂,从而完全停止学习它们。

CARE 通过以下方式解决了这个问题:

  1. 过滤噪声:它忽略了穿山甲照片上的“松鼠”标签,因为文本专家和图像专家强烈反对它。
  2. 保护稀有:除非证据确凿,否则它不会激进地更改那几张稀有照片的标签。这防止了 AI“过度修正”并失去原本仅存的一点真实性。

结果

论文在合成数据(人为制造的噪声数据集)和现实世界的混乱数据(如来自互联网的照片)上测试了这种方法。

  • 结果:CARE 始终优于现有的最佳方法。
  • 提升:它将准确率提高了高达 3.0%。在 AI 领域,这是一个巨大的飞跃。
  • 证明:当他们查看“噪声率”(剩余的错误标签数量)时,CARE 在清理稀有类别方面比其他方法做得更好,而其他方法通常会让稀有类别充满错误。

总结

CARE 是一个智能系统,它知道何时该严格,何时该灵活。它利用文本、图像和原始标签的综合智慧来清理混乱的数据。关键在于,它对稀有物品给予了额外的呵护,确保 AI 能够识别“长尾”中的稀有事物,而不会被噪声搞糊涂。这是一个“即插即用”的工具,能让 AI 在从不完美、现实世界的数据中学习时变得更加可靠。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →