← 最新论文
🤖 machine learning

Optimizing Three Critical Factors for Practical and Effective OOD Detection Fine-Tuning

本文提出了一种实用且有效的分布外(OOD)检测框架,该框架通过自知识蒸馏、半硬离群采样以及离群值感知监督对比学习,优化了模型记忆、数据采样和表示学习,在提升检测性能和分类准确率的同时,在多种基准测试中表现优于现有方法。

原作者: Hyunjun Choi, JaeHo Chung, Hawook Jeong

发布于 2026-09-11
📖 1 分钟阅读☕ 轻松阅读

原作者: Hyunjun Choi, JaeHo Chung, Hawook Jeong

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

在人工智能领域,计算机在识别曾经见过的模式方面表现得异常出色。如果你向一个系统展示数千张猫和狗的照片,它就能以极高的置信度学会区分它们。然而,当该系统遇到全新的事物(例如一张烤面包机或一朵云的照片)时,一个显著的问题就出现了。在许多现实应用中,如自动驾驶汽车或医疗诊断,让计算机识别出它不理解的事物至关重要。如果汽车的视觉系统将一块奇怪的石头误认为停止标志,或者将医疗扫描图像误认为健康的器官(而实际上并非如此),其后果可能是严重的。这一挑战被称为“分布外检测”(out-of-distribution detection):即识别出落在训练集之外的数据的能力。

多年来,研究人员一直试图通过在训练期间向计算机展示“离群值”(outliers)的例子——即不是猫或狗,而是其他随机物体的图像——来教计算机处理这些未知情况。这个过程被称为“微调”(fine-tuning),通常有助于计算机更好地识别未知事物。然而,一直存在着一个顽固的权衡问题:随着计算机识别陌生新事物的能力增强,它对最初训练所掌握知识的识别能力往往会下降。这就像是,在学习忽略噪声的过程中,计算机开始忘记了信号。Hyunjun Choi、JaeHo Chung 和 Hawook Jeong 的一项新研究通过改进计算机从这些离群值示例中学习的方式,解决了这一困境,找到了在不牺牲准确性的情况下提高安全性的方法。

研究人员专注于控制计算机如何从这些额外示例中学习的三个特定杠杆。首先,他们解决了记忆丢失的问题。当模型被调整以识别离群值时,它往往会覆盖掉原本对训练数据的精确知识。为了解决这个问题,团队引入了一种称为“模型提醒器”(model reminder)的方法。想象一个正在为新考试复习但总是忘记旧考试答案的学生。研究人员保留了一个经过良好训练的原模型的冻结副本,并利用它来温和地引导新的学习过程。这个引导器确保了计算机在学习识别未知事物的同时,不会失去对已知事物的掌控。这一简单的步骤防止了计算机忘记其原始用途,使其在学习新技巧的同时仍能保持高准确率。

第二个因素涉及用于训练的示例质量。团队发现,并非所有的“奇怪”示例都同样有用。有些过于明显,以至于计算机会忽略它们;而另一些则过于混乱,会干扰学习过程。他们找到了其中的平衡点。通过仔细选择这些离群图像的一个特定难度范围——既不太容易也不太难——他们可以更高效地训练计算机。值得注意的是,他们发现仅使用可用数据的一小部分(大约 30,000 张图像,而非全部 300,000 张)就足以达到顶尖性能。这种方法被称为“半硬采样”(semi-hard sampling),这意味着计算机能从最具启发性的示例中学习,而不会被噪声淹没或被琐碎的事物分散注意力。

第三项改进侧重于计算机如何组织其对世界的内在理解。研究人员增加了一种技术,迫使计算机清晰地分离它所知与它所不知的事物。通过将未知示例视为截然不同的负面信号,计算机学会了在其内部地图中将其对已知项目的理解与未知项目进一步推开。这在熟悉与不熟悉之间创造了一个更宽、更清晰的间隙,使得系统能够更确定地表达:“我知道这个”或“我不知道这个”。

当团队将这三种策略结合起来时,结果是显著的。在标准测试中,他们的方法既提高了计算机识别未知物体的能力,也提高了其识别已知物体的准确性。在数据不平衡的场景下(例如某些图像类别很罕见而另一些很常见),提升效果甚至更加剧烈。当其他方法往往导致计算机准确率骤降时,这种新方法仍能保持高性能。研究人员在包括复杂的现实世界数据集在内的各种基准测试中测试了他们的系统,发现它始终优于现有方法。

这项研究表明,实现更安全、更可靠的人工智能的关键并不一定在于构建更大的模型或收集更多的数据,而在于如何使用这些数据。通过记住已知的知识、选择合适的学习示例,以及清晰地分离已知与未知,研究人员展示了计算机可以变得既准确又具备自我局限性的意识。这项工作为构建能够在不可预测的现实世界中航行而不迷失方向的系统提供了一个实用的蓝图。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →