← 最新论文
📊 statistics

Hide&Seek: Learning to Explain in an End-to-End Differentiable Network

本文介绍了 Hide&Seek,这是一个用于实例级特征选择的端到端可微框架,它通过将特征移除重新表述为一种可微操作,并通过稀疏性权重退火来稳定训练,从而在不发生信息泄漏的情况下,将特征选择与预测进行联合学习。

原作者: Tal Ellinson, Hadi Mohasel Afshar, Sally Cripps

发布于 2026-08-18
📖 1 分钟阅读☕ 轻松阅读

原作者: Tal Ellinson, Hadi Mohasel Afshar, Sally Cripps

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

在现代世界中,计算机越来越多地被要求做出影响人类生活的决策,从批准贷款到诊断疾病。这些系统通常被称为“黑盒模型”,它们之所以强大,是因为能够从海量数据中发现复杂的模式,但它们也是不透明的。它们可以告诉我们答案,却很少解释是如何得出结论的。为了信任这些系统,科学家和政策制定者需要了解计算机在做出决策时究竟依赖了哪些特定的信息。这就是特征选择(feature selection)领域:即识别数据集中最重要变量的艺术。早期的研究方法寻找的是在整个人群中都至一个重要的特征,而一种更近期的、更必要的方法则侧重于个体案例。对于一个患者而言重要的特征,对另一位患者可能并不重要,正如一个特定的症状对一个人来说可能预示着心脏病发作,而对另一个人来说可能只是焦虑的征兆。挑战在于建立一种系统,能够为每一个个体动态地决定哪些事实是真正相关的,同时又不损失准确性或让自己陷入自我欺骗。

悉尼科技大学的研究人员开发了一种名为 Hide&Seek 的新方法来解决这个问题。他们的工作针对了以往教导计算机如何解释自身决策时发现的一个微妙但关键的缺陷。在早期的系统中,计算机试图通过暂时移除输入中的某些信息片段来解释决策,就像遮住照片的一部分来观察图像是否依然有意义一样。如果计算机在某个信息片段被遮盖后仍能正确猜出结果,那么该片段就被视为不重要的。然而,研究人员发现,这些系统往往会学会利用“遮盖”本身的特定模式。例如,如果一个数据在被视为不重要时总是被替换为零,计算机就会学到看到零就意味着某种特定类型的情况,从而有效地将数据的缺失作为一种秘密代码来做出预测。这意味着系统并非真的在识别重要的特征,而是在记忆它自己游戏的规则。

为了修复这个问题,Hide&Seek 团队重新设计了计算机处理缺失信息的方式。他们不再用固定的值(如零)来替换被移除的特征,而是用从该数据的自然分布中随机抽取的数值来替换。想象一个预测房价的系统。如果它移除了“卧室数量”这一特征,以前的方法可能会将其替换为零,这是一个明显的信号,表明数据缺失。然而,Hide&Seek 会用一个看起来像是现实生活中合理的卧室数量的随机数来替换它。这使得计算机无法区分真实卧室数量与被替换后的数量,迫使其只能依赖于它所选择保留的特征。这种方法防止了系统利用数据缺口作为捷径。

研究人员还引入了一种随时间改变计算机优先级的训练策略。在学习过程开始时,系统被告知要完全专注于获得正确的预测,即使使用许多特征也在所不惜。随着训练的进行,系统会被逐渐鼓励使用更少的特征,从而学习变得更加高效和精准。这种两阶段方法有助于计算机避免陷入依赖过多不必要细节的糟糕方案中。其结果是,该模型的训练速度比前代模型更快,且在识别决策的真实驱动因素方面也更加准确。

在各种场景下的测试中——从旨在欺骗系统的合成数据到现实世界的信用卡记录和医疗数据——Hide&Seek 的表现始终优于现有方法。在涉及“开关”特征(即变量的规则会根据其数值而改变,例如温度决定商店是卖热巧克力还是冰茶)的实验中,旧的方法大约有一半的时间无法识别出该开关的重要性。它们被缺失数据的模式所迷惑。相比之下,Hide&Seek 几乎每次都能正确识别这些关键的开关。当处理高度相关的数据(即许多变量同步变化的情况,这种情况常令其他算法感到困惑)时,该系统也表现出了鲁棒性。在对手写数字图像的测试中,该方法成功地突出了区分“3”和“8”的具体笔画,而其他方法产生的结果则是零散且不一致的。

这项工作的意义不仅在于开发更好的算法。通过确保这些系统提供的解释是真实的,而非源于隐藏的捷径,Hide&Seek 为窥视黑盒内部提供了一种更可靠的方式。这在医学和金融等领域至关重要,因为在这些领域,理解决策背后的“为什么”与决策本身同样重要。研究人员证明,通过改变学习过程中隐藏信息的方式,他们可以防止计算机学会“钻空子”。这使得人类决策者与他们所依赖的人工智能工具之间能够进行更诚实、更透明的互动,确保预测的原因是基于实际数据,而非基于用于分析它的方法的产物。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →