Uncertainty quantification design principles for machine learning interatomic potentials: lessons learned from hierarchical Bayesian inference
本文通过使用氩原子耦合簇数据对机器学习原子间势能的不确定性量化策略进行了基准测试,并提出了一种层次贝叶斯高斯过程设计,该设计有效地平衡了准确性、校准度和误差辨别能力,同时通过显式剖析不确定性来源,为可靠的应用提供了保障。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
在材料科学领域,研究人员经常尝试通过计算机模拟来预测原子的行为。几十年来,这些模拟一直依赖于经验法则或简化的物理学来描述原子之间的推力和拉力。虽然这些简化规则非常有用,但当科学家试图模拟复杂的新材料或极端条件时,这些规则往往会失效。为了解决这个问题,新一代工具应运而生:机器学习原子间势函数(machine learning interatomic potentials)。这些是基于高水平量子物理计算训练出的计算机程序,旨在直接从数据中学习原子相互作用的规律。它们极其快速且精确,充当了缓慢、精确的量子力学世界与快速、大规模的工程世界之间的桥梁。然而,一个主要问题仍然存在:这些程序往往过于自信。它们会做出预测并给出一个数值,但无法可靠地告诉你这个数值在多大程度上可能是错误的。在设计新电池或核材料等领域,了解预测何时具有不确定性,与预测本身一样重要。如果没有一种衡量这种怀疑度的方法,这些强大的工具就无法安全地用于关键决策。
这正是研究团队致力于解决的挑战。他们专注于一种特定的机器学习模型,该模型使用一种被称为高斯过程(Gaussian process)的统计框架。可以将这个框架想象成不是一套僵化的方程,而是一种灵活的学习方式,它能自然地追踪自己掌握了多少知识以及有多少是在猜测。研究人员希望看看他们是否可以构建一个系统,不仅能预测原子间的能量和力,还能提供一个诚实、可靠的自身不确定性度量。为了测试这一点,他们选择了氩气——一种相互作用非常简单的惰性气体——作为训练场。通过使用最精确的量子物理计算作为参考,他们可以准确观察到这种新方法的效果如何。
该团队开发了一种将已知物理学与统计学习相结合的高级方法。他们并没有从零开始,而是向计算机输入了一个关于氩原子如何相互作用的、基础且已被充分理解的描述。随后,机器学习模型仅学习为了使这一基础描述趋于完美所需要的微小修正。至关重要的是,他们并没有仅仅挑选出一组“最佳”的模型参数设置。相反,他们允许计算机探索广泛的可能设置,因为他们明白在数据有限的情况下,并不存在唯一的完美答案。这个过程被称为层次贝叶斯推断(hierarchical Bayesian inference),它让模型能够将关于自身设置的不确定性传递到最终的预测中。结果是一个能够承认自己在犹豫、而非假装比实际知道得更多的系统。
当研究人员将他们的新方法与其他流行的机器学习技术进行对比时,差异非常显著。其他方法(包括先进的神经网络)在平均值上表现得非常好。然而,它们表现出了危险的过度自信。当这些模型出错时,它们往往会给出一个很小的误差估计,暗示它们对错误答案非常有把握。相比之下,这种新的层次模型则显得更为保守,通常会预测一个更宽的结果范围。但这种谨慎并非缺陷,而是一种特性。该模型的误差估计是诚实的:当预测可能出现较大偏差时,模型会发出较大的不确定性信号;当预测可能准确时,不确定性则较小。这种区分简单情况与困难情况的能力对于主动学习(active learning)至规重要,在主动学习过程中,计算机需要决定下一步进行哪些实验。如果一个模型无法告诉你哪些预测是不可靠的,你就无法用它来高效地指导研究。
研究还表明,模型的学习方式至关重要。仅仅拥有大量数据是不够的;模型需要理解底层的物理学。当研究人员从模型中移除基础物理描述并要求它从头开始学习时,结果很差,尤其是在数据稀缺的情况下。通过用已知的物理定律来锚定模型,使得机器学习部分只需要学习微小的偏差,这让整个系统变得更加稳健。此外,他们发现仅仅选取单一的最佳参数设置是一个错误做法。虽然这种方法能提供略微更准确的点预测,但它破坏了模型表达自身不确定性的能力。获得可靠的怀疑度度量的唯一途径,是让模型探索许多不同的可能性并将它们平均化。
最后,研究人员证明了构建既精确又可靠的原子机器学习模型是可能的。通过将物理知识与尊重不确定性的统计方法相结合,他们创造了一个了解自身极限的工具。这是该领域迈出的重要一步。这表明在未来,科学家将能够使用这些强大的模拟,并清晰地了解哪些预测是可靠的,哪些是摇摆不定的。这种清晰度对于从简单的模拟转向设计现实世界中“失败绝不允许发生”的材料至关重要。这项工作表明,实现科学领域可靠人工智能的路径,不仅在于让模型变得更聪明,还在于教会它们对尚未知晓的事物保持谦逊。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。