Bayesian Symbolic Regression with Entropic Reinforcement Learning
本文介绍了 ERRLESS,一种可扩展的贝叶斯符号回归方法,该方法利用熵正则化强化学习从代数表达式的后验分布中进行采样,从而实现有效的确定性量化,并在 Feynman 等基准测试上产生具有竞争力的、可解释性的结果。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下你是一名试图破解谜题的侦探,但你寻找的不是失踪的人,而是试图找到解释世界运作方式的隐藏数学规则。这就是**符号回归(Symbolic Regression)**的工作。标准的数学工具就像是一个只能调整既有西装纽扣的裁缝(微调既定公式中的数字),而符号回归则像是一位大师级裁缝,能够从零开始发明全新的西装,将不同的面料(加法、正弦函数或平方根等数学运算)缝合在一起,以完美契合数据。
然而,现实世界的数据是杂乱无章的。它们充满噪声,就像充满了静电干扰的无线电信号;而且数据稀缺,就像试图仅凭三个音符就猜出整首歌的旋律。如果你只找到一个“最佳”公式,你可能会被这些静电干扰所蒙蔽。这正是**贝叶斯思维(Bayesian thinking)**发挥作用的地方。贝斯侦探不会只押注于一个答案,而是保留着一整个可能的理论库,并根据每个理论与线索的契合程度为其分配概率。这使得他们能够说:“我相当确定是这个公式,但也有很小的可能性是另一个,”这在数据稀缺时至关重要。长久以来的挑战在于:如何高效地在无限的可能公式库中进行搜索,从而找到正确的概率组合而不至于迷失方向?
于是,ERRLESS 登场了。这是由 Oussama Boussif 及其同事提出的一种新方法,它将这种搜索过程比作一场电子游戏。想象一个机器人正在学习搭建复杂的乐高结构,但它不仅仅是尝试搭建一座完美的塔,而是学习如何搭建许多不同的塔,并理解在给定线索的情况下,哪些塔最可能是“真实”的结构。研究人员将他们的这种方法称为 ERRLESS(基于熵正则化的强化学习进行表达式结构采样)。
以下是它在现实世界的数据中是如何运作的:团队训练了一个神经网络(一种人工智能)来充当“建造者”。这个建造者并不只是盲目猜测;它会逐步构建数学表达式,就像逐字逐句地组建句子一样。但有一个限制条件:建造者必须遵循严格的物理规则。正如你不能把“米”和“秒”相加来得到有意义的结果一样,AI 被编程为拒绝任何违反物理单位定律的数学组合。这是通过一种“自底向上”的方法实现的,即 AI 先构建小的、有效的部件,然后再将它们拼接在一起,确保每一步在移动之前都符合逻辑。
AI 通过**强化学习(Reinforcement Learning)进行学习,这就像是用零食训练狗狗。每当 AI 构建出一个符合数据的公式时,它就会得到一份“奖励”(即零食)。但巧妙之处在于:研究人员并不只是想让 AI 找到单一的最佳公式。他们希望 AI 能够探索整个“库”中的可能性。为此,他们使用了一种名为最大熵强化学习(Maximum-Entropy Reinforcement Learning)**的技术。你可以把它想象成告诉 AI:“不要只寻找一条最佳路径;要尽可能多地探索不同的路径,但要确保你更频繁地访问那些最有希望的路径。”这确保了 AI 不会困在某一个想法上,而是学会了理解所有可能公式的完整“地图”。
结果非常令人振奋。在 Feynman 符号回归数据库(由传奇物理学家理查德·费曼收集的 100 个物理公式组成的著名集合)上的测试中,ERRLESS 的表现与现有的顶尖方法不相上下。它能够找到短小、易读且准确度与其它算法发现的复杂公式同样高的公式。更重要的是,因为它捕捉到了不确定性(贝叶斯视角),它能更好地处理噪声数据。在数据稀缺且充满噪声的测试中,ERRLESS 生成的“后验预测均值”(一种所有最佳猜测的平均值)比领先的竞争对手 PySIPS 更准确。PySIPS 有时会被一些离谱且不太可能的猜测所误导,从而导致其平均值发生偏差,而 ERRLESS 则能让其猜测保持在合理的范围内,提供更可靠的预测。
该论文还强调,ERRLESS 的速度极快。不像其他方法必须反复停止并微调公式中的数字(这是一个缓慢且计算成本高昂的过程),ERRLESS 能够同时学会预测公式的结构以及其中的数值。这使得它比许多对手快了一个数量级。
然而,作者也谨慎地表示,这并不是解决所有问题的万灵药。他们指出,虽然 ERRLESS 在对可能答案的分布进行建模方面表现出色,但在处理极其复杂的靶向表达式时仍可能遇到困难。他们还提到,该方法依赖于一组特定的数学算子,未来的工作可能涉及教 AI 发明自己的算子,或者将这些思想应用于微分方程。
简而言之,这篇论文表明,通过将物理规则与智能的、具有探索性的 AI 训练方法相结合,我们可以构建出一个系统,它不仅能找到一个公式,而且能理解可能公式的全貌。这是向着让机器不再仅仅是处理数字,而是真正理解支配我们宇宙之法则的不确定性与美感的方向迈出的一步。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。