← 最新论文
🤖 machine learning

Scaling Laws of Global Weather Models

本文分析了全球天气模型中的经验缩放法则,揭示了通过优先考虑更宽的架构和更大的训练数据集,而非更深的模型或更高的参数量,可以实现性能最大化,且在固定预算下,计算最优策略倾向于数据扩张。

原作者: Yuejiang Yu, Langwen Huang, Alexandru Calotoiu, Torsten Hoefler

发布于 2026-06-11
📖 1 分钟阅读☕ 轻松阅读

原作者: Yuejiang Yu, Langwen Huang, Alexandru Calotoiu, Torsten Hoefler

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,你正在试图教一台计算机预测天气。几十年来,科学家们一直使用复杂的物理方程来模拟大气层,就像运行一个巨大的虚拟风洞。但最近,一种新的方法出现了:不再使用物理学,而是使用“数据驱动”模型。这些模型就像是超级聪明的学生,通过阅读数百万页的历史天气报告来学习如何预测天气。

这篇论文就是这些“学生”的学习指南。研究人员提出了这样一个问题:“如果我们给这些研究天气的计算机更多的脑力(参数)、更多的教科书(数据)或更多的学习时间(计算量),它们到底能变得多强?”

他们测试了五种不同的“学生”(模型分别命名为 Aurora、GraphCast、Pangu、SFNO 和 AIFS),以观察它们如何进行规模化扩展。以下是他们的发现,用简单的语言进行了解释:

1. “更多数据”法则:Aurora 是最好的读者

在语言模型(如编写文章的模型)的世界里,增加更多数据会有帮助,但存在极限。研究人员发现,对于天气模型来说,更多的数据是一种超能力,但有些模型比其他模型更擅长阅读。

  • 类比: 想象两个正在参加考试的学生。一个(GraphCast)非常聪明,但只读了几本书。另一个(Aurora)是一个贪婪的读者。
  • 发现: 当他们将训练数据的量增加 10 倍时,Aurora 的预测能力提升了巨大 amount(高达 3.2 倍)。它是将原始数据转化为天气知识效率最高的模型。其他模型也有所进步,但没有那么显著。

2. “大脑容量”法则:GraphCast 是高效的天才

研究人员还观察了每个模型为了变得优秀需要多少“脑力”(参数)。

  • 类比: 把模型大小想象成图书馆的大小。GraphCast 就像一个微型图书馆,却不知为何掌握了它需要知道的一切知识。它极其高效;它不需要一座宏大的建筑来储存知识。
  • 发现: GraphCast 是最“参数高效”的。它能以相对较小的模型规模取得出色的结果。然而,这里有一个陷阱:虽然它很聪明,但由于其处理信息的方式(就像一个思考非常深入但动作缓慢的天才),它在计算机上运行起来很慢。

3. “形状”的惊喜:宽而浅更好

这是最大的惊喜。在语言模型(如聊天机器人)的世界里,让模型变得更“深”(增加更多的思考层)通常会有所帮助。但对于天气预报,深度不如宽度重要。

  • 类比: 想象建造一座房子。
    • 深: 建造一座有 50 层楼的摩天大楼,但每层只有一个房间。
    • 宽: 建造一座只有 2 层楼、但每层有 50 个房间的平房。
  • 发现: 对于天气预测,宽阔的房子胜出。研究人员发现,拥有更多“宽度”(同时进行的更多处理能力)的模型比拥有更多“深度”(更长的思考链)的模型表现更好。即使是只有一两层“思考”的模型,表现也出奇地好。事实证明,预测未来 6 小时的天气,更多在于拥有对全局的广泛视野,而不是进行许多细小的、深度的步骤。

4. “预算”策略:让它们学得更久,而不只是变得更大

如果你有一笔固定的资金(或计算能力)可以支配,你应该如何分配?是买一个更大的大脑(更多参数),还是买更多的教科书(更多数据)?

  • 类比: 你有一笔给学生的预算。你是雇佣一位更大的教授(更大的模型),还是让现有的教授在图书馆里学习更多的年份(更多数据)?
  • 发现: 论文指出,给它们更多的数据并让它们学得更久。 在固定预算下,训练一个在海量数据上学习的稍小模型,要比在少量数据上训练一个巨大的模型更好。天气模型的“甜点位”是优先考虑数据量而非模型大小。

5. 并非所有变量都是平等的

研究人员还注意到,模型在不同事物上的进步速度并不一致。

  • 类比: 想象一个数学极好但历史很差的学生。
  • 发现: 一些天气变量(如风速)的改善情况与其他变量(如温度)不同。一个模型可能在预测风速方面表现出色,但在预测温度方面仅表现“尚可”。这意味着你不能只看一个总分;你必须检查模型如何处理每一个具体的组成部分。

6. “硬件”现实检查

最后,论文观察了这些模型在真实计算机上运行得如何。

  • 类比: 法拉利引擎(GraphCast)可能动力十足,但如果它被困在交通堵塞中(硬件使用效率低下),它就不会跑得快。一辆可靠的卡车(Aurora)可能不是法拉利,但它行驶顺畅且能高效利用道路。
  • 发现: Aurora 在使用计算机硬件方面极其高效(使用了 GraphCast 约 36 倍的计算机潜力)。GraphCast 虽然聪明,但在使用计算机资源方面非常浪费。这表明,对于实际应用,一个在硬件上“高效”的模型与一个“聪明”的模型同样重要。

总结

如果你想根据这篇论文构建最好的天气预报器:

  1. 宽而浅,而非深而窄: 构建宽阔和平坦的模型,而不是高而窄的模型。
  2. 喂养数据: 优先考虑给模型提供更多的训练数据,而不是把模型本身做大。
  3. 挑选你的冠军: Aurora 擅长从数据中学习并高效利用计算机能力。GraphCast 擅长保持大脑尺寸的小巧与高效,但它在计算机上运行缓慢。
  4. 关注细节: 不要只看平均分;要检查模型如何处理风或温度等特定事物,因为它们的行为方式不同。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →