← 最新论文
🤖 machine learning

NeST: Neighborhood-aware semantic alignment and temporal modulation for LLM based time series forecasting

本文提出了 NeST,这是一个通过生成邻域感知文本原型、通过对比学习将其与时间表示对齐、并应用原型调节的时间调制来实现卓越性能和跨多样化基准及真实任务泛化能力的创新框架,从而增强了基于大语言模型(LLM)的时间序列预测。

原作者: Jayanie Bogahawatte, Sachith Seneviratne, Maneesha Perera, Saman Halgamuge

发布于 2026-08-25
📖 1 分钟阅读☕ 轻松阅读

原作者: Jayanie Bogahawatte, Sachith Seneviratne, Maneesha Perera, Saman Halgamuge

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

预测随时间变化的数字的未来,是一项塑造我们如何为城市供电、管理财务以及应对天气变化的任务。几十年来,科学家们一直依赖专门的数学工具来预测这些被称为“时间序列”的模式。当数据表现出可预测的行为时,这些工具运作良好,但当模式变得复杂、混乱,或者学习数据极少时,它们往往会显得力不从心。近年来,一种被称为“大语言模型”的新型人工智能出现了。这些模型最初旨在理解人类语言,它们在识别单词序列中的模式方面表现得极其出色。由于时间序列数据也是一种序列,研究人员开始尝试教导这些语言模型去预测数字而非句子。挑战在于,如何弥合语言模型所熟知的离散、截然不同的单词与现实世界中如用电量或温度这类平滑、连续的数据流之间的鸿 meant 鸿沟。

墨尔本大学的一个研究小组开发了一种名为 NeST 的新方法来解决这个问题。他们的研究重点在于如何最好地将语言模型对单词的理解转化为对时间的理解。NeST 并没有强迫模型仅仅将数字列表视为单词来读取,也没有使用需要大量计算能力的笨重技术,而是创建了一组“文本原型”。可以将这些原型想象成精心挑选的代表性锚点,它们捕捉了语言模型庞大词汇表中的局部意义领域。研究人员训练该系统以确保这些锚点始终忠于语言模型知识的原始结构,而不是漂移到模型无法真正理解的区域。

一旦建立了这些文本锚点,系统就会将其与需要预测的实际时间序列数据进行对齐。它通过寻找数据与文本锚点之间的最接近匹配来实现这一点,从而确保语言模型的语义知识与数字中的特定模式直接相关。至关重要的是,NeСТ 并没有将文本和数字以可能干扰模型内部时序的方式混合在一起,而是利用文本锚点来温和地调整数据。它缩放并偏移数值特征,使语言模型能够在不破坏时间序列自然节奏的情况下,应用其学到的智慧。这一过程非常高效,仅需对模型的极小部分设置进行更改,即可保持其庞大知识库的完整。

这种新方法的测试结果稳健且一致。在针对长期预测的标准基准测试(如预测电力需求或交通流量)中,NeST 的表现优于目前的最佳方法,将预测误差平均降低了 1.2%。这看起来可能是一个很小的数字,但在预测领域,即使是微小的改进也能带来显著的成本节约和更好的决策。该方法在数据匮乏的情况下也表现得异常有效。在模型只能从极少量可用数据中学习,或者必须预测从未见过的全新类型数据的情况下,NeST 依然保持了高准确度,与其它方法相比,其误差减少了近 5%。

除了标准测试外,研究人员还将 NeST 应用于一个现实世界的挑战:预测分布式太阳能电池板的功率输出。太阳能发电的预测极其困难,因为它取决于波动的天气条件,并且因地理位置而异。该系统在来自不同地理区域的九个太阳能站数据集上进行了测试。在每种情况下,NeST 都提供了最佳的整体性能,与专门为太阳能设计的现有方法相比,其预测准确度平均提高了 3.3%。这表明该框架不仅是一个理论上的改进,更是一个能够处理现实世界能源系统中混乱、多变特性的实用工具。

NeST 的成功在于它能够尊重语言与时间各自的独特本质。通过保留语言模型词汇中的几何关系,并利用它们在不强加僵化连接的前提下引导数值数据,研究人员创建了一个既灵活又精确的系统。他们工作的可视化结果显示,该方法使文本锚点牢牢扎根在语言模型知识的密集、有意义的区域内,不像以往的方法那样允许这些锚点漂移到空白或无关的空间。这种精细的对齐使得模型能够利用其对模式的深度理解来进行更好的预测,即使在数据存在噪声或不完整的情况下也是如此。

最终,这项工作证明了大语言模型可以有效地被改编用于时间序列预测,而不会丢失其核心优势。NeST 框架提供了一种将文本知识整合进数值预测的方法,这种方法既具有计算效率,又具有高度的准确性。随着世界产生更多数据并面临更复杂的预测挑战,这类方法提供了一条可靠的路径,证明了我们理解语言的工具也可以帮助我们理解物理世界的律动。研究结果表明,只要方法得当,文本与时间之间的鸿沟是可以被跨越的,这将为从能源管理到经济规划等领域的更准确预测带来希望。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →