← 最新论文
💬 NLP

Counting as a minimal probe of language model reliability

本文表明,尽管大型语言模型在标准基准测试中表现强劲,但它们缺乏可靠的规则遵循所需的通用逻辑能力,证据在于其无法超越有限的内部状态进行计数,这种状态仅模仿手指计数而非真正程序化执行。

原作者: Tianxiang Dai, Jonathan Fan

发布于 2026-05-05
📖 1 分钟阅读☕ 轻松阅读

原作者: Tianxiang Dai, Jonathan Fan

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

以下是论文《计数作为语言模型可靠性的最小探测》的解释,将其拆解为简单概念并辅以富有创意的类比。

核心思想:“数手指”测试

想象你有一个非常聪明的机器人,它能写诗、调试复杂代码,并回答高难度的科学问题。你问它:“这个篮子里有多少个苹果?”它回答正确。你换了一个更大的篮子再问,它依然答对。

但如果你让它数10,000个苹果呢?或者100,000个呢?

这篇论文提出了一个非常简单的问题:这些 AI 模型真的“知道”如何计数,还是仅仅在根据以往见过的模式进行猜测?

为了找出答案,研究人员设计了一项名为**稳定计数能力(Stable Counting Capacity, SCC)**的测试。他们剥离了所有“聪明”的内容(如数学、历史或编程),只让模型去数长列表中的相同项目(例如字母"a")。

主要发现:“手指”的极限

研究人员发现,他们测试的每一个 AI 模型在计数长列表时都会失败,尽管这些模型被宣传为能够处理海量文本。

以下是关于 AI 内部发生情况的类比:

  • “手指”类比:想象 AI 试图通过举起手指来计数。它拥有有限数量的手指(内部状态)。只要项目数量少于手指数量,它就能完美计数。
  • 崩溃:一旦列表长度超过其“手指”数量,模型不仅仅是犯一个小错误(比如把 100 说成 101)。相反,它完全放弃了。它停止计数,开始随机猜测像 500、1,000 或 2,000 这样的整数。这就好比模型用光了手指,扔掉了计数棒,开始向数字靶板乱掷飞镖。

关键发现(通俗版)

1. “魔法”上下文窗口是个谎言
AI 公司声称他们的模型可以阅读“长上下文”(巨大的文档)。论文表明,虽然模型可以阅读长文档,但它无法追踪其中的简单规则。

  • 类比:这就像一个学生能读完一本 500 页的书,但当被问到“单词'the'出现了多少次?”时,他却一无所知。他能处理文本,但无法在脑海中保持一个简单的变量。

2. 更多的思考时间无济于事
研究人员尝试给模型更多的思考时间(测试时计算)或要求它们“逐步思考”(思维链)。

  • 结果:无效。如果模型内部的“手指”用光了,让它更努力地思考只会让它生成听起来更自信的胡言乱语。它无法重建它丢失的计数。

3. “手指”特定于文本的外观
研究人员改变了被计数的项目(例如,从字母"a"改为字母"b"或不同的符号)。

  • 结果:模型的计数极限发生了变化。这证明模型并没有使用通用的“数学大脑”。相反,它使用的是针对特定符号的特定学习路径。如果你改变符号,“手指”就会感到困惑。

4. “突然跌落”
失败并非渐进的。模型在达到某个点之前(比如 72 个项目)都能完美计数,然后瞬间崩溃。

  • 类比:这不像汽车燃油耗尽而减速。这更像是一个灯泡,在灯丝断裂的那一秒钟之前工作完美,随后完全熄灭。

5. 为什么当前的测试忽略了这一点
标准测试(如数学考试或编程挑战)过于复杂。

  • 类比:如果你想知道汽车引擎是否可靠,你不仅仅是在赛道上驾驶它(那里的空气动力学和速度可能会掩盖活塞故障)。你需要运行一个简单、枯燥的测试,比如在升降机上旋转车轮。论文认为,当前的 AI 基准测试就是那条“赛道”,掩盖了“引擎”(遵循简单规则的能力)已损坏的事实。

这对未来的意义(根据论文)

论文得出结论,当前的 AI 模型是脆弱的。它们可以模仿遵循规则一段时间,但它们没有可靠的内部机制来在长时间内追踪变量。

  • 问题:如果你要求 AI 规划一个包含 50 个步骤的复杂项目,它可能会正确完成前 10 步,但到了第 50 步,它很可能已经“数错了”约束条件,只是在猜测什么听起来不错。
  • 解决方案:作者建议,要解决这个问题,我们不能仅仅让模型变得更大或给它们更多思考时间。我们需要改变它们的架构,加入诸如显式记忆持久变量(像真正的笔记本或计数器)之类的东西,这些不依赖于模型脆弱的内部“手指”。

总结

论文揭示,尽管大型语言模型在复杂任务上表现出色,但它们在简单、精确的计数方面从根本上是糟糕的。它们依赖有限数量的内部“状态”(像手指)来追踪信息。一旦达到该限制,它们就会停止遵循规则并开始猜测。这表明它们当前的“智能”是一种脆弱的幻觉,当被要求在长时间内维持简单规则时就会瓦解。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →