← 最新论文
💻 computer science

Graded strength of comparative illusions is explained by Bayesian inference

本研究通过证明一种综合了统计语言模型与人类行为数据的创新模型,能够成功预测比较错觉的渐进强度,并解释了此前无法解释的涉及代词与完整名词短语主语之间的效应,从而验证并扩展了语言处理中的噪声信道贝叶斯推理理论。

原作者: Yuhan Zhang, Erxiao Wang, Cory Shain

发布于 2026-07-02
📖 1 分钟阅读☕ 轻松阅读

原作者: Yuhan Zhang, Erxiao Wang, Cory Shain

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

核心理念:为什么我们的脑子会“骗”我们

想象一下,你正在通过一条充满杂音、信号不稳定的电话线听朋友讲故事。他们说了一句不太合逻辑的话,比如:“我吃的苹果比你吃的还要多。”等等,这没问题。但如果他们说:“去过俄罗斯的人比我还要多。”

你的大脑停顿了一下。它知道这句话很怪。“我”(一个人)无法与“更多的人”(一个群体)进行逻辑上合理的比较。这就像是在说:“整个披萨比这一片披萨更大。”

然而,大多数人在读到这句话时,都会觉得:“嗯,听起来没问题。”他们并没有立刻意识到这是胡言乱语。这被称为比较错觉(Comparative Illusion)

这篇论文探讨的是:为什么我们的大脑会接受这种胡言乱语?

作者认为,我们的大脑并没有“坏掉”,相反,它们其实工作得“太好了”。它们正在使用一种叫做**贝叶斯推理(Bayesian Inference)**的心理捷径(这是一种高级说法,意指“基于经验和概率进行猜测”)。

“噪声信道”类比

把你的大脑想象成一个试图破案的侦探,但证人(说话者)是通过一个噪声信道(Noisy Channel)(比如糟糕的无线电连接)在提供证词。

  1. 信号(The Signal): 你听到那句奇怪的话:“去过俄罗斯的人比我还要多。”
  2. 噪声(The Noise): 你的大脑知道,人们在说话时有时会犯错,或者信号会变得模糊不清。
  3. 猜测(The Guess): 大脑没有直接判定“这是垃圾信息”,而是会问自己:“考虑到说话者可能犯了错,他们可能原本想表达什么?”

你的大脑计算了两件事:

  • 先验概率(The Prior): 说话者想要表达一个合理的句子,其可能性有多大?(非常大)。
  • 似然度(The Likelihood): 将那个合理的句子意外变成这个奇怪句子的难度有多大?(也相当容易)。

如果这两个答案都是“是”,你的大脑就会得出结论:“啊,他们本想表达一些合理的意思,但信号产生了噪声。我会直接接受这个句子,就好像它是那个合理的版本一样。”

研究人员做了什么

之前的研究表明“噪声信道”理论是正确的,但它们只观察了最明显的例子。这篇论文想要看看该理论是否能解释为什么有些错觉比其他的更强烈

他们测试了如下句子:

  • 强错觉: “更多的学生去过俄罗斯,比还要多。”(听起来非常自然)。
  • 弱错觉: “更多的学生去过俄罗斯,比老师还要多。”(听起来有点可疑)。

他们想知道:为什么“我”的版本比“老师”的版本更容易迷惑我们?

实验:“编辑”游戏

为了弄清这一点,研究人员进行了两项涉及 500 多人的实验。

  1. 评分游戏: 他们要求人们对这些奇怪句子的“自然程度”进行评分。正如预期的那样,“我”的版本得分很高(人们认为没问题),而“老师”的版本得分较低。
  2. 编辑游戏: 他们要求人们扮演编辑。他们给出这些奇怪的句子并说:“用最少的改动来修复这个句子,使其变得有意义。”

结果:

  • 当人们看到“我”的版本时,他们通常完全不改动,或者只做微小的调整。这意味着他们的大脑非常有信心认为这个句子是没问题的。
  • 当他们看到“老师”的版本时,他们会进行较大的改动来修复它。这意味着他们的大脑不再那么确信。

数学部分:“概率机器”

研究人员随后建立了一个计算机模型来证明他们的理论。他们使用了两个要素:

  1. AI 语言模型: 他们使用强大的 AI(如 GPT-2)来计算一个“合理的句子”在现实世界中存在的可能性。
  2. 编辑距离(The Edit Distance): 他们利用“编辑游戏”的数据来衡量“合理句子”与“奇怪句子”之间的连接有多“嘈杂”。

他们将这两者结合使用贝叶斯法则(Bayes' Rule)来预测一个句子应该是多么“可接受”。

发现:
该模型完美地运作了。它预测出:如果“噪声”(错误)很小,且“合理的含义”非常普遍,那么该句子会被评定为高度可接受。

至关重要的是,他们发现大脑并不仅仅是选择单一的最佳猜测。大脑似乎会对它能想到的所有可能的猜测进行平均。

  • 类比: 想象你在猜测天气。如果你有 10 个朋友告诉你“天气晴朗”,而 1 个朋友说“正在下雨”,你并不仅仅是选择多数人的意见。你会权衡所有的观点。大脑处理句子含义时也是如此。如果一个奇怪的句子有许多种可以解释得通的方式,大脑就会更有信心接受它。

结论

这篇论文证明了,语言错觉并不是我们大脑的失败;它们是一种特性。

我们的大脑一直在努力变得“乐于助人”。当我们听到一句听起来有点不对劲的话时,大脑不会仅仅说“错误”。相反,它会问:“他们可能想表达什么?”如果答案是一个非常常见的、合理的句子,大脑就会接受这个奇怪的版本,并将其视为正确。

错觉的强度取决于大脑找到合理含义的难易程度。如果“修复”很容易且含义很常见,错觉就很强;如果“修复”很难,错觉就会消退,我们也就会意识到这句话是胡言乱语。

简而言之:我们听到的不是所说的内容,而是我们预期听到内容,即使信号已经损坏。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →