← 最新论文
💬 NLP

Surprisal Minimisation over Goal-directed Alternatives Predicts Production Choice in Dialogue

本文表明,将话语生成建模为对语言模型生成的目标导向替代方案的概率性成本敏感选择,揭示出相对于这些替代方案的惊讶度最小化是对话中说话者选择的最强预测因子,其表现优于均匀信息密度和基于长度的成本。

原作者: Tom Utting, Mario Giulianelli, Arabella Sinclair

发布于 2026-05-04
📖 1 分钟阅读☕ 轻松阅读

原作者: Tom Utting, Mario Giulianelli, Arabella Sinclair

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象你正在参加一场晚宴,需要补全朋友说了一半的句子。你有一个想要表达的具体观点(你的目标),但你也知道朋友正在倾听并试图理解你。

这篇论文就像一部侦探小说,调查我们如何选择确切的词语来完成那个句子。作者想要解开一个谜团:当我们说话时,我们是在试图让自己的工作更轻松,还是在试图让听众的工作更轻松?

为了解开这个谜团,他们使用了一个巧妙的技巧,涉及两个不同的“选项列表”(alternatives)和一个数字大脑(大型语言模型)。

两个选项列表

研究人员意识到,要理解我们为何选择某些词语,就必须知道我们本来可以选择哪些其他词语。他们创建了两类列表:

  1. “相同目标”列表(目标导向型): 想象你想说:“会议是一场灾难。”

    • 选项 A: “会议是一场灾难。”
    • 选项 B: “会议简直是一场彻底的浩劫。”
    • 选项 C: “会议进行得糟透了。”
    • 所有这些选项表达的意思完全相同。它们只是表达同一件事的不同方式。这个列表代表了说话者在仅仅试图传达其特定信息时所拥有的选择。
  2. “随意发挥”列表(目标无关型): 现在,想象听众还不知道你将要说什么。他们只是根据目前的对话进行猜测。

    • 选项 A: “会议是一场灾难。”
    • 选项 B: “会议被重新安排了。”
    • 选项 C: “会议被取消了。”
    • 选项 D: “会议很有趣。”
    • 这个列表代表了无论你的实际意图如何,听众可能预期听到的所有内容。

四种“成本”衡量标准

这篇论文测试了关于什么使一个句子变得“昂贵”或“难以”产生的四种不同观点。可以将这些视为衡量努力程度的不同方式:

  • 惊讶度(“意外”因素): 这个词有多出乎意料?如果你说“会议是……"然后接着说“灾难”,这并不太令人惊讶。如果你说“会议是……菠萝”,那就会让人非常惊讶。高惊讶度对大脑处理来说是“昂贵”的。
  • 均匀信息密度(“流畅度”因素): 词语是否流畅均匀,还是先出现一堆难词随后又是简单的词?说话者通常偏好平稳、稳定的节奏。
  • 长度(“简洁”因素): 通常较短比较长更容易。
  • 全局均匀性: 类似于流畅度,但是着眼于整个句子。

实验:谁是主导者?

研究人员利用超级智能 AI(GPT-4)为真实的人类对话生成了成千上万个这样的“相同目标”和“随意发挥”列表。然后,他们将人类实际所说的内容与 AI 的列表进行了比较。

他们问道:人类是否根据这些规则选择了成本最低的选项?

以下是他们的发现:

1. “说话者”规则胜出(惊讶度):
当查看“相同目标”列表时,人类压倒性地选择了惊讶度最低的选项。

  • 类比: 想象你开车去上班(你的目标)。你有三条路线都能到达那里。你总是选择交通最少(惊讶度最低)的那一条。
  • 结论: 当我们确切知道想说什么时,我们会选择对我们自己来说最容易产生的词语。我们坚持走最常见、最可预测的路径。这表明惊讶度是一种说话者侧的成本

2. “听众”规则较弱:
当查看“随意发挥”列表时,结果参差不齐。

  • 人类并没有一致地选择最“流畅”或最短的选项来帮助听众。
  • 事实上,对于某些衡量标准,人类有时选择了比 AI 认为他们应该选择的更令人惊讶或更长的选项。
  • 结论: 虽然我们关心听众,但我们为了自己的目标而选择最自然、低惊讶度词语的驱动力,远强于我们为听众平滑信息流的驱动力。

主要启示

这篇论文认为,你不能只说“说话者最小化成本”。你必须问:“为谁最小化成本,以及针对哪些选项?”

  • 如果你查看所有表达相同意思的选项(目标导向型),说话者就像高效的司机,选择最流畅、最可预测的路线(低惊讶度)。
  • 如果你查看所有完全改变含义的选项(目标无关型),规则就会变得混乱。

简单来说: 当我们说话时,我们主要通过选择最熟悉的词语来表达特定想法,从而让自己轻松。我们并不是不断地重组句子以使其对听众来说完美流畅,至少不像以前的理论所建议的那样频繁。我们是司机,我们选择通往目的地阻力最小的路径。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →