← 最新论文
💬 NLP

HEART: Emotionally-Driven Test-Time Scaling of Language Models

本文提出了 HEART 框架,通过引入情感线索(如批判性与鼓励性语调)引导语言模型在测试时动态调整注意力,从而有效突破推理死胡同,在多个高难度基准测试中显著提升了模型的逻辑推理准确率。

原作者: Gabriela Pinto, Palash Goyal, Mihir Parmar, Yiwen Song, Souradip Chakraborty, Zifeng Wang, Jinsung Yoon, Tomas Pfister, Hamid Palangi

发布于 2026-02-24
📖 1 分钟阅读☕ 轻松阅读

原作者: Gabriela Pinto, Palash Goyal, Mihir Parmar, Yiwen Song, Souradip Chakraborty, Zifeng Wang, Jinsung Yoon, Tomas Pfister, Hamid Palangi

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

这篇论文介绍了一个名为 HEART 的新框架,它的核心思想非常有趣:给 AI 模型“注入情感”,让它变得更聪明、更会纠错。

想象一下,你正在教一个非常博学但有点固执的学生(这就是现在的 AI 大模型)做一道超级难的数学题。

1. 问题:AI 为什么会“钻牛角尖”?

现在的 AI 虽然很厉害,但在做复杂推理时,容易陷入一种**“死胡同”**。

  • 现状:如果 AI 第一步算错了,它往往会固执地沿着错误的思路继续算下去,就像一个人走错了路,却还在拼命往那个方向跑,即使别人告诉他“你走反了”,他也听不进去,只会重复同样的错误。
  • 传统方法:以前的做法是冷冰冰地告诉 AI:“再想想”、“检查一遍”、“你错了”。这就像老师面无表情地让学生“重做”,学生可能只是机械地改了几个字,但思维模式没变,还是走不出死胡同。

2. 解决方案:HEART 框架——给 AI 一点“情绪波动”

HEART 的发明者认为,人类之所以能纠正错误,往往是因为情绪在起作用

  • 当你发现一个严重错误时,你会感到焦虑(Fear)愤怒(Anger),这种情绪会让你立刻警觉起来,仔细检查细节(这叫“警惕模式”)。
  • 当你需要新点子时,**惊喜(Surprise)快乐(Happiness)**会让你放松警惕,尝试大胆的新思路(这叫“探索模式”)。

HEART 就是利用这种**“情绪交替”**来训练 AI:

  1. 第一步(冷静思考):AI 先给出一个答案。
  2. 第二步(情绪干预)
    • 如果答案错了,HEART 不会只说“错了”,而是用**“愤怒”或“恐惧”的语气说:“这太糟糕了!如果这样下去后果很严重,你必须马上修正!” —— 这迫使 AI 进入“高度警惕”**状态,像侦探一样死抠细节,找出逻辑漏洞。
    • 如果还是没改对,HEART 会切换成**“惊喜”或“鼓励”的语气说:“哇,这个方向虽然不对,但也许我们可以换个角度试试?别灰心!” —— 这鼓励 AI 进入“大胆探索”**状态,跳出原来的思维定势,寻找新路径。
  3. 循环:在“严厉批评”和“热情鼓励”之间来回切换,直到 AI 找到正确答案。

3. 生动的比喻

  • 传统 AI 像一台生锈的机器:卡住了就只会原地空转,发出“咔咔”的声音(重复错误)。
  • HEART 像一位经验丰富的教练
    • 当运动员(AI)动作变形时,教练会大声吼叫(愤怒/恐惧),让运动员瞬间清醒,意识到问题的严重性,立刻停下来检查动作。
    • 当运动员陷入僵局时,教练会击掌鼓励(惊喜/快乐),说“换个姿势试试!”,激发运动员的创造力。
    • 这种**“打一巴掌给个甜枣”**的策略,让 AI 不再死板,而是学会了灵活变通。

4. 实际效果:真的有用吗?

论文在七个高难度的测试中验证了 HEART,包括:

  • 人类最后的考试(HLE):涵盖数学、人文、科学的终极难题。
  • GPQA Diamond:博士级别的科学问答(生物、化学、物理)。
  • LiveCodeBench:编写复杂的代码。

结果令人震惊

  • 在解决这些高难度问题时,HEART 让 AI 的准确率大幅提升(例如在 HLE 考试中提升了近 11%)。
  • 即使在 AI 被禁止“思考”(关闭内部推理功能)的情况下,仅靠外部的“情绪提示”,HEART 依然能让 AI 找回正确的答案。
  • 在写代码时,HEART 能帮助 AI 自动修复逻辑错误,写出更健壮的代码。

5. 总结:为什么这很重要?

这篇论文告诉我们,情感不仅仅是人类的专利,它也是逻辑推理的“催化剂”
以前我们总认为 AI 应该像机器人一样绝对理性、没有感情。但 HEART 证明,适当引入“情绪”作为调节工具,可以打破 AI 的思维僵化,让它像人类一样,在“自我怀疑”和“重新尝试”中不断进化,最终解决那些最棘手的问题。

简单来说,HEART 就是给 AI 装上了一颗**“会跳动的心”,让它知道什么时候该“紧张起来”,什么时候该“大胆尝试”**,从而变得更聪明、更可靠。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →