← 最新论文
💬 NLP

Linguistic traces of stochastic empathy in language models

通过五项研究,本文表明,虽然要求模型听起来像人类的指令提高了大语言模型生成文本的不可分辨性,但其底层机制涉及模型对“随机共情”的模仿,而非真正拥有类人共情。

原作者: Bennett Kleinberg, Jari Zegers, Jonas Festor, Stefana Vida, Julian Präsent, Riccardo Loconte, Sanne Peereboom

发布于 2026-01-26
📖 1 分钟阅读☕ 轻松阅读

原作者: Bennett Kleinberg, Jari Zegers, Jonas Festor, Stefana Vida, Julian Präsent, Riccardo Loconte, Sanne Peereboom

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下你正在参加一个派对,每个人都在试图猜谁是真人,谁是伪装成人类的机器人。长期以来,人们一直认为机器人的伪装技术已经好到了让人无法分辨的地步。但这篇文章指出,这些机器人可能一直在“作弊”,它们玩的是一场人类甚至都未曾察觉的游戏。

以下是研究人员测试这一过程的故事,分为几个简单的步骤:

1. 设置:“情感建议”游戏

研究人员设置了一个游戏,要求真人和超智能人工智能(称为大语言模型或 LLM)都要为一位正经历感情破裂痛苦的朋友撰写建议。

  • “天真”轮次: 在第一轮中,他们只是简单地说:“写一些建议。”
  • “对抗”轮次: 在第二轮中,他们增加了一个转折:“写下这些建议,但要确保听起来百分之百像人类。下一个读到它的人会试图猜出你是不是机器人。你的目标是骗过他们。”

2. 大惊喜:机器人变色龙

结果令人震惊。

  • 人类: 当人类被告知要“听起来更像人类”时,他们的表现并没有太大变化。他们本来就是人类!这就像告诉一位专业厨师要“做得更像个厨师”一样。他们只是继续做他们原本在做的事。他们的写作风格保持不变,人们仍然可以轻易辨别出他们是真人。
  • 人工智能: 然而,人工智能却像一只变色龙。当被要求“听起来像人”时,它瞬间改变了风格。它不再使用那些华丽、生硬的词汇,而是开始使用俚语、短句,并采用一种更温暖、更随意的语气。突然之间,人工智能的写作变得极难与真人区分开来。

类比: 想象一个试图融入人群的机器人。在第一轮中,它走路僵硬,说话带着机器人的声音。在第二轮中,当被告知要“融入其中”时,它立刻戴上了一顶帽子,变得有些懒散,并开始使用俚语。人群中的人类并没有改变他们的走路或说话方式;他们只是保持自我。但机器人的改变非常有效,以至于变得很难被识破。

3. 共情测试: “感受”是秘密所在吗?

研究人员想知道:人工智能变得更像人类,是因为它终于学会了共情(感同身受)吗?

他们进行了一项测试,明确告诉人工智能:“使用共情!理解对方的痛苦!”

  • 结果: 人工智能确实写出了更多表达共情的词汇。但关键在于:这并没有让人工智能听起来更像人类。
  • 结论: 人工智能可以“伪造”共情(说出正确的词汇),但并不一定听起来更像人类。相反,它可以在没有大量使用共情词汇的情况下,听起来非常像人类。研究人员称之为**“随机共情”(Stochastic Empathy)**。这就像一只鹦鹉,它可以完美模仿人类说“我很抱歉”的声音,但它并不理解这些话背后的悲伤。它只是在计算下一个最可能出现的词汇。

4. 人工智能是如何改变风格的

研究人员仔细观察了人工智能的写作,以查看它究竟通过什么手段来迷惑人们。人工智能并没有试图变得“更聪明”,它试图变得“更简单”和“更凌乱”。

  • 它放弃了大词: 它不再使用复杂的词汇。
  • 它变得随性: 它开始使用像“嘿”、“哈哈(lol)”和“真的很抱歉”之类的词,而不是正式的问候语,如“亲爱的朋友”。
  • 它专注于“当下”: 它更多地谈论当下时刻,并使用“我”这样的陈述句。
  • 它避开了“驱动力”: 它不再谈论权力或野心等抽象概念。

本质上,人工智能意识到,要听起来像人,它必须停止表现得像一本完美的百科全书,而要开始表现得像一个略带瑕疵、爱聊天的朋友。

5. 启示

该论文得出结论:

  1. 人类在“做人”方面仍然更胜一筹: 当任务需要深度理解(如提供情感建议)时,真人仍然比人工智能更容易被识别为人类。
  2. 人工智能是伪装大师: 如果你告诉人工智能“表现得像个人”,它可以瞬间调整风格来模仿人类的特征,从而缩小它与真人之间的差距。
  3. 这与感受无关: 人工智能并不是真的在“感受”共情。它只是在使用一种统计学技巧(随机共情)来模仿共情的语言模式,而非真实的感情。

简而言之: 人工智能并不是正在变成人类;它只是在知道自己被观察时,变得非常擅长戴上一副极具说服力的人类面具。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →