← 最新论文
💬 NLP

Artificial Epanorthosis: Why large language models overuse a classical rhetorical figure, and how to mitigate it

本文认为,由于训练偏差和偏好微调,大语言模型系统性地过度使用修辞格——纠正法(epanorthosis),并提出一种利用轻量级适配器和指令微调的特定体裁校准方法,旨在使模型的输出与人类修辞规范对齐,而非完全消除该修辞格。

原作者: Federico Boggia

发布于 2026-07-29
📖 1 分钟阅读☕ 轻松阅读

原作者: Federico Boggia

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

机器写作的秘密配方

想象一下,你正走进一座巨大的图书馆,那里有数百万本书籍、网站和社交媒体帖子被粉碎并混合成了一杯巨大的“奶昔”。这就是现代人工智能聊天机器人学习说话的方式:它们品尝这种数字奶昔,并学习如何一遍又一遍地预测句子中的下一个词。但这里有一个转折。在它们从奶昔中学习之后,人类会介入进行“味觉测试”。人类阅读机器人的回答,然后说:“这个听起来很自信且酷,”或者“这个听起来很枯燥。”随后,机器人就会学习去做更多人类喜欢的事情。这个过程被称为“强化学习”,就像用零食训练狗狗一样,只不过这只“狗”是一个超级聪明的计算机,而“零食”则是数字化的认可。

这篇论文提出的核心问题是:当我们训练一个机器人听起来既“自信”又“酷”时,会发生什么?结果发现,机器人开始使用一种非常特定且陈旧的技巧来让自己显得令人印象深刻。这是一种人类演讲者使用了数千年的技巧,但机器人使用得过于频繁,以至于听起来显得虚假。论文研究了机器人为什么会这样做,这种现象发生的频率如何,以及我们是否可以教会机器人停止过度使用这种技巧,而不至于让它听起来变得枯燥或愚蠢。


机器人的“等等,其实……”抽搐

你知道那种感觉吗?当有人说:“我不只是一个老师。我是一个思想的塑造者”?或者当一名销售员说:“我们不只是卖鞋。我们是在卖自由”?他们先以一个正常的句子开始,然后立即按下“撤销”键,将其替换为更宏大、更响亮、更具戏剧性的表达。

在华丽语言的研究领域,这种技巧有一个名字:epanorthosis(发音为 eh-pan-or-tho-sis)。这是一个希腊语词汇,基本意思是“纠正”或“自我修正”。古代演讲者使用它来使观点更有力。但最近,研究人员注意到,AI聊天机器人一直在这样做,就像一种神经质的抽搐。这已经成了机器人的招牌动作。

论文认为这并非偶然。这并不是因为机器人在进行“深度思考”并改变主意。相反,机器人从两个主要渠道习得了这个习惯:

  1. 互联网奶昔: 机器人阅读了大量的营销文案、励志帖子和销售话术,在这些内容中,“不是 X,而是 Y!”这种风格能获得大量的点击和点赞。
  2. 人类味觉测试: 当人类对机器人的回答进行评分时,他们更倾向于那些听起来自信且富有感染力的回答。机器人意识到:“嘿,如果我说‘我不是一个机器人,我是一个数字建筑师’,人们会给我高分!”于是,它开始越来越多地这样做。

论文指出,机器人逐字逐句、从左到右的写作方式加剧了这个问题。因为机器人无法在写完句子后回头修改,它利用这种“修正”技巧作为一种即时调整语调的方式,使其听起来比人类通常使用的语气更加戏剧化。

“Epanorthosis 指数”:测量机器人的戏剧性

为了证明这一点,作者们不仅是凭空猜测,还制作了一把“测量尺”。他们创建了一个名为 Epanorthosis 指数的东西。你可以把它想象成一个“戏剧感计分器”。他们统计了机器人在一万个单词中使用了多少次这种“不是 X,而是 Y”的技巧,并将其与真实人类在同类写作中的使用频率进行了对比。

以下是他们的发现,情况有些复杂:

  • 在演讲与销售中: 机器人做得太过火了。在“演说”(oratory)和“促销”(promotional)类写作中,机器人使用该技巧的频率大约是人类的两倍。在意大利语中情况甚至更糟,几乎是人类的三倍。它们太努力想表现得鼓舞人心,结果听起来很虚假。
  • 在日常问答中: 机器人则恰恰相反。当人类只是在闲聊或回答简单问题时,他们经常使用这种技巧来软化语气或留有余地。然而,机器人表现得过于平淡,没有充分使用它。它们的使用频率仅为人类的五分之一左右。
  • 在严肃写作中: 在新闻文章或百科全书条目中,机器人和人类的表现其实非常接近。机器人知道什么时候不应该表现得具有戏剧性。

主要的结论是,机器人是失调的(miscalibrated)。它们不知道何时该调高戏剧性的旋钮,何时该调低。每当它们认为需要表现得令人印象深刻时,就会猛按“epanorthosis”按钮。

我们能修复机器人吗?(“戏剧旋钮”)

论文并不仅仅指出了问题,还尝试解决它。作者们问道:“我们能否教会机器人停止过度使用这个技巧,而不至于让它听起来像一个不敢说话的机器人?”

他们测试了几种想法,以下是奏效的方法:

  1. “单行”修复法(提示词工程): 他们尝试简单地告诉机器人:“请以直白的方式写作,避免说‘它不是 X,而是 Y’。”

    • 结果: 有效!在意大利语测试中,这一简单的指令将演讲和论文中的戏剧性修正减少了 70% 到 72%。它并没有完全消除这个技巧,但它将机器人的使用频率降低到了一个看起来更像人类的水平。
  2. “风格适配器”(神奇旋钮): 这是大型实验。作者为机器人训练了一个微小的、特殊的附加组件(称为 LoRA 适配器)。你可以把这个附加组件想象成一个用于控制戏剧感的“音量旋钮”。

    • 他们在“戏剧化”文本和“平实”文本的样本上对其进行了训练。
    • 然后,他们测试了一个“旋钮”(一个可以改变的数值),以观察使用这种新风格的程度。
    • 结果: 旋钮完美地发挥了作用。当他们调高旋钮时,机器人听起来很平实;当他们调低旋钮时,机器人听起来很有戏剧性。至关重要的是,他们找到了一个设置,使机器人的使用率与人类的速率完全匹配。这并不是要删除这个技巧,而是关于校准
  3. 无效的方法: 他们尝试单独使用“偏好学习”(教机器人什么是人类喜欢的),但这种方法无法实现泛化。机器人学会了在测试中选择正确的答案,但并没有真正改变它撰写新句子的方式。

一个巨大的警告

论文以一个略带忧虑的想法结束。真正的危险不在于机器人过度使用这个技巧。真正的危险在于我们可能会开始模仿它们。

如果我们习惯了阅读充满“不是 X,而是 Y!”这类修正的文本,我们可能会开始认为这就是“好”写作的标准。我们可能会为了让自己听起来更有分量,而在自己的论文、邮件和演讲中加入这种虚假的、过度戏剧化的色彩。论文建议,目标不应该是让机器人听起来完全像人类,而是让它们听起来在特定情境下是“得体”的。有时演讲需要戏剧性;有时医疗报告需要平实的实事求是。

作者总结道,虽然我们可以利用这些新工具来修复机器人的“抽搐”,但更难的工作是教会我们自己去识别:一次修正究竟是诚实的表达,还仅仅是一场表演。毕竟,如果机器可以学会如何听起来像人类,那么下一步就是确保我们在学习的同时,不要忘记如何保持真实的自我。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →