What Are LLMs Doing to Scientific Communication? Measuring Changes in Writing Practices and Reading Experience
本文通过分析 ACL 论文语料库和合成数据集,探讨大语言模型如何重塑自然语言处理领域的科学交流,揭示出语言风格正显著转向更复杂、更多样性降低的形态,这种形态虽被专家视为更易理解,却在主观上引发问题。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下,科学写作的领域就像一座巨大而繁忙的图书馆,研究人员在这里撰写书籍,以解释计算机如何理解语言。多年来,这些作者如同各自使用独家秘制香料的不同厨师,用独特的声音进行写作。但最近,一位全新且极其强大的厨房助手——大型语言模型(LLM),或称"AI 写手”——已经登场。
本文提出了一个简单的问题:这位新助手是否改变了图书馆中书籍的“风味”?
作者们如同语言的美食评论家,决定通过考察两方面内容来探究这一问题:一是收集在 AI 助手普及前后撰写的海量真实科学论文,二是进行一项受控实验,即选取旧段落并让 AI 对其进行“润色”。
以下是他们发现的要点,以简单的类比进行分解:
1. 词汇的转变:从“家常烹饪”到“精致摆盘”
研究人员注意到,科学家们使用的词汇发生了变化。
- 之前: 作者使用简单、直接的词汇,如“使用”、“好”或“展示”。
- 之后: 作者开始使用更华丽、更正式的词汇,如“利用”、“全面”和“阐明”。
类比: 想象一位厨师过去会说“我把盐放进汤里”,而现在他们却说“我已掺入氯化钠以增强风味轮廓”。AI 助手似乎正推动作者走向更“精致”的风格,用更复杂、听起来更昂贵的词汇替换简单的食材。
2. 语义的转变:收窄与拓宽
研究发现,某些词汇的使用变得更加具体,而另一些则变得更加宽泛。
- 专业化: “确保”一词现在更严格地用于表示“保证特定质量”,而此前其用法更为宽泛。
- 泛化: “利用”一词已成为“使用某物”的万能词,丧失了一些原有的细微差别。
类比: 想象一个工具箱。过去,锤子就只是锤子。现在,有些工具仅用于非常具体、精细的工作(专业化),而另一些工具则几乎可用于任何场合,变成了“万能”工具(泛化)。AI 似乎正在重新整理这个工具箱。
3. 风格的转变:"AI 润色”
当研究人员将人类撰写的文本与经 AI“改进”后的文本进行对比时,他们发现了 AI 风格的显著模式:
- 更长、更密集的词汇: AI 偏爱更长的词汇,并在更少的句子中浓缩更多含义。
- 多样性降低: AI 倾向于重复使用同一组“华丽”词汇,使得文本显得多样性稍欠,就像歌单不断循环播放那几首热门歌曲。
- 更“礼貌”的结构: AI 添加了更多的连接词和复杂的句子结构,使文本显得更加详尽且充满限定条件。
类比: 如果人类写作像是在咖啡馆里的随意交谈,那么经 AI 润色的写作则像是在盛大晚宴上的正式演讲。它更流畅、结构更严谨、用词更宏大,但可能让人觉得少了一些真人交谈的意味。
4. 读者的体验:“平稳的旅程”
最后,研究人员请 20 位专家(如同经验丰富的司机)阅读原始人类文本和经 AI 润色的文本。他们问道:“哪一个更清晰?哪一个感觉更可信?哪一个更令人兴奋?”
结果:
- 清晰度与兴奋感: 专家们普遍更喜欢经 AI 润色的文本。他们发现其阅读起来更流畅,且更“令人兴奋”。
- 信任度与真实性: 然而,专家们的意见存在分歧。有些人觉得 AI 文本缺乏“真实性”或可信度,感觉到其中可能有机器介入的痕迹。
类比: 这就像驾驶两辆不同的汽车。经 AI 润色的汽车(新文本)行驶更平稳,感觉更快(更令人兴奋),但有些司机觉得方向盘过于完美,不禁让人怀疑驾驶座上是否真的有人。
结论
该论文得出结论,AI 写作助手的兴起确实改变了科学写作的“风味”。文本变得更加复杂、正式和精致。虽然这使得许多人的阅读体验更轻松、更令人兴奋,但也带来了一种微妙的转变,即人类的声音显得略微不再那么独特。作者们并未测试这是否使科学本身变得“更好”或“更糟”,仅指出风格已经改变,且读者已经察觉到了这一点。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。