Detecting undisclosed LLM-generated content in parliamentary texts
本文提出了一种用于检测议会文本中未披露的 LLM 生成内容的具有可解释性的分类器,揭示了自 2022 年以来英国和瑞典此类用法在稳步增加。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一个繁忙的图书馆,英国和瑞典的政治家们在这里撰写演讲稿、动议和官方声明。多年来,这些文件完全由人类之手(或者至少是人类的大脑在键盘上敲击)书写。但最近,一个全新的、无形的幽灵开始在图书馆里游荡:这就是大语言模型(LLM),也就是驱动像 ChatGPT 这样的聊天机器人的同一种人工智能。
这篇论文就像是一组侦探,他们构建了一个特殊的“测谎仪”,旨在查明政治家们是否在未告知任何人的情况下,偷偷让这个 AI 幽灵来撰写他们的演讲稿。
以下是他们调查过程的简化版故事:
1. 谜团:沉默的幽灵
在许多职业中,比如新闻工作者或学生写论文,如果你使用了 AI,你应该举手说明:“我用机器人辅助了写作。”但在议会的世界里,规则是模糊的。并没有严格的法律强制要求政治家必须说:“嘿,我刚才请一位 AI 帮我起草了这份文件。”
研究人员担心,如果政治家们使用 AI 来撰写演讲稿却不承认,这可能会损害公众的信任。这就像一位厨师为你端上一道菜,却没告诉你这道菜其实是机器人做的,而那个机器人不小心在甜点里放了盐。
2. 侦探的工具:“玻璃盒”
为了抓住这个幽灵,研究人员没有使用那种给出答案却无法解释其原理的神秘“黑箱”机器,而是构建了一个**“玻璃盒”**分类器。
你可以把它想象成一个放大镜,它不仅仅是简单地判定“有罪”或“无罪”,它还能向你展示究竟是哪些词汇和句子结构引起了怀疑。
- 如何训练: 他们提取了 2022 年之前(当时 AI 还未流行)的旧演讲稿,因为这些稿件百分之百是人类创作的,所以他们掌握了“真人类”样本。接着,他们将这些演讲稿喂给 AI,并要求 AI 进行重写。现在,他们拥有了一个“人类”堆和一个“AI”堆。
- 训练过程: 他们教会了他们的“玻璃盒”如何识别两者之间细微的差异。他们发现,AI 的写作方式往往呈现出略微不同的模式——比如使用“United Kingdom”而不是“UK”,或者拥有非常特定的句子节奏。
3. 调查:检查近期文件
一旦侦探工具准备就绪,他们便将其投入到 2021 年至 2026 年间的新演讲稿中进行检测。他们从两个维度观察这些演讲稿:
- 整篇演讲稿: 整份文件闻起来是否有 AI 的味道?
- 段落层面: 演讲稿中是否仅有一个段落闻起来像是由 AI 写的?(也许政治家写了开头,但让 AI 写了中间部分)。
4. 发现:幽灵无处不在(且正在增长)
结果清晰且稳定:
- 趋势: 在英国和瑞典,这些文本中使用 AI 的比例自 2022 年以来一直在稳步上升。
- 数据: 到 2026 年,检测器发现英国约有 2% 的演讲稿以及瑞典约有 6.5% 的演讲稿很可能是完全由 AI 撰写的。
- “隐藏”的部分: 当他们观察单个段落时,数字甚至更高。在英国,超过 15% 的近期动议包含至少一个看起来像是 AI 撰写的段落。在瑞典,这一比例超过了 9%。
- 沉默: 最令人震惊的部分是:这些文本中没有任何一份承认使用了 AI。 没有一个文本说:“我们在这里使用了聊天机器人。”
5. 为什么这很重要(根据论文观点)
论文认为,这种缺乏诚实的行为是一个问题。
- 信任: 如果选民发现他们的政治家在不说明情况的前提下使用 AI 来撰写言论,这可能会让他们感到被背叛。
- 错误: AI 有时会编造事实(幻觉)或带有偏见。如果政治家在使用 AI 时没有仔细检查,他们可能会在无意中传播虚假信息或冒犯性的观点。
- “认知特洛伊木马”: 论文提到,依赖 AI 可能会让政治家停止进行批判性思考,让他们在不知不觉中让 AI 代替了思考的重任。
6. 结论
研究人员得出结论:虽然使用 AI 本身并不一定是“坏事”,但隐瞒使用行为是。 他们发现,政治家们越来越多地使用 AI 来撰写他们的官方文本,但他们并没有遵循那些暗示应当保持透明度的(通常是模糊的)准则。
他们建议,议会需要停止模棱两可,开始制定明确、严格的规则:“如果你使用了 AI,你必须说明。”否则,图书馆里的这个“幽灵”将继续在黑暗中撰写演讲稿。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。