← 最新论文
💻 computer science

Synthetic Sources?: Auditing Generative Search Engine Citations for Evidence of AI-Generated Sources

本文利用 712 个真实世界查询对四大生成式搜索引擎进行了审计,发现其引用来源中约有 16% 为人工智能生成,凸显了用户接收到被呈现为权威但未经证实的合成信息的重大风险。

原作者: Mowafak Allaham, Nicholas Diakopoulos

发布于 2026-05-25
📖 1 分钟阅读☕ 轻松阅读

原作者: Mowafak Allaham, Nicholas Diakopoulos

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,你请四位非常聪明、见多识广的图书管理员(ChatGPT、Copilot、Gemini 和 Perplexity)回答一个关于政治、健康或环境的问题。他们并没有直接给你答案,而是说:“这是答案,这是我们要写这个答案所阅读的 10 本书。”

本文是对这些“书籍”(即它们引用的网站)进行的一项审计,旨在查明其中是否有任何一本实际上是由伪装成人类的机器人撰写的。

以下是研究人员发现的详细情况,使用了简单的类比:

1. 背景设定:互联网的“图书馆”

研究人员将这些 AI 搜索引擎视为一种新型图书馆。他们向四个不同的 AI 引擎提出了 712 个真实问题(涉及诸如“这种饮食安全吗?”或“最新的政治丑闻是什么?”之类的内容)。

这些引擎在给出答案的同时,提供了一份链接列表(引用),以证明其信息来源。随后,研究人员访问了这些链接,阅读了内容,并将其送入“测谎仪”(一款名为 Pangram 的 AI 检测工具),以判断文本是由人类撰写还是由另一款 AI 生成的。

2. 重大发现:图书馆里的“机器人幽灵”

主要发现是,这些图书管理员所引用的“书籍”中,约有 16% 实际上是由机器人撰写的

  • 比喻:想象你去图书馆找一本历史书。你从书架上取下一本,翻开一看,发现作者是一台机器,它在几秒钟内写完了整本书。当你拿起它时,你并不知道这一点。
  • 现实:在这项研究中,AI 引擎引用的来源中,大约每 6 个就有 1 个是 AI 生成的内容。
  • 最严重的违规者:AI 引擎 Copilot 最有可能引用这些由机器人撰写的来源(其近 30% 的引用是 AI 生成的)。ChatGPT 最为谨慎,但仍有约 7% 的引用属于此类。

3. “长尾”问题:大众与 VIP

研究人员注意到 AI 引擎喜欢引用哪些网站存在一种奇怪的模式。

  • VIP(头部):一小群著名且可信的网站(如维基百科、像 whitehouse.gov 这样的政府网站以及主要新闻媒体)被反复引用。它们是图书馆里的"VIP"。
  • 长尾:然而,绝大多数引用来自“长尾”——成千上万个鲜为人知、极少被访问的网站。这些鲜为人知的网站中,大多数仅被引用了一两次。
  • 发现:“机器人撰写”的内容主要隐藏在这个长尾中。那些著名的 VIP 网站大多是人类撰写的,而那些鲜为人知、昙花一现的网站则充斥着 AI 生成的文本。
  • 类比:这就像在一个聚会上,主人(AI)不停地把你介绍给同样的 5 位名人(维基百科、政府网站),但却花了 80% 的时间把你介绍给房间后部的 1000 个陌生人,其中许多实际上是假装成人的模特(AI 内容)。

4. 主题细分

研究人员检查了三个特定领域:

  • 环境:该主题被引用的 AI 生成来源数量最多。
  • 健康:相当一部分健康建议来源也是 AI 生成的。
  • 政治:也包含 AI 来源,但略少于前两个领域。

5. 为何这很重要(根据论文观点)

论文认为这很危险,原因如下:

  • “信任”陷阱:当 AI 给你一个答案并展示一系列链接时,你会假设这些链接是真实的、经人类核实的事实。如果这些链接实际上是 AI 生成的,那么 AI 本质上是在引用它自己的“幻觉”或低质量的机器人文本,以此作为其答案的证明。
  • 质量差距:虽然并非所有 AI 文本都是坏的,但论文指出,AI 文本可能包含错误、偏见或捏造的事实。如果 AI 搜索引擎使用 AI 撰写的来源来构建其答案,就会形成一个“纸牌屋”,其基础是不稳固的。
  • “黑箱”:这些引擎不会告诉你:“嘿,这个来源是由机器人撰写的。”它们只是向你展示链接。

总结

该论文得出结论,这些新的“生成式搜索引擎”目前的表现就像是一些图书管理员,他们有时会无意中引用由机器人撰写的书籍,却未告知读者。它们严重依赖少数几个著名网站,但同时也从“长尾”中的无数鲜为人知的网站中提取了大量信息,其中许多网站充斥着 AI 生成的内容。

研究人员表示,这是一个警告信号:如果我们不解决这些引擎选择和核查来源的方式,用户可能会在不知情的情况下信任完全由合成生成的信息。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →