← 最新论文
🤖 AI

Mitigating Visual Hallucinations in Multimodal Systems through Retrieval-Augmented Reliability-Aware Inference

本文提出了一种检索增强的可靠性感知推理框架,该框架利用外部视觉证据来评估预测的可信度并实现选择性决策门控,从而在无需模型重训练的情况下,显著提高多模态大语言模型的准确性并减少幻觉。

原作者: Pratheswaran Hariharan, Haiping Xu, Donghui Yan

发布于 2026-06-16
📖 1 分钟阅读☕ 轻松阅读

原作者: Pratheswaran Hariharan, Haiping Xu, Donghui Yan

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,你有一个非常聪明、自信的机器人助手,它可以通过观察图片并准确地告诉你它看到了什么。它非常擅长描述事物,但有时在不是 100% 确定时,它仍然会进行猜测,并且表现得极其自信。这就像一个学生明明不知道数学题的答案,却举手大声喊出一个猜测,听起来还非常笃定。在人工智能领域,这被称为“视觉幻觉(visual hallucination)”——系统看到了并不存在的东西,或者为了表现得“乐于助人”而编造事实。

这篇论文介绍了一种全新的“安全检查”系统,旨在阻止机器人在不该猜测时进行自信的猜测。以下是它的工作原理,我们使用简单的类比来解释:

问题所在:过度自信的猜测

目前的 AI 模型就像那些背了很多事实但没有自我检查能力的同学。如果它们看到一张模糊的鸟类照片,它们可能会自信满满地说:“那是一只鹰!”即使那其实是一只风筝。因为机器人说话非常流利且自信,人类往往会相信它,即便它是错的。

解决方案:“证据图书管理员”

作者提议在机器人的大脑和用户之间增加第二个步骤。把这个新系统想象成一位坐在机器人与用户之间的图书管理员

  1. 检索(The Search/Retrieval): 当机器人看到一张新图片时,它不再只是盲目猜测,而是向图书管理员发送请求。图书管理员拥有一座拥有数百万张参考照片的庞大图书馆(数据库)。图书管理员会找出库中最像这张新图片的 5 张照片。
  2. 事实核查(The Fact-Check/Reliability Estimation): 图书管理员不仅是看这些照片,还会像侦探一样分析它们。它会提出四个关键问题:
    • 相似度(Similarity): 参考照片与新图片看起来真的非常接近吗?
    • 一致性(Agreement): 所有参考照片对该物体的定义是否一致?(例如:如果 4 张说是“鲨鱼”,1 张说是“海豚”,这就是冲突)。
    • 置信度差距(Confidence Gap): “鲨鱼”这个答案是否明显优于“海豚”这个答案,还是两者不相上下?
    • 混乱度(Confusion): 证据是分散且混乱的,还是清晰且集中的?

决策门控:交通灯

根据事实核查的结果,图书管理员会为机器人的答案挂上一个交通灯:

  • 🟢 绿灯(接受/Accept): 证据有力、清晰且大家意见一致。机器人被允许给出自信的回答:“这是一条大白鲨。”
  • 🟡 黄灯(谨慎/Caution): 证据还可以,但有点摇摆不定或存在争议。机器人可以回答,但必须使用“谨慎的语言”。它不会说“这是一只风筝”,而是说“这可能是一只风筝,但我不是完全确定。”
  • 🔴 红灯(弃权/Fallback): 证据薄弱、混乱,或者该物体不在图书馆的资料库中。机器人被禁止进行猜测。它必须说:“我无法有把握地识别这个物体,”或者“我没有足够的信息来回答。”

实验中发生了什么?

研究人员使用一套标准的 100 类图像(就像一场学校考试)测试了这个系统。

  • 在加入安全检查之前: 机器人回答了每一个问题。它的正确率是 86%,但有 14% 的时间它是在自信地犯错。
  • 在加入安全检查之后: 机器人停止回答大约 11% 的问题(即那些它不确定的问题)。对于它回答的问题,其正确率提升到了 89%
  • 结果: 机器人自信地给出错误答案的次数显著下降(从 14% 降至 11%)。

核心启示

这个系统不需要重新训练那个庞大且复杂的机器人大脑。它只是增加了一个“现实检查”层,在让机器人开口说话之前,先查看外部证据。

  • 如果证据充分: 机器人自信地发言。
  • 如果证据薄弱: 机器人保持沉默或谨慎发言。

这使得 AI 更加值得信赖,因为它会在不知道时承认自己不知道,而不是编造一个自信的谎言。这就像拥有一个会说“我不确定,让我查一下”的朋友,而不是一个只会瞎猜并希望你没发现它错了的朋友。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →