← 最新论文
🤖 machine learning

LLMs Should Express Uncertainty Explicitly

该论文提出将不确定性作为控制接口,通过对比全局置信度评分与推理过程中的局部风险标记两种互补方式,发现前者能显著提升校准度并优化自适应检索增强生成(RAG)的决策,而后者能有效暴露生成过程中的潜在错误并触发检索,从而论证了大语言模型应根据任务需求将不确定性训练为针对性的沟通机制。

原作者: Junyu Guo, Shangding Gu, Ming Jin, Costas Spanos, Javad Lavaei

发布于 2026-04-08
📖 1 分钟阅读☕ 轻松阅读

原作者: Junyu Guo, Shangding Gu, Ming Jin, Costas Spanos, Javad Lavaei

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

这篇论文探讨了一个非常有趣的问题:当人工智能(大语言模型)“不知道”答案时,它应该如何告诉我们?

想象一下,你正在和一个非常博学但偶尔会犯糊涂的朋友聊天。如果这个朋友总是自信满满地胡说八道,你会很危险;但如果他能在自己不确定时,立刻停下来告诉你“我不确定,我得查一下”,那你们之间的合作就会变得非常高效。

这篇论文的核心观点就是:大模型不应该把“不确定性”藏在心里,而应该把它变成一种清晰的“语言”或“信号”,直接告诉下游系统(比如检索工具或人类用户)。

为了做到这一点,作者设计了两种不同的“沟通方式”(接口),我们可以用两个生动的比喻来理解:

1. 全局接口:像“天气预报”一样的最终自信度

(Verbalized Confidence / 口头表达自信度)

  • 场景:就像你问朋友:“明天会下雨吗?”
  • 传统做法:朋友直接回答“会下雨”,但他心里其实只有 60% 的把握。如果你信了,出门没带伞就被淋湿了。
  • 论文的新做法:朋友不仅回答“会下雨”,还会加上一句:"我有 85% 的把握会下雨"。
  • 它的作用
    • 如果他说“我有 99% 的把握”,你可以放心地相信他。
    • 如果他说“我只有 40% 的把握”,你就知道:“哦,他其实不太确定,我得自己再查查或者别太当真。”
  • 效果:这种训练让模型学会了**“知之为知之,不知为不知”**。它不再盲目自信地胡说八道(减少了“过度自信的幻觉”),而是能准确评估自己有多大的把握。这就像给模型装了一个精准的“自信度仪表盘”。

2. 局部接口:像“路标”一样的中途警示

(Reasoning-Time Signaling / 推理时的<不确定>标记)

  • 场景:想象朋友在解一道复杂的数学题,或者在写一篇文章。
  • 传统做法:他一路写到底,最后给出一个错误的答案。你直到最后才发现他错了,但已经晚了,整个推理过程都白费了。
  • 论文的新做法:朋友在解题过程中,一旦遇到一个卡住的知识点,或者发现证据不足,他会立刻在纸上画一个醒目的**“红色感叹号”**(论文里叫 <uncertain> 标记),并说:“等等,这里我不确定,我需要去查资料!”
  • 它的作用
    • 这是一个实时的“刹车”信号。它告诉系统:“别继续往下编了,现在停下来去查资料(检索)还来得及!”
    • 它把那些原本“沉默的失败”(模型心里知道不对但嘴上还在硬撑)变成了可见的干预点
  • 效果:这就像给模型装了一个**“中途警报器”**。在它犯错之前,系统就能捕捉到信号,及时介入(比如调用搜索引擎),从而避免最终产生错误的结论。

为什么这两种方法都很重要?(核心发现)

作者通过大量的实验和“显微镜”观察(分析模型内部的大脑结构),发现这两种方法虽然目标不同,但各有奇效:

  1. “自信度仪表盘”(全局接口)

    • 它主要是在**“最后一步”**起作用。它让模型学会了如何更诚实地表达“我有多确定”。
    • 比喻:就像给汽车装了一个更精准的速度表和油量表。它不会改变你开车的方式,但能让你在油量低时知道该去加油,而不是盲目开到没油。
    • 结果:大幅减少了模型“一本正经胡说八道”的情况,让最终答案更可靠。
  2. “中途警报器”(局部接口)

    • 它是在**“思考过程中”**起作用的。它迫使模型在遇到知识盲区时,主动暴露出来。
    • 比喻:就像在开车时,如果前方有坑,警报器会在你还没掉进去之前就开始响,让你有机会立刻转向或停车。
    • 结果:它让模型在犯错前就“举手投降”,让系统有机会在关键时刻介入(比如去查资料),从而挽救了原本会失败的推理。

总结:给 AI 装上“诚实的嘴”和“敏锐的雷达”

这篇论文告诉我们,未来的大模型不应该只是一个“只会输出答案的机器”,而应该是一个懂得沟通自己状态的合作者

  • 对于最终答案:它应该像一位诚实的专家,明确告诉你“我有几成把握”,让你决定是否信任它。
  • 对于思考过程:它应该像一位警觉的向导,在遇到迷雾时立刻发出信号,让你知道“这里需要帮忙”,而不是硬着头皮走错路。

通过这种“任务匹配”的沟通训练(该自信时自信,该犹豫时犹豫),我们可以让 AI 变得更安全、更可靠,也更懂得在什么时候该停下来寻求帮助。这不仅是技术的进步,更是让 AI 从“黑盒”变成“透明伙伴”的关键一步。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →