本页收录的每篇论文,都有至少一位原作者阅读并参与了我们的通俗解释——或是确认其准确无误,或是提出修正意见并由我们随后采纳。作者的确认并不等同于对每一句话的正式背书,但说明该解释已经过论文作者的审视。

1199 篇论文已由作者审阅 · 481–490 / 1199

🤖 machine learning

Invariant Reasoning Directions in Latent Trajectories of Language Models

本文介绍了轨迹不变潜空间精炼(Trajectory-Invariant Latent Refinement, TILR),这是一个无需训练的框架,它通过识别并操纵语言模型潜空间轨迹中稳定的低秩不变方向,在不牺牲准确性的情况下,显著提高了推理的一致性,并降低了对改写和扰动的敏感性。

Arun Vignesh Malarkkan, Manan Roy Choudhury, Utkarsh Byahut, Yash Ravindra Charde, Vivek Gupta, Yanjie Fu2026-06-30✓ Author reviewed
🤖 machine learning

Deterministic Decisions for High-Stakes AI. A Zero-Egress Pipeline with the Deployability of RAG and the Accuracy of Machine Learning

本文识别并量化了零样本大语言模型教育顾问中的“干预偏差”问题,即与最优先知相比,这些顾问会错误地推荐不必要的行动,并证明了使用 Decision Transformer 或 XGBoost 进行监督策略学习能有效消除这种偏差,同时实现适用于高风险部署的高准确率和低延迟决策。

Craig Atkinson2026-06-30✓ Author reviewed
💬 NLP

How Far Can You Get Without a GPU? A Systematic Benchmark of Lightweight Hallucination Detection Across Question Answering, Dialogue, and Summarisation

本文系统地基准测试了五种轻量级、CPU 可行的幻觉检测方法在问答、对话和摘要任务中的表现,揭示出性能具有高度的任务依赖性:集成方法在问答任务中表现卓越,NLI 检测器在对话任务中处于领先地位,而所有方法在摘要任务上均表现出显著的失败。

Kriti Faujdar, Smit Kadvani2026-06-30✓ Author reviewed
💬 NLP

Evidence-Informed LLM Beliefs for Continual Scientific Discovery

本文引入了一个基于证据的、利用大语言模型进行持续科学发现的框架,该框架以非平稳的、基于信念更新的惊异度取代了静态的贝叶斯惊异度,并利用过滤和多样性最大化来消除伪奖励,从而显著提升了跨多个领域的假设探索能力。

Dhruv Agarwal, Reece Adamson, Andrew McCallum, Peter Clark, Ashish Sabharwal, Bodhisattwa Prasad Majumder2026-06-30✓ Author reviewed