本页收录的每篇论文,都有至少一位原作者阅读并参与了我们的通俗解释——或是确认其准确无误,或是提出修正意见并由我们随后采纳。作者的确认并不等同于对每一句话的正式背书,但说明该解释已经过论文作者的审视。

1008 篇论文已由作者审阅 · 11–20 / 1008

💬 NLP

Novel Claim or Déjà Vu? Rethinking "Contamination-Free'' Dynamic Evaluation for Multimodal Automated Fact-Checking

本文通过证明很大一部分截断日期后的主张仍可通过既有知识进行验证,从而挑战了动态基准测试本质上不存在污染的假设,这种现象可能会人为地抬高多模态事实核查性能并扭曲系统排名,因此有必要实施更严格的评估协议。

Haorui He, Xinwen Chen, Dacheng Wen, Reynold Cheng, Francis C. M. Lau, Yupeng Li2026-07-28✓ Author reviewed
💬 NLP

Language-Routed RAG and Direct Option Scoring for Multilingual Financial QA: DS@GT at FinMMEval

DS@GT 团队提出了一种用于多语言金融问答的语言路由检索增强流水线,该流水线结合了 BGE-M3 嵌入、加权倒数排名融合以及通过下一标记对数概率进行的直接选项评分,并证明了实现最优性能需要进行特定语言的模型选择,以及在某些语言中需谨慎避免使用思维链提示。

Justice Ayela, Kabir Sahni2026-07-28✓ Author reviewed
🔭 astrophysics

Enhancing weak lensing redshift distribution characterization by optimizing the Dark Energy Survey Self-Organizing Map Photo-z method

本文表明,通过针对红移估计定制算法并结合 g 波段通量信息,优化了暗能量调查(Dark Energy Survey)的自组织映射光度红移方法,显著改善了红移分布特征化,使分箱重叠减少了高达 66%,并为未来的 DES 第 6 年及第四阶段巡天建立了稳健的框架。

A. Campos, B. Yin, S. Dodelson, A. Amon, A. Alarcon, C. Sánchez, G. M. Bernstein, G. Giannini, J. Myles, S. Samuroff, O. (…)2026-07-28✓ Author reviewed