本页收录的每篇论文,都有至少一位原作者阅读并参与了我们的通俗解释——或是确认其准确无误,或是提出修正意见并由我们随后采纳。作者的确认并不等同于对每一句话的正式背书,但说明该解释已经过论文作者的审视。

1206 篇论文已由作者审阅 · 651–660 / 1206

🔭 astrophysics

Gaia FGK Benchmark Stars: Selecting Infrared Lines for Abundance Determination

本研究通过定量评估 CRIRES 光谱与实验室数据及合成模型的符合程度,为 Gaia FGK 基准星在近红外 Y、J 和 H 波段内建立了一套同质、可重复且稳健的原子吸收谱线集,最终确定了如 Mg、Si、Ca、Fe 和 Sr 等元素的可靠跃迁,以改进红外丰度测定。

Scarlet Elgueta, Paula Jofré, Claudia Aguilera-Gómez, Ditte Slumstrup, Álvaro Rojas-Arriagada, Ulrike Heiter, Laia Casam (…)2026-06-10✓ Author reviewed
🔬 physics

Systematic comparison of VMEC and HINT equilibrium calculations for finite-beta LHD plasmas

本文系统地比较了大型螺旋装置(LHD)等离子体的 VMEC 与 HINT 平衡计算,揭示了虽然两者在低 β\beta 值时保持一致,但在高 β\beta 值下会出现分歧,因为 HINT 能够捕捉到 VMEC 因其嵌套通量面假设而无法表示的边缘随机性和通量面破裂现象。

Albert Civit-Bertran, Yasuhiro Suzuki, Shimpei Futatani2026-06-10✓ Author reviewed
🔭 astrophysics

Learning the Universe with the 2nd Generation of CAMELS: Varying 35 parameters of the IllustrisTNG model in (50Mpc/h)^3 boxes

本文介绍了 CAMELS 项目的第二代,其包含 1,192 个宇宙学模拟,体积比前作大了八倍,旨在探索一个 35 参数的空间,并证明虽然这些更大的体积改善了基于神经网络的参数推断,但由于模式耦合和参数简并,这种增益是次线性的。

Shy Genel, Yongseok Jo, Boon Kiat Oh, Megan Taylor Tillman, Max E. Lee, Jun-Young Lee, Elena Hernández-Martínez, Christo (…)2026-06-10✓ Author reviewed
🤖 AI

An LLM-Native Psychometric Instrument Does Not Predict LLM Behavior: Evidence Across 25 Models

尽管一种源自大语言模型行为可负担性(behavioral affordances)的新型心理测量工具展现出了极高的内部信度,但它却无法预测大语言模型的实际行为,揭示了模型自我报告与观察到的行动之间存在严重脱节,这对“大语言模型作为评判者”(LLM-as-judge)的评估流水线构成了重大风险。

Juan Manuel Contreras2026-06-10✓ Author reviewed
💬 NLP

τ\tau-Rec: A Verifiable Benchmark for Agentic Recommender Systems

本文介绍了 τ\tau-Rec,这是一个针对智能体推荐系统(agentic recommender systems)的可验证基准测试,它通过结构化奖励和带有标签揭示机制的启发式过程,取代了主观的基于大语言模型(LLM)的评估,从而揭示了当前对话式智能体中存在的显著可靠性差距,即即使是顶尖模型也难以持续满足任务约束。

Bharath Sivaram Narasimhan, Karthik R Narasimhan2026-06-10✓ Author reviewed