What Context Does a Coding Agent Actually Need to Act?
本文证明了对于进行代码编辑的编程智能体而言,其核心上下文严格限于正在被修改的具体文件,因为与源代码本身相比,自然语言摘要和周围文件内容对解决问题的贡献微乎其微,同时也揭示了基准测试结果中由非确定性 API 推理所导致的显著噪声底限。
原作者已查阅我们通俗解释的论文。
本页收录的每篇论文,都有至少一位原作者阅读并参与了我们的通俗解释——或是确认其准确无误,或是提出修正意见并由我们随后采纳。作者的确认并不等同于对每一句话的正式背书,但说明该解释已经过论文作者的审视。
1008 篇论文已由作者审阅 · 141–150 / 1008
本文证明了对于进行代码编辑的编程智能体而言,其核心上下文严格限于正在被修改的具体文件,因为与源代码本身相比,自然语言摘要和周围文件内容对解决问题的贡献微乎其微,同时也揭示了基准测试结果中由非确定性 API 推理所导致的显著噪声底限。
本文提出了学习型预测模糊集(Learned Predictive Ambiguity Sets, LPAS),这是一个深度上下文框架,通过自适应地学习状态依赖型 Wasserstein 半径和标称分布来增强分布鲁棒优化,并证明了与传统的固定半径基准相比,该框架在投资组合优化中具有更优越的性能和更低的保守性。
通过利用颜色超导状态方程,对从热的、中微子俘获的诞生态到冷的、中微子透明的最终态的原中子星演化进行建模,该研究识别出四种不同的核心演化情景,并得出结论:稳定的颜色超导相只能在最终的冷中子星内极窄的高质量区域中持续存在。
本文提出了一种计算高效、无需 MCMC 的贝叶斯框架,用于对 QPAT 和 EIT 等基于非线性 PDE 的成像反问题进行不确定性量化,该框架利用两阶段前推方法来推导严谨的后验收敛率,并在较低的计算成本下实现精确重建。
本文通过一项纵向实验研究了推理类大语言模型中的语义漂移现象,并提出了一种数学模型及一种新的“算子控制稳定性系数”,以确保人机混合决策支持系统中的目标导向稳定性。
本文提出了一种自主科学知识生成框架,该框架通过本体引导的获取、混合提取和语义协调的集成工作流,将非结构化科学文献转化为统一的、面向人工智能的知识库,并在电光材料领域成功演示,以实现可扩展的闭环科学发现。
本文通过推导基本的波德-法诺(Bode–Fano)反射界限,并利用多项式正定性和斯图姆(Sturm)根计数法证明精确的稳定性与性能保证,为被动多谐振器量子存储接口建立了严谨的、计算机辅助的连续证书,从而以数学可验证的最坏情况写入效率界限取代了采样效率指标。
本文提出了一种公平感知型零售定价框架,该框架利用带有 CPI 锚定约束的对数-对数 ARDL 模型以及模拟退火算法优化,通过解决通胀驱动的正价格弹性问题来防止消费者受剥削,从而在平衡销售目标与消费者福利之间取得平衡。
本文引入了运动增强引力(Motion-Enhanced Gravity, MEG),这是一种度量-仿射矢量-张量广义相对论扩展,它将时空曲率与物质四维动量通量耦合,提供了一个在数学上一致的框架,在潜在解释平坦星系旋转曲线和晚期宇宙加速的同时,也预言了引力波和黑洞阴影中可观测到的偏差。
受扭曲 实验的启发,本文提出在分数量子反常霍尔态附近观察到的高电阻率金属是一种 正交金属,其特征是具有尖锐的电荷 费米子准粒子并耦合到离散规范场,这自然地解释了高电阻率,并通过配对与普通超导体相联系。