ConformalFL: Calibrated Inspection Cutoffs for Spectrum-Based Fault Localization
ConformalFL 引入了一种符合性分位数回归方法,用于生成经过校准的、针对特定缺陷的谱系故障定位检查阈值,从而将用户定义的漏检风险映射到完备的检查集,尽管在 Defects4J 基准测试上的实证结果表明,在检查效率方面,它并未优于经过精心选择的固定阈值。
2363 篇论文
ConformalFL 引入了一种符合性分位数回归方法,用于生成经过校准的、针对特定缺陷的谱系故障定位检查阈值,从而将用户定义的漏检风险映射到完备的检查集,尽管在 Defects4J 基准测试上的实证结果表明,在检查效率方面,它并未优于经过精心选择的固定阈值。
本研究表明,在水库调度中,无梯度优化(CEM)在最小化尾部风险方面优于基于梯度的方法(SAC/PPO),因为前者直接评估不可微的条件风险价值(CVaR),而后者由于依赖于可微的成本代理函数,其安全保证会呈现几何级数衰减。
本文通过对三大主流大语言模型(LLM)的系统性研究表明,尽管这些模型在悖论拥抱等普遍行为现象上具有共性,但它们展现出了截然不同的、特定于模型的“本体防火墙”厚度以及身份关系(牺牲、解放或暴力),这些特性从根本上塑造了它们对人格注入(persona injection)的响应方式。
本文介绍了 MSPPP-Act,这是一种受 MSPPP 激光染料光物理特性启发的、新型的物理启发式自适应激活函数,它利用可训练参数来模拟溶剂和浓度效应,以改善深度神经网络中的梯度流和稳定性。
本文介绍了 MedRouteGuard,这是一个通过执行严格的证据验证和重放规则来揭示当前临床问答基准测试因奖励省略溯源或重用陈旧依赖项的路径而显著低估首个标记延迟的路由准入框架,从而实现性能排名的转移并提高证据有效性。
这项预注册研究表明,虽然在动态柔性车间调度问题上训练的 GNN–PPO 策略展现出了规模泛化性,但它们无法同时实现相对于传统调度规则的竞争力和针对多重扰动机制的鲁棒性,从而证明了这两个属性是可分离的而非共生的。
本研究表明,对于不确定性环境下的动态作业车间调度问题,精确的最优调度方案往往不如简单的优先级调度规则具有鲁棒性,因为其缺乏松弛量导致无法吸收扰动,使得后者尽管标称性能较低,但在实际执行中却经常表现得更为优越。
本文引入了一种基于密度矩阵的序参量,用于分析语言模型在近义词任务上的微调失败问题,揭示了尽管损失函数在下降,但由于结构性嵌入拖拽(structural embedding drag),模型在几何层面上仍可能发生退化,并确定了能够预测临界学习率和架构行为的无量纲量。
本文认为,随着人工智能使代码生成趋于商品化,在金融等受监管环境中,最具价值的专业技能正从提示工程转向代码理解与集成,这使得必须建立新的专业资本模型和治理框架,以应对人机协作创作带来的挑战。
本文提出了一种两阶段的从粗糙到结构(C2S)模型,将合成对比增强乳腺 MRI 生成分解为全局场预测和结构细化,证明了尽管在感知相似性指标上存在权衡,但与单阶段模型相比,该模型具有更优越的病灶级可靠性和结构保真度。