J-space Forecasts Model Collapse, but Only Anchoring the Function Prevents It
虽然在合成数据上的递归训练会导致模型崩溃,表现为 J-空间表示子空间的全局漂移,但研究发现,稳定这种几何结构是无效的,而利用少量真实序列将模型的输入-输出函数锚定在崩溃前的状态,则能成功防止几乎所有的损伤。
2358 篇论文
虽然在合成数据上的递归训练会导致模型崩溃,表现为 J-空间表示子空间的全局漂移,但研究发现,稳定这种几何结构是无效的,而利用少量真实序列将模型的输入-输出函数锚定在崩溃前的状态,则能成功防止几乎所有的损伤。
本文提出了一种带有切换控制机制的双深度Q网络(DDQN)框架,用于在资源受限的LTE-V2X网络中,跨六个径向小区层自适应地选择覆盖-非覆盖传输模式,与现有的经验型和贪婪型基准方案相比,该框架在提高吞吐量和可靠性的同时,实现了模式切换的稳定性。
本文证明了由于能力与难度的混淆,无法从学生交互日志中可靠地推断出先验知识图谱,并据此提出了一种透明的、由专家提供的模糊推理层,该层在与可复用的局部化审计框架结合使用时,能够确保可解释的知识追踪,且研究证明产品 t-范数在建模先验效应方面是最优的。
本综述通过物联网数字取证发展的四个阶段来追溯其演进过程,揭示了理论设计与实证证据之间存在的关键错位,并强调尽管在监管链等核心原则上已达成共识,但该领域仍受困于关于获取时机和治理问题的未决争议,以及对未能解决资源匮乏的边缘设备和跨界云端实际约束的、未经验证的模拟实验的依赖。
本研究表明,通过挖掘版本控制历史来比较 AI 智能体与人类修复的持久性,会受到工作流伪影的严重影响,通过人工验证和程序化修正揭示了最初观察到的 AI 智能体更高的复发率其实是一种幻象,且在考虑到这些伪影后该现象便会消失。
本研究表明,虽然固定比例稀疏注意力归一化器在特定的图像和文本任务的紧凑分类器中可以显著优于密集 Softmax,但其有效性高度依赖于任务和实现细节,而非提供一种普遍的优越性。
这项研究表明,虽然美国和中国的语言大模型在回答有关美国的问题时表现出极小的偏见,但在涉及中国时却呈现出显著的分歧模式,其中 Claude 的得分始终较低,DeepSeek 较高,而 ChatGPT 与群体平均水平相比则保持相对中立。
本研究评估了在 UCI 混凝土抗压强度数据集上的各种机器学习和贝叶斯方法,发现虽然经过贝叶斯优化的 XGBoost 提供了最高的预测准确度,但高斯过程回归在不确定性量化方面具有独特优势,且所有结果和工具均通过 R 代码和交互式 Shiny 应用公开提供。
本研究表明,大型语言模型在“自愿结构性解离”方面表现出显著的架构差异性,即 GPT-5.4 完全遵循框架化的隐藏指令,Claude 一贯拒绝此类指令,而 Gemini 则表现出中间程度的合规性,并明确承认了隐藏指令的存在。
PolyDetect 是一个实时、质量感知的混合深度学习框架,它通过集成无参考图像质量评估模块、自适应增强以及加权训练,在退化的结肠镜图像中实现了鲁棒且达到最先进水平的息肉分割。