← 最新论文
🤖 AI

PhaseLoRA: Control-Regime-Conditioned Low-Rank Adaptation for Continuous-Action Vision-Language-Action Policies

该论文提出了 PhaseLoRA,一种针对连续动作视觉-语言-动作策略的参数高效微调方法,该方法根据精细控制倾向和事件强度动态地将低秩自适应条件化,以更好地处理操控任务的不同阶段,从而实现了优于静态基准方法的性能。

原作者: Yufei Guo, Yinan Wu, Haoran Duan, Guiguang Ding, Jungong Han

发布于 2026-08-18
📖 1 分钟阅读☕ 轻松阅读

原作者: Yufei Guo, Yinan Wu, Haoran Duan, Guiguang Ding, Jungong Han

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

能够看见、理解语言并移动双手的机器人不再是科幻小说中的情节,它们正在成为现实。这些机器通常被称为视觉-语言-动作模型(vision-language-action models),它们充当了人类语言与机器人行为之间的桥梁。它们接收摄像头的画面流和口头指令,然后决定如何移动其抓取器以完成任务。然而,教导这些强大的系统执行特定的、精细的工作既昂贵又困难。标准的方法涉及提取一个庞大的、预训练好的“大脑”,并为每一个新工作从头开始重新训练,这个过程需要巨大的计算能力和数据。为了解决这个问题,研究人员转向了一种被称为“微调”(fine-tuning)的技术,这就像是在机器人现有的知识库中添加一本小型的、专门的笔记本,而不是重写它的整部百科全书。这种方法很高效,但一项新的研究表明,目前使用这些“笔记本”的方式过于僵化。它将机器人运动的每一个瞬间都视为完全相同,忽略了这样一个事实:像拿起一个杯子这样的单一任务,包含了许多截然不同的物理阶段,从伸手去够到手指闭合的微妙时刻。

清华大学的一个研究小组开发了一种名为 PhaseLoRA 的新方法来解决这种僵化问题。他们意识到,机器人的控制需求会随着其在任务中的移动而不断变化。当机器人只是在空中挥动机械臂时,它需要宽泛、粗略的调整。但当它接触到物体或试图将其轻轻放在桌子上时,所需的精度会发生剧烈转变。旧方法在整个运动过程中应用相同的微小调整,就像开车时方向盘被锁死在一个位置一样。新方法则允许机器人在情况演变时动态地改变其“转向”。PhaseLoRA 不再是一个静态的笔记本,而是给了机器人一种感知自己处于哪种时刻的能力——无论是在接近物体、进行接触,还是在放下物体——并能立即针对那一特定瞬间调整其学习和行动方式。

研究人员在涉及在桌子上移动物体的标准机器人任务集上测试了这个想法。他们将这种新方法与现有的最佳技术进行了对比,其中包括一个仅仅通过增加计算能力来学习更多细节的版本。结果令人瞩目。在这些模拟实验中,新方法的任务完成成功率显著高于标准方法。它大幅超越了一个功能更强大、容量更高的旧版本方法,这证明了这种进步源于对机器人行为进行更智能的调整,而不仅仅是增加了更多的原始数据。团队还在实验室环境下,在一个真实的物理机械臂上测试了该系统。虽然现实世界的测试比计算机模拟要困难且不可预测得多,但新方法仍然显示出明显的优势,其成功率接近 70%,而旧方法约为 50%。这表明,适应不同运动阶段的能力不仅仅是一种计算机技巧,而是一种在机器人实际抓取物理物体时确实有效的实质性提升。

为了在不需要人类手动标记机器人每一次运动秒数的情况下实现这一目标,团队教导系统能够自主识别这些阶段。他们创建了一个轻量级的辅助系统,该系统观察机器人的动作,并推测当前时刻是需要精细控制,还是正在发生碰撞或释放等突发事件。这个辅助系统不需要完美的标签,只需要大致准确即可。它通过观察机器人的移动速度以及其动作变化的剧烈程度来进行判断。如果机器人移动得缓慢且小心,系统就知道正处于精细阶段。如果机器人突然猛冲或停止,系统就知道正在发生转换。基于这些推测,系统会实时重塑机器人的学习调整。研究人员发现,如果用随机数替换这些智能推测,机器人的性能就会下降,这证明了该系统实际上是在学习如何识别改变行为行为的时机。他们还表明,仅仅调高或调低旧有的、静态调整的强度是不够的;机器人需要实际改变其学习的方向,而不仅仅是改变强度。

这项研究为使机器人变得更强大、更高效提供了一条清晰的路径。通过允许机器人理解一个任务是由不同的章节组成的,且每个章节都需要不同类型的关注,研究人员展示了我们可以在不需要海量新数据或计算能力的情况下,获得更好的性能。这项工作表明,机器人学习的未来不仅在于制造更大的“大脑”,还在于教导它们去感知它们所居住的物理世界不断变化的本质。随着这些系统从模拟环境走向真实的工厂和家庭,能够在宽泛运动与细腻触碰之间流畅切换的能力,对于它们应对现实生活的不可预测性将至关重要。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →