← 最新论文
💻 computer science

REAL: Robust Extreme Agility via Spatio-Temporal Policy Learning and Physics-Guided Filtering

本文提出了名为 REAL 的端到端框架,通过结合时空策略学习与物理引导滤波,利用 FiLM 调制 Mamba 骨干网络及贝叶斯状态估计,使四足机器人在视觉严重退化(如存在 1 米盲区)的极端动态环境下仍能实现鲁棒且实时的敏捷跑酷。

原作者: Jialong Liu, Dehan Shen, Yanbo Wen, Zeyu Jiang, Changhao Chen

发布于 2026-03-19
📖 1 分钟阅读☕ 轻松阅读

原作者: Jialong Liu, Dehan Shen, Yanbo Wen, Zeyu Jiang, Changhao Chen

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 ✨ 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

这篇文章介绍了一种名为 REAL 的新系统,它让四足机器人(比如机器狗)变得像真正的“跑酷大师”一样,即使在眼睛看不见、传感器失灵的极端情况下,也能灵活地跨越障碍。

为了让你更容易理解,我们可以把这项技术想象成训练一只拥有“超级直觉”和“物理本能”的机器狗。

1. 核心问题:为什么以前的机器狗容易“摔跟头”?

以前的机器狗虽然跑得快,但它们太依赖“眼睛”(摄像头)了。

  • 比喻:想象一个在黑暗中走钢丝的人,如果突然有人用黑布蒙住他的眼睛,或者给他戴上了模糊的墨镜,他立刻就会失去平衡摔下来。
  • 现实:在真实的跑酷中,机器狗跳跃时会有剧烈震动、运动模糊,或者被灰尘遮挡视线。一旦视觉信号出现哪怕一点点“噪点”或延迟,以前的算法就会直接“死机”或做出错误的动作,导致机器狗摔倒。

2. REAL 的解决方案:三个“超能力”

REAL 系统通过三个核心技巧,让机器狗不再单纯依赖眼睛,而是学会了“用心跳”和“肌肉记忆”来感知世界。

超能力一:像“老练的教练”带“新手” (教师 - 学生蒸馏)

  • 比喻:想象有一个全知全能的教练(教师),他在训练时有“上帝视角”,能直接看到地面的每一个坑洼和高度。他先学会了完美的动作。然后,他把这些经验“教”给一个只有普通眼睛的新手(学生)。
  • 做法:这个新手虽然看不到那么清楚,但它通过模仿教练,学会了如何根据自己身体的感觉(比如腿部的压力、身体的倾斜)来推断脚下的地形。即使眼睛看不清,它也能猜出前面是台阶还是平地。

超能力二:拥有“超级大脑”和“动态滤镜” (Mamba + FiLM)

这是论文中最酷的部分,解决了“看不清”和“记不住”的问题。

  • FiLM(动态滤镜):
    • 比喻:就像你戴着一副智能墨镜。当你静止时,墨镜是透明的;但当你剧烈跳跃、身体晃动导致画面模糊时,这副墨镜会自动变暗,屏蔽掉那些模糊、不可靠的视觉信号,转而让你更依赖身体的感觉。
    • 作用:它主动过滤掉视觉噪音,防止机器狗被错误的图像误导。
  • Mamba(超级记忆):
    • 比喻:以前的机器人像金鱼,只有 7 秒记忆。Mamba 就像是一个拥有超强短期记忆的运动员。即使眼前一片漆黑(比如跳进一个坑里看不见地面),它也能记住:“我刚才跳了 0.5 秒,身体在空中,根据刚才的起跳力度,我大概会在 0.3 秒后落地。”
    • 作用:它利用过去几秒的身体动作数据,在视觉失效时“脑补”出地形,确保持续奔跑不中断。而且它的计算速度极快,不会让机器狗“反应迟钝”。

超能力三:物理本能的“安全网” (物理引导滤波)

  • 比喻:想象机器狗身上装了一个物理学家。当它跳跃落地时,如果传感器说“我速度很快”,但物理学家根据牛顿定律算出“不可能这么快,除非你飞起来了”,物理学家就会立刻纠正传感器的错误数据。
  • 做法:系统结合了神经网络(猜速度)和物理公式(算速度)。如果传感器数据太离谱(比如因为打滑导致数据乱跳),物理模型会强制修正,确保机器狗的动作符合物理规律,不会做出“飘在空中”或“穿地而过”的荒谬动作。

3. 实验结果:真的有多强?

研究人员在真实的 Unitree Go2 机器狗上测试了这套系统:

  • 蒙眼跑酷:在机器狗眼睛被遮挡(比如前方 1 米内看不见)的情况下,其他机器狗直接摔倒,而 REAL 机器狗依然能稳稳地跳过障碍、爬上楼梯。
  • 抗干扰:即使摄像头画面全是雪花点(噪音)或者卡顿,它也能像没事人一样继续跑。
  • 速度极快:它的思考速度极快(每步只需 13.1 毫秒),完全满足实时控制的要求,不会像以前的复杂模型那样因为计算太慢而反应不过来。

总结

REAL 就像是给机器狗装上了直觉、记忆和物理常识。它不再是一个只会看摄像头数据的“瞎子”,而是一个即使闭着眼睛、在混乱环境中,也能凭借身体感觉和物理本能,像真正的跑酷运动员一样灵活、稳健地跨越障碍的“高手”。

这项技术让机器人真正具备了在灾难现场、废墟等复杂、危险环境中执行任务的能力,因为它们不再害怕传感器失灵。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →