← 最新论文
💻 computer science

S4R: Scaling for Rigid-Body Interpenetration Resolution

S4R 是一种尺度延续方法,它通过将物体均匀收缩至无穿透状态,随后通过一系列最小范数凸接触二次规划恢复其全尺寸,从而解决静态刚体穿透问题,并实现以最小位移达成零穿透以及在大规模场景中具有卓越的计算效率。

原作者: Zhiyang Dou, Ang Zhao, Chen Peng, Minghao Guo, Haixu Wu, Cheng Lin, Yuan Liu, Junfeng Yao, Xiaohu Guo, Wenping Wang, Wojciech Matusik

发布于 2026-09-18
📖 1 分钟阅读☕ 轻松阅读

原作者: Zhiyang Dou, Ang Zhao, Chen Peng, Minghao Guo, Haixu Wu, Cheng Lin, Yuan Liu, Junfeng Yao, Xiaohu Guo, Wenping Wang, Wojciech Matusik

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

在数字世界中,三维物体无处不在。它们充斥在机器人学习运动的虚拟环境中,填满了动画电影的场景,也构成了将文本或图像转化为3D模型的新型工具的基础。为了让这些数字世界感觉真实,其中的物体必须遵守物理定律。一把椅子不能悬浮在半空中,一个杯子也不能穿过桌子。然而,当计算机自动生成这些场景,或者设计师将许多独立的部件组装在一起时,一个常见的问题就出现了:物体往往会在同一时间占据相同的空间。用物理学的语言来说,它们发生了“相互穿透”。这是一种在现实世界中并不存在的状态,并且会破坏依赖于这些场景的模拟过程。如果机器人试图学习如何拿起一个目前卡在桌子里的杯子,模拟将会失败或产生剧烈且不真实的现象。修复这个问题需要移动物体,使其不再重叠,但又要避免移动得太远,以至于它们最终处于一个完全不同、并非预期的排列状态。

多年来,研究人员一直致力于高效地解决这个问题,尤其是在处理成千上万个物体时。传统方法通常试图通过一个巨大的、强力的步骤将物体推开,但这可能会导致物体飞出屏幕,或者陷入复杂的纠缠中。另一些方法则试图模拟碰撞的物理过程,但这些方法速度缓慢,且可能产生过大的、不必要的位移。现在,一组研究人员引入了一种名为 S4R 的新方法,它采取了一条不同的路径来理顺这些数字乱象。该方法并没有试图立即强行将物体推开,而是首先将场景中的每一个物体都缩小到其原始尺寸的一个极小比例。在这个微缩尺度下,物体变得非常小,以至于即使它们之前曾深度嵌入彼此,现在也不会再互相接触。此时,场景变得安全且没有重叠。

一旦场景变得清晰,研究人员便开始一个精细的过程:生长。他们让物体缓慢地膨胀回其完整的原始尺寸。随着每个物体的生长,计算机都会检查它是否即将触碰到邻近物体。如果检测到接触,系统会对涉及的物体进行微小的、精确的位置调整,其幅度仅够让它们在继续生长时保持互不重叠。这个过程分许多个小步骤进行,就像一场慢动作的充气过程。由于调整是在物体仍然很小且接触较浅时进行的,因此计算移动所需的数学运算既简单又快速。系统重复这个“生长与轻推”的循环,直到每个物体都恢复到其完整尺寸。结果是,物体被完美地分隔开来,同时它们仍能保持在最初放置位置附近。

研究人员在各种具有挑战性的场景中测试了这种方法,包括包含多达五千个物体的场景。他们将这种方法与机器人技术和计算机图形学中使用的几种现有技术进行了对比。在每一次测试中,这种新方法都成功消除了所有重叠,没有任何物体仍被卡在另一个物体内部。至关重要的是,它在移动物体幅度最小的情况下完成了任务,保留了场景原本的设计布局。它还证明了自己比其他方法显著更快,能在极短的时间内解决问题。例如,在一台标准计算机上,它可以在大约 68 秒内解决一个拥有五千个物体的场景,而其他方法要么耗时更长,要么无法在合理的时间内完成。该方法同样适用于强大的图形处理器(GPU),在那里它可以处理规模更大的场景,使其适用于现代机器人训练和虚拟现实中所使用的庞大且复杂的环境。

这项技术的强大之处在于其简洁性,以及它在不被复杂性压垮的情况下处理复杂问题的能力。通过将一个困难的问题分解为一系列简单的步骤,研究人员避开了困扰其他方法的陷阱。他们发现,即使是对于形状奇特、不规则或排列极其紧密的物体,这种方法依然表现良好。该方法并不是解决所有不可能情况的“万灵药”:如果物体排列得过于紧密,以至于在物理上不存在不重叠的空间,系统会识别出这一点并停止运行。但对于绝大多数由计算机生成或由人类设计的场景,它提供了一种可靠的方法,能将一个破碎、重叠的混乱局面转化为一个干净、可用的环境。这种能力对于机器人的未来至关重要——在未来,机器需要从看起来并表现得像真实世界的模拟中学习;同时也对于数字内容的创作至关重要——即创造出无需经过数小时人工修正即可直接投入使用的数字内容。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →