← 最新论文
💻 computer science

Velocity-Space 3D Asset Editing

本文介绍了 VS3D,这是一个无需训练且无需掩码的局部 3D 资产编辑框架,它通过在常微分方程采样器内直接实施针对性的速度空间干预——具体包括重建锚定源注入、部分均值引导和双一致残差注入——来解决整流流生成器中的身份泄露和信号干扰问题。

原作者: Hao Liu, Yuxuan Lin, Jingfeng Guo, Ruihang Chu, Junjie Wang, Ruotong Li, Yujiu Yang

发布于 2026-05-12
📖 1 分钟阅读☕ 轻松阅读

原作者: Hao Liu, Yuxuan Lin, Jingfeng Guo, Ruihang Chu, Junjie Wang, Ruotong Li, Yujiu Yang

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象你拥有一个数字 3D 雕像,比如一只驼鹿的黏土模型。你想给它戴上一顶新帽子,但不想改变它的耳朵、鼻子或毛皮的纹理。这就是局部 3D 编辑的目标:只改变特定部分,同时保持其他一切完全不变。

本文介绍了一种名为VS3D的新工具,它能完美实现这一目标,无需你手动绘制“蒙版”(即数字模板)来告诉计算机哪些部分需要修改、哪些需要忽略。此外,它也不需要重新训练人工智能。

以下是作者如何用简单的类比来解释问题及其解决方案:

问题: “漏水的软管”

现有的 3D 生成人工智能工具就像一根喷水(速度)来构建形状的软管。要编辑形状,它们试图改变某一点的水流方向。

然而,作者发现现有工具在尝试这样做时存在三个主要问题:

  1. “溢出”(身份泄露):当你试图朝一个方向推水以添加帽子时,压力会泄漏出来,意外地喷到驼鹿的其他部位。驼鹿的耳朵可能会晃动,或者毛皮颜色可能会改变,因为“编辑信号”没有被限制住。
  2. “信号微弱”(无放大):为了阻止溢出,人们通常会调低水压。但如果调得太低,你试图添加的帽子就会变得模糊无力。使用现有方法,你无法同时拥有强烈的帽子和安静的驼鹿。
  3. “全局拉扯”(身份拖拽):在构建雕像的最后阶段,人工智能会查看一张带有帽子的驼鹿图片,并试图让整座雕像看起来像那张图片。这种“拉扯”会将未受影响的部位(如驼鹿的腿)从其原始外观中拉开,使其变形以匹配新帽子。

现有工具试图通过使用外部“蒙版”(告诉人工智能“不要碰这里”)或在事后拼接碎片来解决这个问题。作者表示,这就像试图通过在软管外部贴胶带来修复漏水,而不是修复内部的压力阀。

解决方案:VS3D(“内部修复”)

VS3D 通过调整三个特定阶段的水压和方向,从人工智能引擎("ODE 采样器”)的内部修复了问题。它们使用了三个巧妙的技巧:

1. RASI: “自定义锚点”

  • 类比:想象人工智能是一艘在海洋中漂移的船。当你想将其驶向新目的地(帽子)时,洋流通常会将整艘船带离航线。
  • 修复:RASI 就像专门为这艘船抛下的定制锚。它校准引擎,使当你驶向帽子时,引擎确切知道如何抵消船体其余部分的漂移。它确保“水”只在你想要的地方流动,无需蒙版即可阻止溢出。

2. PMG: “信号增强器”

  • 类比:想象你正试图在嘈杂的房间(人工智能的随机噪声)中听清耳语(编辑)。如果你只是倾听,你可能会错过耳语或听到太多噪音。
  • 修复:PMG 就像一位聪明的音响工程师。它两次听取耳语:一次带有大量背景噪音,一次噪音较少。通过比较两者,它可以确切找出“耳语”(帽子)是什么,并将该特定声音的音量调大。如果船已经稳定(无需编辑),增强器将保持静默。这使得编辑变得强烈,而不会扰乱其余部分。

3. TAR: “双重检查”

  • 类比:船被转向后,船员开始绘制细节。他们看着船的照片,却因过于专注于新帽子而错误地绘制了旧部分。
  • 修复:TAR 并行运行一个“孪生”模拟。它询问人工智能:“如果我们构建完全相同的形状但使用照片,腿部看起来会不同吗?”
    • 如果两条腿在两个模拟中看起来相同,人工智能就会知道:“啊,这些腿不需要新帽子的影响。”然后它将纹理轻轻拉回原始外观。
    • 如果腿部看起来不同,它就知道:“这是编辑的一部分”,并让它保持不变。
      这确保了未受影响部分的毛发和颜色保持与原始状态一致。

结果

通过结合这三种内部修复,VS3D 可以对 3D 资产添加帽子、移除尾巴或改变颜色,而物体的其余部分则完美地冻结在时间中。

  • 无需蒙版:你不需要在你想要更改的部分周围画一个圆圈。
  • 无需重新训练:它完全按照人工智能最初构建的方式工作。
  • 高质量:作者在许多物体上测试了它,发现即使在同时进行添加和移除等复杂更改时,它也能比其他方法更好地保持原始外观。

简而言之,VS3D 就像一位大师级雕塑家,他确切知道如何在雕像上雕刻出新特征,而不会意外地凿掉想要保留的部分,这一切都是通过调整内部技巧而非使用外部胶带或胶水来实现的。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →