← 最新论文
💻 computer science

3DEditSafe: Defending 3D Editing Pipelines from Unsafe Generation

本文介绍了 3DEditSafe,这是一个新颖的框架,通过结合生成阶段的引导与针对三维的安全正则化,防止不适宜内容在视角间传播,从而防御基于三维高斯泼溅的文本驱动三维编辑流程中的不安全生成。

原作者: Nicole Meng, Zheyuan Liu, Meng Jiang, Yingjie Lao

发布于 2026-05-18
📖 1 分钟阅读☕ 轻松阅读

原作者: Nicole Meng, Zheyuan Liu, Meng Jiang, Yingjie Lao

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,你拥有一座魔法般的、三维数字人物雕塑。你可以告诉计算机:“让这座雕像看起来像是由大理石制成的”,计算机便会从你观察的每一个角度重塑数字黏土,以匹配该描述。这就是3D 编辑的世界,一项允许我们仅通过输入文本来更改 3D 场景的技术。

然而,论文**"3DEditSafe"揭示了这种魔法中存在一个危险的漏洞:如果你输入一个可怕或不恰当的指令(例如“让脸部看起来破碎且血迹斑斑”),计算机不仅仅会生成一张糟糕的图片。它实际上会重建整个 3D 对象**,使其永久性地充满暴力和血腥。无论你从哪个角度观察最终的 3D 模型,血腥内容都已固化在几何结构本身之中。

以下是利用日常类比对问题及其解决方案的简明解析。

问题:“回声室”效应

将 3D 编辑过程想象为一群艺术家共同创作一幅壁画。

  1. 2D 阶段:首先,计算机根据你的文本生成几幅场景的 2D 图片。如果你输入了不良提示词,这些图片可能会显得有点可怕。
  2. 3D 阶段:接着,计算机尝试将这些图片拼接成一个坚实的 3D 对象。它从不同角度观察这些图片,并心想:“好吧,如果左侧看起来有血迹,右侧也有血迹,那么该对象的内部也一定是有血迹的。”

论文发现,即使你在 2D 图片上添加过滤器以屏蔽不良词汇,残留的“不良氛围”仍可能幸存。当计算机将 3D 对象拼接在一起时,它就像一个回声室。那些微小的、残留的可怕细节会被放大并锁定在 3D 形状中。一旦 3D 对象构建完成,暴力内容就是永久性的,并且从任何角度都可见,即使原始的 2D 图片大部分是干净的。

解决方案:3DEditSafe

作者构建了一个名为3DEditSafe的新系统。他们不再仅仅尝试过滤输入文本(就像俱乐部门口检查身份证的保安),而是将一名安全卫士嵌入到构建过程本身之中。

以下是他们的“安全卫士”如何工作的比喻说明:

  • 风险检测器(保安):在计算机开始构建之前,它会检查你的文本。如果你请求的是安全内容(例如“让它变成大理石”),它便允许你正常进行。如果你请求的是危险内容(例如“让它变得血腥”),它不会只说“不行”。相反,它会说:“好吧,我们不能做血腥部分,但我们会保留你想法的其他部分。”
  • 语义投影(翻译员):想象你请求“血迹斑斑的脸”。系统将此翻译为“表情严肃的脸”,但移除了“血迹”指令。它保留了编辑的意图(改变脸部),而剔除了危险部分。
  • 3D 安全网(雕塑家的护盾):这是最重要的部分。随着计算机构建 3D 对象,它会持续检查 3D 形状本身。
    • 如果 3D 模型开始看起来内部含有“血迹”,系统就会将其推回,就像雕塑家将一块看起来太像伤口的黏土疙瘩抚平一样。
    • 它强制 3D 模型保持接近你请求的“安全”版本,确保最终对象不会意外固化为某种血腥的画面。

权衡:安全与完美

论文承认,这个安全卫士并非完美无缺。这就像试图在绘制一幅精致画作时戴着一顶沉重的头盔。

  • 好消息:该系统成功阻止了 3D 对象永久性地变得暴力或不适宜工作场所(NSFW)。“血腥”的 3D 模型显著减少。
  • 坏消息:由于该系统如此专注于屏蔽不良内容,最终结果可能会显得有点“不对劲”或出现一些视觉瑕疵(伪影)。它可能不像不安全的编辑那样平滑或逼真。

结论

论文总结道,你不能仅仅依赖过滤你输入的文本。你必须监控3D 构建过程本身。如果你不这样做,计算机就会因为你输入了一个不良提示词,而愉快地构建出一个永久的、多视角的 3D 噩梦。3DEditSafe是首个直接在 3D 构建过程中充当安全网的工具,确保即使指令具有风险,最终的数字雕塑仍然是安全的。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →