← 最新论文
💻 computer science

ReGenHuman: Re-Generating Human Appearances for Realistic Full-Body Video Anonymization

本文介绍了 ReGenHuman,一种新颖的全身视频匿名化流水线,它通过一种“重构而非编辑”的范式,从无身份信息的结构性线索中合成逼真且具有时间一致性的人类外观,从而在隐私保护、视觉质量和下游任务效用之间实现了最佳平衡。

原作者: Adam Sun, Eshaan Barkataki, Arnold Milstein, Gordon Wetzstein, Ehsan Adeli

发布于 2026-06-16
📖 1 分钟阅读☕ 轻松阅读

原作者: Adam Sun, Eshaan Barkataki, Arnold Milstein, Gordon Wetzstein, Ehsan Adeli

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,你有一段关于繁忙医院走廊或拥挤街道的家庭录像。你想分享这段视频来帮助训练 AI 系统(如自动驾驶汽车或医疗机器人),但你无法做到,因为视频中的人是可以被识别出来的。他们的脸部、衣服、走路的方式,甚至衣服上的文字都会暴露他们的身份。

目前,人们处理这种问题的方法就像是用记号笔在人的脸上涂鸦,或者把整个屏幕模糊化。这虽然保护了身份,但却毁掉了视频。AI 从一片模糊的景象中无法学习到任何东西,而且视频看起来也很糟糕。

迎接“ReGenHuman”。

请不要把 ReGenHuman 仅仅看作是一个带着记号笔的编辑器,而要把它看作是一个神奇、极速的画家。它会观看视频,然后从头开始重新绘制整个场景,用全新的、虚构的人物替换掉真实的人。

以下是它的工作原理,分为简单的几个步骤:

1. “幽灵蓝图”(输入)

系统并不会让画家看到真实的人,而是首先将视频简化为一份“幽灵蓝图”。它提取出三个描述人们“在哪里”以及“在做什么”的信息,但这些信息完全不包含任何关于“他们是谁”的信息:

  • 骨架 (The Skeleton): 一个人的姿态线条图(如抬起手臂、行走、坐下)。
  • 轮廓 (The Outline): 一个剪影,显示人体在房间内的精确位置。
  • 深度图 (The Depth Map): 一个 3D 地图,显示物体的远近距离,从而呈现场景的形状,但不显示纹理或颜色。
  • 描述 (The Description): 一段描述场景的文字说明(例如:“三个人站在台上颁奖”)。

至关重要的是,画家从未见过原始的脸部、衣服或皮肤。它看到的仅仅是这些匿名的蓝图。

2. “重绘”(生成)

系统使用一个强大的 AI(视频扩散模型)来观察这些蓝图,并生成一段全新的视频。

  • 它绘制出完美契合线条骨架的新人物。
  • 它绘制出看起来逼真的新衣服和发型。
  • 它保持背景和动作与原视频完全一致。

因为画家从未见过原作者,所以在数学层面上,原作者不可能出现在新的视频中。这就像是你给一位艺术家一张树的照片,并要求他仅根据线框图画出一棵新树;他绝不可能意外地画出照片中那棵完全相同的树。

3. 结果:一段“安全”的视频

最终生成的视频看起来极其逼真。新的人物看起来像真人,动作流畅(没有帧与帧之间的闪烁或抖动),并且能与环境自然互动。

  • 隐私性: 原来的人已经消失了。你无法通过脸部、走路方式或衣服来识别他们。
  • 质量: 视频呈现高清且自然的效果,而不是模糊或像素化的。
  • 实用性: 由于动作和运动被完整保留,AI 系统仍然可以“观看”这段视频并学习人类如何移动、医生如何与患者互动,或者人群是如何行为的。

为什么这很重要?

论文将此方法与旧方法进行了对比:

  • 旧方法(模糊化/遮盖): 就像在脸上画一条黑杠。虽然安全,但视频对学习来说毫无用处。
  • 旧的生成式方法(图像修复/Inpainting): 就像试图在照片的脸上进行涂抹。这往往看起来很怪异,人物在每一帧中可能会发生变化(闪烁),而且有时原始的面部特征仍会泄露出来。
  • ReGenHuman: 这是第一个从设计上保证安全(因为它从未接触过原始数据)且高质量(因为它生成了全新的、真实的视频)的方法。

作者在数千个视频(包括医疗影像)上测试了该方法,发现其在平衡隐私(保持匿名)与实用性(保持视频对 AI 的有用性)方面表现最佳。他们甚至证明,AI 模型在观看这些视频时回答相关问题(例如“医生正在做什么?”)的能力,与观看原始未脱敏视频时的能力几乎一样。

简而言之: ReGenHuman 是一个工具,它获取一段真实人物的视频,彻底抹去他们,然后画入全新的、虚构的人物,让他们表现得完全一样,从而让我们能够在不冒任何隐私风险的情况下,分享和研究视频数据。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →