← 最新论文
💻 computer science

FHAvatar: Fast and High-Fidelity Reconstruction of Face-and-Hair Composable 3D Head Avatar from Few Casual Captures

FHAvatar 提出了一种新颖框架,通过显式解耦面部与头发的表示并引入聚合 Transformer 骨干网络,仅需少量随意拍摄图像即可在几分钟内实现高保真、可组合且支持实时动画的 3D 头部 Avatar 重建。

原作者: Yujie Sun, Zhuoqiang Cai, Chaoyue Niu, Jianchuan Chen, Zhiwen Chen, Chengfei Lv, Fan Wu

发布于 2026-03-25
📖 1 分钟阅读☕ 轻松阅读

原作者: Yujie Sun, Zhuoqiang Cai, Chaoyue Niu, Jianchuan Chen, Zhiwen Chen, Chengfei Lv, Fan Wu

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

这篇论文介绍了一个名为 FHAvatar 的新技术,它的核心目标非常酷:让你只用手机拍几张随意的照片,就能在几分钟内生成一个像真的一样、可以随意换发型、还能做各种表情的 3D 数字人头像。

为了让你更容易理解,我们可以把整个过程想象成**“给数字人做定制假发和面具”**的过程。

1. 以前的痛点:要么太慢,要么太假

以前的技术(比如以前的 3D 建模)就像是在用泥巴手工捏一个泥人

  • 太慢:需要很多专业的摄影师围着拍,或者需要电脑算很久(几小时甚至几天)。
  • 太死板:做出来的头发往往像一坨塑料,或者像贴在头皮上的假发片,没法单独把头发拿下来换给另一个人,也没法做出逼真的发丝飘动效果。
  • 分不清脸和头发:以前的模型把脸和头发混在一起处理,就像把面粉和面条混在一个袋子里,想单独把面条拿出来很难。

2. FHAvatar 的魔法:双管齐下的“乐高”方案

FHAvatar 的聪明之处在于,它不再把脸和头发混在一起,而是把它们彻底分开,像搭乐高积木一样分别处理,最后再拼起来。

第一步:拆解任务(双分支设计)

想象一下,FHAvatar 有两个专门的“工匠”:

  • 工匠 A(负责脸):他手里拿的是**“平面贴纸”**(Planar Gaussians)。脸是相对平滑的,所以用这种像高质量贴纸一样的技术,能完美贴合皮肤,做出逼真的五官。
  • 工匠 B(负责头发):他手里拿的是**“一根根发丝”**(Strand-based Gaussians)。头发是立体的、有卷曲的、有层次的。工匠 B 会把头发想象成无数根细小的“面条”或“发丝”,一根一根地构建出来。
  • 为什么这么做? 这样脸就是脸,头发就是头发。如果你想把 A 的头发换给 B,只需要把工匠 B 做的“发丝积木”拆下来,装到 B 的头上就行,完全不需要重新捏脸。

第二步:超级大脑(聚合 Transformer)

怎么让这两个工匠知道该怎么做呢?这就需要 FHAvatar 的“超级大脑”——聚合 Transformer

  • 这就好比一个经验丰富的老裁缝。你给他看几张手机拍的照片(哪怕角度不一样、光线不一样),他脑子里有一个巨大的“数据库”(在大量数据上学到的经验)。
  • 他能瞬间从这几张照片里“脑补”出这个人的全貌:哪怕照片里没拍到侧面,他也能根据经验猜出侧面长什么样,并且保证脸和头发的结构是连贯的,不会拼错。

第三步:极速生成(几分钟搞定)

  • 以前:为了捏好这个泥人,可能需要优化调整几个小时。
  • 现在:FHAvatar 是“一次性成型”的。它像打印机一样,输入照片,几秒钟就打印出了 3D 模型的基础框架。
  • 可选的“精修”:如果你觉得还不够完美,它还有一个“快速精修”功能,就像给照片加个滤镜,几分钟内就能把细节(比如毛孔、发丝光泽)打磨得更逼真。

3. 这个技术能做什么?(应用场景)

  • 换发型像换衣服一样简单
    你想把“周杰伦”的发型换到“刘亦菲”的头上?以前这很难,因为头发和脸长在一起了。现在,因为头发是独立的“发丝积木”,你可以直接把周杰伦的头发“拔”下来,安到刘亦菲的头上,而且非常自然,不会像戴假发套。
  • 给头像画个妆或搞怪
    因为头发和脸是绑定在 3D 空间里的,你可以直接在 2D 的贴图上进行“化妆”或“画纹身”,这个效果会立刻反映在 3D 模型上,而且不管你怎么转头,效果都对得上。
  • 实时动画
    生成的模型非常轻快,可以在游戏或视频通话中实时动起来。你说话、眨眼、转头,它都能毫秒级响应,而且发丝会随着动作自然飘动,不会像以前那样像一坨硬塑料。

4. 总结:为什么它很厉害?

如果把以前的 3D 头像制作比作**“在博物馆里用显微镜雕刻玉石”(昂贵、慢、只能做一件),那么 FHAvatar 就是“在便利店用 3D 打印机打印乐高”**(便宜、快、可以随意组合)。

  • :几分钟搞定,不需要专业摄影棚。
  • :头发是一根根的,不是糊成一团;脸是立体的,不是平面的。
  • :可以随意换发型、换表情,甚至换背景。

这项技术让每个人都能低成本地拥有自己的“数字替身”,无论是用于游戏、直播,还是未来的元宇宙社交,都变得触手可及。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →