← 最新论文
💻 computer science

Abstraction in Style

本文提出了名为“风格抽象”(AiS)的生成框架,通过将结构抽象与视觉风格化解耦,利用中间抽象代理在无需显式几何监督的情况下,实现对非真实感及插画风格中深层结构重构的有效迁移。

原作者: Min Lu, Yuanfeng He, Anthony Chen, Jianhuang He, Pu Wang, Daniel Cohen-Or, Hui Huang

发布于 2026-04-01
📖 1 分钟阅读☕ 轻松阅读

原作者: Min Lu, Yuanfeng He, Anthony Chen, Jianhuang He, Pu Wang, Daniel Cohen-Or, Hui Huang

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

这篇论文介绍了一种名为**“风格中的抽象”(Abstraction in Style,简称 AiS)的新技术。简单来说,它能让 AI 不仅学会把一张照片“画成”某种艺术风格(比如油画或素描),还能学会像艺术家那样“重新思考”物体的形状**。

为了让你更容易理解,我们可以用**“做一道菜”“盖房子”**的比喻来拆解这个技术。

1. 以前的 AI 做菜:只换调料,不换食材

传统的“风格迁移”技术(比如把照片变成梵高风格)就像是一个只会换调料的厨师

  • 输入:你给他一张真实的牛排照片(目标图像)。
  • 操作:他给牛排涂上厚厚的油画颜料,加上梵高的笔触。
  • 结果:虽然看起来像油画,但牛排还是那个牛排,形状、比例、甚至多余的细节都原封不动。
  • 问题:很多艺术风格(比如插画、漫画)不仅仅是换颜色,它们会简化物体。比如画一只猫,艺术家可能会把复杂的毛发简化成几根线条,把胖乎乎的身体画得修长。以前的 AI 做不到这一点,它太“老实”了,不敢改变物体的原始结构。

2. AiS 的做法:先“重塑骨架”,再“穿上外衣”

AiS 就像是一个懂艺术的大厨,它把做菜分成了两个明确的步骤:

第一步:重塑骨架(Structural Abstraction)—— “把食材切好,去掉多余部分”

在正式上色之前,AiS 会先对照片进行“大改造”。

  • 比喻:想象你要做一道抽象派雕塑。你先把真实的牛(目标图像)放进机器里,机器把它变成了一根**“隐形骨架”**(Hidden Backbone)。这根骨架去掉了所有毛皮、纹理和复杂的细节,只保留了最核心的轮廓和连接关系(比如头在哪里,腿在哪里)。
  • 关键动作:然后,AI 会观察参考的画作(比如参考图里,艺术家是如何把一只胖猫画成瘦长线条的)。AI 学习这种**“变形逻辑”,把刚才那根“隐形骨架”按照参考画的风格进行扭曲、简化或夸张**。
    • 例子:如果参考画喜欢把圆滚滚的东西画成三角形,AI 就会把骨架里的圆形部分“捏”成三角形。
  • 产出:这就得到了一个**“抽象代理图”(Abstraction Proxy)。它既不是原图,也不是最终画作,而是一个“已经按照艺术风格重新设计过形状”的半成品**。

第二步:穿上外衣(Visual Stylization)—— “给骨架穿上风格化的衣服”

现在,形状已经按照艺术家的意图改好了,接下来就是上色和加纹理。

  • 比喻:拿着刚才那个“被重新设计过的骨架”,AI 再穿上参考画那种独特的“衣服”(笔触、颜色、质感)。
  • 产出:最终生成的图片。因为形状已经在第一步改好了,所以这张图看起来既像参考画,又像目标物体,而且结构非常自然,不会像以前那样生硬。

3. 核心魔法:视觉类比(Visual Analogy)

这个技术最聪明的地方在于它怎么学习。它不需要人类告诉它“把圆变成方”的具体数学公式。

  • 比喻:它玩的是**“看图猜谜”**的游戏(视觉类比)。
    • 它看到:参考图 A 的骨架 \rightarrow 参考图 A 的成品。
    • 它学会:哦!原来在这个风格里,骨架是这样变形的。
    • 它应用:现在给你目标图 B 的骨架,请你也用同样的逻辑把它变形,再变成成品。
  • 这就好比教小孩画画:你给他看“老师画的猫”和“老师画的狗”,他学会了老师画猫和狗的比例逻辑,然后让他画一只“老虎”,他就能画出符合老师风格的、结构合理的老虎,而不是把真老虎的照片硬套上颜色。

4. 为什么这很厉害?

  • 更自由:以前的 AI 被原图的结构“锁死”了。AiS 解开了这把锁,允许 AI 为了艺术效果去改变物体的形状(比如把复杂的建筑简化成几何图形)。
  • 更可控:你可以像搭积木一样,把“改变形状的逻辑”(第一步)和“上色风格”(第二步)分开。
    • 例子:你可以用“卡通猫的形状逻辑” + “水墨画的风格”,或者“极简线条的形状逻辑” + “油画的风格”。这种混搭能力是以前做不到的。
  • 更真实:生成的图片看起来更像是人类艺术家精心创作的作品,而不是机器生硬的拼凑。

总结

AiS 就是一个“先想好怎么改形状,再决定怎么上色”的 AI 艺术家。

它不再满足于只是给照片“换层皮”,而是学会了像真正的艺术家一样,提炼事物的本质,大胆地改变结构,从而创造出真正具有艺术灵魂的图像。这就好比它不再只是给房子刷漆,而是先根据设计图重新盖了一座房子,再刷上漂亮的油漆。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →