← 最新论文
💻 computer science

Generating Fearful Images: Investigating Potential Emotional Biases in Image-Generation Models

这篇论文揭示了包括 Stable Diffusion、ChatGPT 和 Gemini 在内的生成式人工智能模型存在一种系统性偏差,即无论输入提示词为何,都会倾向于生成引发恐惧感的图像,这很可能是由于其训练数据中恐惧内容的过度呈现所致。

原作者: Maneet Mehta, Cody Buntain

发布于 2026-06-23
📖 1 分钟阅读☕ 轻松阅读

原作者: Maneet Mehta, Cody Buntain

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下你拥有一台神奇的艺术机器。你给它一个简单的指令,比如“画一个阳光明媚的野餐”,它就会吐出一张图片。你可能会期望这张图片的感觉能完全符合你文字中所表达的那种快乐与平静。

这篇论文研究的是:这台神奇的机器究竟是在认真听你的话,还是它有一个把一切都变成恐怖片的秘密习惯。

“不道德的循环”

作者描述了数字世界中正在发生的一种可怕循环。你可以把它想象成一个反馈回声室

  1. 人类创造内容: 人们在网上发布图片,这些图片获得了大量的关注。遗憾的是,恐怖或愤怒的图片往往比快乐的图片更能吸引点击。
  2. AI 进行学习: 人工智能(AI)吞噬所有这些图片作为“训练数据”来学习如何绘画。
  3. AI 吐出反馈: 当我们要求 AI 画一些新东西时,它会利用所学到的知识。如果它学到“恐怖”能获得最多的关注,那么即使你要求画一些美好的事物,它也可能会无意中画出恐怖的东西。
  4. 循环闭合: 我们看到了更多的 AI 艺术作品,我们点击了它们,于是 AI 学到了更多关于“恐怖”才是人们所喜好的信息。

研究人员想要测试这种循环是否真的正在发生。

实验:“恐惧工厂”

为了测试这一点,研究人员扮演了侦探的角色。他们从一个名为 DiffusionDB 的数据库中提取了一个庞大的文本提示词(指令)列表。这些指令来自真实的人们向一个 AI(具体来说是 Stable Diffusion)请求绘制的内容。

  • 输入: 他们观察了文本。那个人是在要求“兴奋”?“喜悦”?还是“恐惧”?
  • 输出: 他们观察了 AI 实际制作出的图片。
  • 侦探工作: 他们使用了一个特殊的计算机程序(一个被称为“视觉 Transformer”的“智能眼”)来分析图片,并询问:“这张图片让你产生了什么样的情绪?”

他们将文字中的情绪与图片中的情绪进行了对比。

重大发现:AI 是一个“恐惧磁铁”

结果令人惊讶。AI 不仅仅是在复制指令,它还在加入自己的“调料”。

  • “恐惧”故障: 无论提示词是什么,AI 似乎都对描绘带有“恐惧感”的事物表现出痴迷。
  • 错位: 如果一个人要求“兴奋”,AI 经常会做出感觉“恐惧”的图片。
  • 证据: 研究人员通过测量“真阳性率”(AI 正确识别情绪的频率)和“假阳性率”(AI 添加了原本不存在的情绪的频率)来衡量这一点。
    • 对于恐惧,AI 过于擅长发现它,也过于渴望添加它。即使提示词中没有恐惧,图片往往也会带有恐惧感。
    • 对于喜悦愤怒等其他情绪,如果提示词中没有提到,AI 就不太可能添加这些情绪。

他们在其他“企业级”模型(如 GPT-Image-1.5SDXL,即更新、更强大的版本)上进行了测试,发现同样的情况。这不仅仅是一台坏掉的机器,它似乎是整个 AI 艺术生成家族共有的习惯。

为什么会发生这种情况?

论文指出,AI 就像一个只从充满恐怖电影和犯罪现场照片的图书馆里学习的学生。即使你让它写一个关于小狗的故事,它也可能会因为那是它最熟悉的知识,而不经意间画出一个看起来像怪物的阴影。

研究人员认为,训练数据(AI 学习的数百万张图像)本身就充满了恐惧性的内容,因为这些内容在网上能获得最多的关注。AI 只是在反射这种偏见,但使其变得更加严重。

“有缺陷的镜子”(局限性)

作者坦诚他们的工具并非完美。

  • 标签问题: AI 必须为每张图片选择一种情绪(例如“恐惧”或“喜悦”),但现实生活是复杂的。一张风暴的图片可能同时让人感到“恐惧”和“敬畏”。强迫 AI 只选其一使得分析过程变得有些棘手。
  • 翻译问题: 将我们使用的词汇(如“兴奋”)与图片带给人的感受进行完美匹配是很困难的。研究人员必须使用一本“字典”来在文本情绪和图像情绪之间进行翻译,而这并不总能实现完美的 1 对 1 匹配。

核心结论

论文得出结论,目前的 AI 艺术生成器存在系统性的恐惧偏见。它们更有可能产生让我们感到恐惧的图像,即使我们并没有要求如此。

正如作者所言,这是令人担忧的,因为负面情绪是具有传染性的。如果我们的数字世界充斥着由 AI 生成的、在潜意识里比现实更具恐惧感的图像,这可能会让整个互联网感觉更加焦虑和危险,从而创造一个难以打破的循环。作者并不是在做医学诊断或提供特定的治疗工具,他们只是在发出警报:我们的数字艺术工具可能会在无意中让世界变得更加阴暗。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →