A Marketplace for AI-Generated Adult Content and Deepfakes
本文通过分析来自 Civitai 平台的 14 个月数据集,揭示了其货币化赏金系统不成比例地激励了针对女性名人的非自愿、非礼勿视(NSFW)深度伪造内容的创作,从而凸显了社区驱动型生成式人工智能市场中显著的性别化伤害与治理挑战。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一个规模宏大、繁忙的数字市场,名叫 Civitai。你可以把它想象成一个巨大的、高科技的跳蚤市场,人们在这里交易的不只是实物商品,而是 AI 生成的图像和工具。
在这个市场中,有一个特殊的板块叫做 “悬赏”(Bounties)。你可以把“悬赏”理解为一个“通缉令”,只不过通缉的不是罪犯,而是在寻找特定的图片或 AI 工具。一个人(“支持者”)发布请求,说:“我想要一张穿着燕尾服的猫的照片”,并在桌上放下一笔现金奖励(以虚拟代币“buzz”的形式)。其他用户(“创作者”)则通过竞争来制作这张图片。第一个做对的人将赢得这笔钱。
该论文的研究人员决定调查这个市场,以了解人们到底在请求什么、是谁在请求,以及规则是如何被遵守的。他们查看了 14 个月内发布的每一张“通缉令”。以下是他们的发现,为了方便理解进行了简化处理:
1. “成人”板块正在占据主导地位
研究人员发现,虽然人们会请求各种各样的东西(如艺术品或 Logo),但很大一部分请求是针对 NSFW(不适合工作场合) 内容的——基本上就是成人或露骨的内容。
- 趋势: 在研究初期,这些请求仅占少数。但随着时间的推移,它们稳步增长。到 14 个月结束时,近一半的请求都是为了成人内容。
- 工具: 这些请求大多不仅仅是为了单张图片,而是要求制作 LoRA。你可以把 LoRA 理解为一种“特殊的说明书”或“滤镜”,你可以下载并永久使用它。一旦有人创建了一个可以生成特定成人图像的 LoRA,任何人都可以使用这个工具来生成无限的变化。该市场正被那些试图通过购买这些“说明书”来引导 AI 模型去做其原本并非设计初衷的事情的人所主导。
2. “深度伪造”(Deepfake)问题:谁成为了目标?
在这种语境下,“深度伪造”是指请求生成一个真实存在的、活着的个体(如名人)的图像,而那个人实际上并未为这张照片摆过造型。
- 性别差距: 研究人员发现了一个令人震惊的不平衡现象。如果你观察所有生成真实人物图像的请求,其中 10 个中有 9 个是女性。这些目标的绝大多数是女性名人、女演员和网红。
- “自我”漏洞: 一些人试图绕过规则,声称:“我是在请求一张我自己的照片”或者“我妻子的照片”。研究人员发现,这些说法往往无法验证,而且实际上并没有解决“知情同意”的问题。
3. “超级请求者”
研究还观察了谁在发布这些请求。这并不是一种每个人都发布一点点内容的公平、平等的分布。
- 20% 法则: 大约 20% 的用户 贡献了大约 一半的请求。
- 深度伪造的集中度: 这种集中现象在深度伪造领域更为显著。一小部分人驱动了绝大部分生成真实人物图像的请求。
4. 并不总是出现的“警告标志”
Civitai 有一条规则:如果你请求一张真实人物的照片,系统应该在该页面上显示一个 警告标志。该标志会提示:“嘿,这是一个真实的人物。我们只允许安全图像,且该人士可以要求我们删除此内容。”
- 差距: 研究人员检查了该警告标志是否真的出现了。
- 对于真实人物的“安全”(SFW)请求,该标志在 86% 的情况下出现了。
- 对于真实人物的“成人”(NSFW)请求,该标志在 42% 的情况下缺失。
- 结论: 尽管平台有规则,但在最需要出现警告标志的时候——即请求涉及露骨内容时——该标志经常缺失。
总结
论文得出结论,这个市场已演变成这样一个地方:一小部分用户在大量驱动着对 成人内容 和 真实女性图像 的需求,并且经常利用特殊的 AI 工具(LoRA)来绕过安全过滤器。虽然平台设有规则和警告标志,但执行并不一致,尤其是在处理最敏感且可能具有危害性的请求时。
重要提示: 研究人员仅查看了请求(人们要求了什么),而不是最终生成的图片,也没有研究人们进行这些请求的个人动机。他们仅仅是绘制出了这个数字餐厅里正在被订购的“菜单”。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。