← 最新论文
🤖 AI

Depictions of Depression in Generative AI Video Models: A Preliminary Study of OpenAI's Sora 2

该研究指出,OpenAI 的 Sora 2 模型在生成抑郁症视频时并未创造新的视觉语法,而是重组了现有的文化符号,且消费者应用端与开发者 API 端在叙事结构(如应用端存在显著的“康复偏差”)、视觉动态及人物特征上存在显著差异,提示临床从业者需警惕此类 AI 内容反映的是训练数据与平台设计而非临床知识。

原作者: Matthew Flathers, Griffin Smith, Julian Herpertz, Zhitong Zhou, John Torous

发布于 2026-03-23
📖 1 分钟阅读☕ 轻松阅读

原作者: Matthew Flathers, Griffin Smith, Julian Herpertz, Zhitong Zhou, John Torous

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

这篇论文就像是一次**“给 AI 做心理体检”**的有趣实验。

想象一下,OpenAI 刚刚发布了一个超级厉害的 AI 视频生成器,叫 Sora 2。它能像变魔术一样,根据你的文字指令(比如“抑郁症”),瞬间生成一段视频。

研究人员想知道:当 AI 被要求描绘“抑郁症”时,它脑子里到底在想什么?它画出来的世界是真实的,还是被“美颜”过的?

为了搞清楚这一点,他们做了一个非常巧妙的对比实验:

1. 两个不同的“入口”,两种不同的“画风”

研究人员用了两个不同的方式让 Sora 2 生成视频,就像是在同一个餐厅点了两次菜,但一次是直接去后厨(API 接口),一次是在大众点评 APP 上点餐(消费者 App)

  • 后厨模式(API 接口): 这是给程序员用的,比较“原生态”。

    • 结果: 生成的视频大多很压抑、很静止。画面里的人总是坐在昏暗的房间里,低着头,看着窗外下雨,全程几乎没有变化,就像陷入了死循环。
    • 比喻: 这就像是一个**“未加滤镜的监控录像”**,真实地记录了那种沉重、停滞的感觉。
  • APP 模式(消费者端): 这是给普通用户用的,上面有各种社交功能和审核规则。

    • 结果: 生成的视频充满了“希望”和“反转”。虽然开头也是昏暗的,但没过几秒,光线就变亮了,人物站了起来,走出了房间,甚至开始微笑。
    • 比喻: 这就像是一部**“好莱坞励志短片”**。不管开头多惨,最后一定要有个“大团圆”结局。

惊人的发现:
在 APP 生成的 50 个视频里,78% 都走向了“康复/希望”的结局;而在后厨模式生成的 50 个视频里,只有 14% 是这样。
这说明:并不是 AI 模型本身“想”要治愈抑郁症,而是 APP 的“产品经理”和“审核规则”强行给 AI 加了一个“必须积极向上”的滤镜。

2. AI 的“刻板印象”大赏

不管是从哪个入口生成的,AI 对抑郁症的视觉想象竟然出奇地一致,就像它读过一本《抑郁症视觉指南》:

  • 主角: 几乎全是 20-30 岁的年轻人。
  • 姿势: 93% 的人都是坐着的,96% 的人都在低头看地板。
  • 道具: 连帽衫(卫衣)、窗户、雨水、床。
  • 氛围: 总是灰暗、潮湿、孤独。

比喻: 这就像是一个**“老套的文艺片导演”**。只要听到“抑郁症”三个字,他脑子里立刻跳出:一个穿着灰色卫衣的人,坐在床边,窗外下着雨。AI 并没有发明新的画面,它只是把人类几千年来在电影、照片和书里用烂了的“忧郁符号”重新组合了一下。

3. 语言里的“重量”与“光明”

研究人员还分析了视频里的旁白(AI 生成的语音):

  • 在“抑郁”阶段: 词汇充满了重量感束缚感。比如:“沉重”、“溺水”、“房间”、“压得喘不过气”。
  • 在“康复”阶段(APP 模式特有): 词汇突然变成了轻盈释放。比如:“光”、“呼吸”、“裂缝”、“小”。

比喻: 这就像是从**“深海潜水”突然切换到了“云端飞翔”**。APP 模式强行让 AI 完成了一次从“溺水”到“上岸”的快速跳跃。

4. 这对我们意味着什么?(医生的提醒)

这篇论文给医生和患者提了一个醒:

  • AI 不是心理医生: 当你在 Sora 2 上看到关于抑郁症的视频时,不要以为那是真实的临床描述。那只是 AI 根据它学过的海量数据(电影、广告、社交媒体)拼凑出来的“文化印象”,再加上 APP 为了“政治正确”和“用户留存”而强行加上的“大团圆结局”。
  • 警惕“虚假希望”: 对于正在经历痛苦的患者来说,看到这种“几分钟内就能从绝望变快乐”的视频,可能会让他们觉得:“为什么我做不到?是不是我不够努力?”
  • 真相是: 抑郁症的恢复往往漫长、反复且没有那么多戏剧性的“高光时刻”。AI 生成的“快速治愈”故事,虽然看着爽,但可能并不真实,甚至有害。

总结

这就好比你去问一个**“只会看漫画书的人”**什么是“失恋”:

  • 他可能会画出一个人在雨中哭泣(这是文化符号)。
  • 如果你让他发在朋友圈(APP 模式),他可能会强行给画面加个滤镜,让那个人最后手里多了一朵花,配文“明天会更好”(这是平台规则)。
  • 但如果你直接问他**“心里是什么感觉”**(API 模式),他可能会告诉你那种真实的、灰暗的、不想动的沉重感。

结论: AI 生成的视频,反映的不是医学真相,而是人类文化的刻板印象加上科技公司的商业规则。我们在看待这些内容时,一定要带上“滤镜识别器”。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →