Detecting Deception, Not Deepfakes: Why Media Forensics Needs Social Theories
本文认为,仅依赖基于伪影的深度学习检测因“泛化错觉”而日益失效,并提出一个基于言语行为理论和格赖斯合作原则等社会理论的互补框架,通过分析交际互动而非仅仅媒体信号来检测欺骗。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
以下是用通俗语言和日常类比对论文《检测欺骗,而非深度伪造》的解释。
核心难题:“魔镜”陷阱
想象你有一面魔镜,能分辨画作是真是假。多年来,这面镜子非常管用,因为伪造者总会留下明显的破绽:这里有一块颜料污渍,那里有一处怪异的笔触。
但现在,伪造者升级了。他们利用"AI 魔法”创作出完美无瑕的画作,让镜子找不到任何污渍。镜子依然会说:“这看起来 99% 是真的!”但在现实世界中,人们依然上当受骗。这是为什么?
论文指出,我们问错了问题。
- 旧问题: “这张图片或视频是假的吗?”(寻找污渍)。
- 正确问题: “这个人想骗我吗?”(关注意图)。
作者认为,即使我们构建出完美的“伪造检测器”,也无法阻止最危险的诈骗。为什么?因为诈骗者不仅仅是在制作假视频;他们是在进行虚假对话。
“泛化错觉”
作者将当前的局面称为泛化错觉。
这就好比一名保安,他背熟了 1000 名特定罪犯的长相。如果一名戴着保安见过的面具的罪犯走进来,保安会抓住他。但如果罪犯戴着一张保安从未见过的全新面具走进来,保安就会放他过去。
目前的 AI 检测器就像这名保安。它们是在旧有的、特定类型的假视频上训练的。一旦诈骗者使用新的 AI 工具制作视频,检测器就会失效。论文声称,依赖这些检测器,就像试图在堤坝四处崩塌时,只去堵住一个微小的漏洞来阻挡洪水。
新方案:“侦探审讯”
作者提议,我们不应只关注画面(媒体内容),而应开始关注对话(互动过程)。他们建议利用心理学和语言学的三种“侦探工具”来识破谎言,即使视频看起来完美无缺。
以下是他们新框架的三个层级:
层级 1:“谁与何事”核查(言语行为理论)
类比: 想象一个陌生人走到你面前说:“我是你的老板,我现在需要你立刻给我转账 5 万美元。”
- 旧方法: 检查这个陌生人的脸看起来是否真实。
- 新方法: 问:“这个人有提出此请求的权威吗?”
- 运作方式: 在现实世界中,老板通常不会通过随机的 WhatsApp 消息索要资金。如果“言语行为”(请求)与对方的身份或情境不符,这就是一个红旗,即使他们的脸看起来 100% 真实。
层级 2:“对话流”核查(格赖斯准则)
类比: 想象你在和一个朋友交谈,他突然开始用一种奇怪、机械的脚本说话。他们提供了过多不必要的细节,或者突兀地转换话题。
- 准则: 人类遵循着未言明的规则,以做到有帮助、真实且切题。
- 新方法: 诈骗者经常为了催促你而打破这些规则。他们可能表现得过于急切、对细节含糊其辞,或拒绝回答简单的问题。如果对话感觉“不对劲”或“像背稿”,系统就会发出警报,即使声音听起来完美无缺。
层级 3:“高压锅”核查(西奥迪尼的影响力原则)
类比: 一个试图向你推销汽车的推销员。如果他们说:“这是最后一辆,老板在盯着,而且你的邻居刚买了一辆”,他们就是在施加层层压力。
- 准则: 诈骗者利用心理技巧,如权威(“我是 CEO")、稀缺性("5 分钟内完成!”)和社会认同(“其他人都在做”)。
- 新方法: 系统会寻找这些技巧的“堆叠”。如果视频通话同时使用所有这些施压手段来让你不经思考就行动,那很可能就是诈骗。
这一切如何协同工作
论文建议采用双轨系统:
- 轨道 A(旧方法): 检查像素和声音,看媒体是否为合成。
- 轨道 B(新方法): 倾听对话,看行为是否具有欺骗性。
如果轨道 A 显示“可能是假的”,或者轨道 B 显示“绝对是可疑行为”,系统就会发出警报。如果两者都确认,则发出高置信度警报。
为何此刻至关重要
论文指出,现实世界的诈骗(例如 Arup 案中 2500 万美元被盗案)并非被视频检测器识破的。之所以被识破,是因为有人注意到请求很奇怪,或者因为受害者问了一个假 CEO 无法回答的个人问题。
核心结论:
我们无法仅靠构建更好的“伪造检测器”来获胜,因为伪造技术已经变得太出色。我们需要构建更好的“欺骗检测器”,它们能理解人类行为、权威和对话。我们需要停止寻找“画作上的污渍”,转而倾听“画家的故事”。
下一步是什么?
作者承认这很难。这需要新的 AI 测试方法(不仅针对视频片段,还要针对完整对话),以及实时分析语言和心理学的新工具。他们提出了一项研究议程,旨在构建这些新的“对话侦探”,以便在一个“眼见不再为实”的世界里保持安全。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。