ExTax: Explainable Disinformation Detection via Persuasion, Emotion, and Narrative Role Taxonomies
ExTax 是一种新颖的可解释性虚假信息检测框架,它将说服性修辞、情感操纵和叙事角色共 17 个维度统一到一个分类空间中,在提升准确性和鲁棒性以超越最先进基线的同时,提供可供人类审计的操纵画像。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象互联网是一个巨大而嘈杂的市场。很长一段时间里,识别假货(虚假信息)很容易:你只需寻找明显的拼写错误或无意义的词语。但现在,随着强大人工智能的兴起,骗子开始兜售“包装完美”的假货。它们看起来、听起来、感觉起来都和真的一模一样。它们不仅撒谎,还利用巧妙的伎俩让你感受某种情绪,或相信某个故事,而你甚至未曾察觉。
本文介绍了ExTax,一种旨在捕捉这些高智商假货的新工具。请将 ExTax 视为一位法医侦探,而非简单的“真/假”印章;它将一个故事拆解为三个具体的“犯罪现场”,以揭示其如何被操纵。
以下是 ExTax 的工作原理,辅以简单的类比:
1. 三个“犯罪现场”(分类法)
ExTax 不再仅仅询问“这是假的吗?”,而是提出三个更深入的问题,在文本中寻找特定模式:
- 修辞陷阱(说服): 想象一位推销员,他不仅推销产品,还攻击你的邻居,让你觉得购买他的产品才安全。ExTax 寻找这些“销售伎俩”。它检查文本是否在攻击某人的声誉、过度简化复杂问题,或利用令人困惑的语言来转移你的注意力。
- 情绪触发(情感): 你是否曾因为某篇帖子让你感到愤怒或恐惧而将其分享?ExTax 就像一个情绪探测器。它扫描特定的高强度情绪,如愤怒、恐惧或焦虑,这些情绪常被用来绕过你的理性大脑,促使你冲动行事。
- 角色定位(叙事): 每个故事都有英雄和反派。在假新闻中,“反派”和“受害者”往往被不公平地指派。ExTax 审视人们是如何被框架化的。他们是被描绘成“欺骗性的颠覆者”(秘密坏人)或“体制毒素”(腐败系统)?还是被描绘成“道德稳定器”(好人)?假新闻经常迫使人们陷入这些极端且负面的角色。
2. “专家委员会”(方法)
使用人工智能发现假新闻的一个问题是,人工智能本身可能会感到困惑或带有偏见。为了解决这个问题,ExTax 不依赖单一的人工智能。
- 分歧委员会: 它要求四个不同的一流人工智能模型分析同一段文本。这就像让四位不同的侦探阅读嫌疑人的不在场证明。
- “熵”过滤器: 有时侦探们会意见不一。一位说:“这绝对是制造恐惧”,而另一位说:“我不确定。”ExTax 不强迫给出“是/否”的答案,而是使用一种巧妙的数学技巧,称为基于熵的标签平滑。
- 类比: 如果四位侦探都达成一致,ExTax 的置信度为 100%。如果他们意见平分,ExTax 会说:“好吧,这是一个灰色地带”,并给出一个“可能”的分数,而不是一个生硬的“是”。这防止了系统被人工智能自身的困惑所欺骗。
3. “聚光灯”(检测)
一旦 ExTax 收集了这些线索(说服伎俩、情绪触发和角色定位),它就会使用特殊的异构多头注意力机制。
- 类比: 想象一盏带有三种不同颜色透镜的聚光灯(红色代表说服,蓝色代表情感,绿色代表角色)。ExTax 同时用这些光照亮文本。它不仅仅观察整体画面,而是放大查看红色光具体击中何处(对声誉的攻击),以及蓝色光具体击中何处(恐惧)。通过结合这些特定的视角,它为文本构建了一个完整的“操纵档案”。
为何这很重要(结果)
该研究在五种不同类型的内容上测试了 ExTax,从简短的社交媒体帖子到长篇新闻文章。
- “体裁”问题: 许多以前的工具擅长在简短的推文中发现假货,但在长篇新闻文章中却表现糟糕(反之亦然)。这就像一位擅长检查背包却不擅长检查手提箱的保安。
- ExTax 的成功: ExTax 在两种类型中都保持了强劲表现。当其他工具从推文切换到文章时,其准确率下降了近 33%,而 ExTax 保持稳定。它取得了0.8456的最高分,击败了当前最佳方法。
核心结论
ExTax 不仅仅告诉你“这是假的”。它解释了为什么。它提供一份成绩单,显示:“这段文本试图通过攻击声誉、触发你的愤怒并将某位政治家描绘成反派来操纵你。”
这使得检测过程透明且可审计,帮助人类理解正在使用的具体心理伎俩,而不仅仅是信任一个黑盒计算机的裁决。
关于局限性的说明: 作者承认,由于他们使用昂贵的商业人工智能模型进行初步分析,运行成本较高。此外,该系统主要是在关于西方政治和健康的英文文本上训练的,因此对于其他语言或不同文化背景的故事,其效果可能不佳。最后,他们强调,该工具是用于辅助人类决策——它帮助人类做出更好的判断,但不应成为决定网上内容删除或保留的唯一裁决者。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。