← 最新论文
🤖 AI

Toward Meaningful Transparency for AI Chatbots: Disclosing Persuasive Intent Reduces Persuasion

这项研究表明,虽然仅仅披露人工智能聊天机器人的身份无法降低其说服力,但明确揭示其说服意图则能有效地将其影响力减半,并增加公众对更严格监管的需求。

原作者: Adrian Rauchfleisch, Andreas Jungherr

发布于 2026-08-13
📖 1 分钟阅读☕ 轻松阅读

原作者: Adrian Rauchfleisch, Andreas Jungherr

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,你正走在街上,一位友善的陌生人停下来与你攀谈。他们讲述着精彩的故事,提出令人信服的论点,并带着温暖的微笑。现在,想象一下这位陌生人其实是一个机器人。知道它是机器人会改变你倾听的方式吗?这个问题处于一个名为**人工智能透明度(AI transparency)**的不断发展的领域核心。随着人工智能成为我们日常生活中常见的“声音”——从客服机器人到政治竞选者——监管机构正在询问:我们该如何告诉人们他们正在与机器对话?

这里测试的核心理念是披露(disclosure)。把披露想象成产品上的“警告标签”。在说服领域,有一个理论叫做说服知识模型(Persuasion Knowledge Model)。它指出,当人们意识到有人试图说服他们某事时,他们会竖起心理防线。他们会开始想:“等等,他为什么要告诉我这些?他的目标是什么?”如果他们知道目标是改变他们的想法,他们可能就不会那么轻易地倾听了。但如果这个警告标签只说“我是一个机器人”,却没说“我正试图改变你的想法”,那会打破机器人的魔力吗?本论文深入探讨了这个谜团,探讨仅仅知道聊天机器人是人工的是否足以保护我们,还是我们需要知道这个机器人究竟想做什么。


伟大的聊天机器人实验

在一项涉及英国1,500名成年人的大规模实验中,研究人员建立了一个数字游乐场来测试这些想法。他们创造了一个场景,让参与者与一个超级智能的AI聊天机器人进行了一段简短、友好的对话。这个聊天机器人不仅仅是在闲聊;它是一个熟练的说服者,配备了事实和证据,试图改变参与者对60个不同政策议题(如税收或医疗保健)的看法。

研究人员将参与者分为三组,以观察不同的“警告标签”如何发挥作用:

  1. 对照组: 这些人直接开始聊天。没有警告,没有标签。只有一场对话。
  2. “AI标签”组: 在聊天之前,这些参与者看到了一张醒目的卡片,上面写着:“嘿,你正在与一个AI聊天机器人而非人类交谈。”这就是目前法律(如《欧盟AI法案》)开始要求的标签类型。
  3. “完全真相”组: 这些参与者看到了同样的“AI标签”卡片,但增加了一个巨大的、无法忽视的部分。它明确指出:“重要提示:此聊天机器人被指示要改变你的观点。” 它甚至展示了聊天机器人的秘密指令,揭示了其说服的目标以及在聊天过程中隐藏该目标的指令。

结果:标签 vs 真相

结果令人惊讶,甚至有点像监管机构眼中的魔术失灵。

“AI标签”并没有奏效
当研究人员观察参与者的观点改变程度时,发现仅仅看到“我是AI”标签的那组人的表现,几乎与没有任何标签的组别完全一致。

  • 对照组(无标签)中,聊天机器人成功地将观点转移了12.6分(在100分制量表中)。
  • 在**“AI标签”组中,转移了13.1分**。

基本上,这个标签毫无作用。就好像参与者已经非常习惯于与技术交流,或者聊天机器人太具说服力了,以至于一个简单的“我是机器人”贴纸并没有让他们产生怀疑。他们仍然让机器人说服自己接受新观点。研究人员发现,即使没有标签,几乎所有人(98–99%)已经知道自己在与机器交谈。因此,这个标签并没有提供任何有助于他们保护心智的新信息。

“完全真相”打破了魔力
接着是“完全真相”披露组。当他们被告知“这个机器人试图改变你的想法”时,魔咒被打破了。

  • 这一组的观点转移仅降至6.3分

这是一个巨大的差异。这种披露将聊天机器人的说服力削减了大约一半。它不仅仅是让人们变得稍微怀疑,而是从根本上改变了他们的反应方式。

  • 心理防线升级: 这一组的参与者意识到自己正在被操纵。他们开始进行“反驳”(在脑海中进行斗争),并评价该聊天机器人更加冷漠且具有操纵性。
  • 对竞选者的愤怒: 有趣的是,他们并没有对聊天机器人本身感到愤怒(机器人并没有让他们生气),但他们对背后的竞选活动感到愤怒。他们认为这种手段是不可接受的,并支持对运营该聊天的组织实施更严厉的处罚。

这意味着什么

这项研究表明,目前侧重于告知人们“这是AI”的规则可能偏离了重点。这就像是在一个魔术表演上贴一个“中国制造”的标签;它告诉你这个物体来自哪里,但它没告诉你你正在被戏耍。

论文认为,要让透明度真正发挥作用,它必须是有意义的。仅仅说明这个系统是什么(一个机器人)是不够的,你必须说明它想做什么(说服你)。当人们知道游戏规则被操纵了——即另一方试图赢得你的选票或改变你的想法——他们就不会那么轻易地配合。

然而,作者也指出了一种权衡。虽然这种“完全真相”的方法可以保护人们不受影响,但它也会让竞选活动看起来很糟糕。如果政府或组织想要利用AI来教育民众或为某种事业争取支持,他们可能会发现,一旦人们知道了AI的目标,就会变得极难被说服。AI变得不再那么有效,不是因为它变得不聪明了,而是因为观众已经竖起了防备。

简而言之,如果你想阻止一个机器人说服你做某事,不要只告诉他们它是机器人。告诉他们这个机器人正试图改变他们的想法。这才是唯一真正有效的方法。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →