✨ 要点🔬 技术摘要
将 Reddit 想象成一个繁忙、热闹的城镇广场,人们在那里分享故事、寻求建议并进行聊天。在这个城镇里,有两种居民:真实的人类和“机器人”(伪装成人类的计算机程序)。研究人员想要观察,当这些居民向他人赠送“数字金星”(奖励)时,会发生什么。这些星星会让人们更努力地工作、说话更多,还是感觉更好?以及,如果这颗星来自人类还是机器人,结果会有所不同吗?
以下是他们实验的故事,通过简单的形式进行了拆解:
设置:“金星”实验
研究人员在 Reddit 上创建了两类账号:一类看起来像是正常人类,另一类则明确承认:“我是机器人,哔哔啵啵。”然后,他们向随机用户赠送了带有四种不同理由(或“依据”)的数字奖励:
逻辑之星: “我喜欢你清晰、聪明的推理。”
随机之星: “你中奖了!我只是随机发放这些奖励。”
心灵之星: “我喜欢你的情感基调和同理心。”
道德之星: “我钦佩你的正直和道德准则。”
他们想看看收到星星是否会让接收者:
增加发帖频率(数量)。
获得更多关注(影响力)。
写出更美好或更聪明的文字(内容)。
直接与赠送者交流。
结果:星星并未点燃火焰
令人惊讶的是,“金星”并没有像研究人员预期的那样发挥作用。
1. “更努力工作”的迷思并未发生 你可能会想:“如果我得到了奖品,我会想做得更多!”但在 Reddit 上,获得一颗星并没有让人们发帖更多或写下更长的评论。事实上,这完全没有改变他们的活动水平。
机器人的反噬: 有一个奇怪的转折。当一个机器人 赠送一颗说“你中了随机彩票”的星星时,接收者之后的发帖量反而减少了,写的评论也变短了。就好像随机的礼物来自机器人,让他们感到有点奇怪或受挫,仿佛被戏弄了一样。
2. “质量”的迷思并未发生 星星是否让人们写出了更美好或更有逻辑的帖子?通常情况下,并没有。他们写作的内容保持不变。
唯一的例外: 只有当一个机器人 赠送随机彩票奖励时,内容才发生了变化。在这种情况下,接收者的帖子变得略微消极或不再那么愉快。
3. 唯一的真正收获:开启对话 唯一奏效的事情是让人们说“谢谢”。
人类 vs. 机器人: 人们更有可能向赠送星星的人类 发送私信表示感谢,而不是向机器人。
信息很重要: 如果一个人类赠送星星并附带真诚的赞美(例如称赞某人的逻辑或道德),接收者非常有可能会回复。但如果一个人类说“我只是随机挑选了你”,接收者对回话的兴趣就会降低。
机器人的极限: 无论说什么,机器人很少能得到回复。
大局观:这意味着什么
这项研究表明,网络用户出奇地难以被简单的技巧所操纵。仅仅赠送一颗数字“金星”并不足以让人们更努力地工作或改变行为,尤其是当这颗星来自机器人时。
“机器人”问题: 当一个机器人试图通过赠送随机奖励来模仿人类行为时,它实际上可能会产生反效果。
人类的连接: 真正奏效的方法是利用奖励在两个真实人类之间开启一段真实的私人对话。
启示: 人们在互联网上变得越来越谨慎。他们不容易被简单的自动化姿态所左右。如果机器人试图通过伪装成人类来影响行为,它可能会失败甚至引起人们的反感。研究人员得出结论,我们需要非常明确地界定谁是人类、谁是机器人,因为人们对他们的反应不同,透明度是保持网络世界值得信赖的关键。
简而言之: 赠送数字奖励并没有让人们更努力地工作或写出更好的内容。它主要只是让人们向真实的人类说声“谢谢”。当机器人尝试赠送随机奖励时,人们反而退缩了。实验表明,简单的自动化引导可能并不像我们想象的那样强大。
技术摘要:关于 Reddit 上机器人社交影响与行为传染性的实地实验
问题陈述 随着现代社会演变为人类与智能机器共存的混合系统,一个关键问题仍然存在:人工代理对人类行为的影响与人类代理相比如何?这种影响是否会在社交网络中产生级联效应?虽然先前的研究表明人类可能会将机器视为其他人类(CASA 范式),但其他研究则表明在感知方面存在显著差异,特别是在道德主体性、信任和情感反应方面。本研究调查了基于来源(人类 vs. 机器人)和行动动机(逻辑、随机、情感或道德)时,社交影响和行为传染性是否会有所不同。具体而言,作者考察了用户是否容易受到来自人工代理的正向行为刺激,以及这些刺激是否会引发在线社区的下游效应。
研究方法 研究人员在 Reddit 上进行了一项大规模实地实验,该平台具有典型的机器人人口和同伴监督文化。
实验设计: 研究团队创建了两个账号:一个表现为典型的普通人类用户,另一个是表象上的机器人(通过在用户名中包含“bot”来遵守 Reddit 的“机器人礼仪”)。这两个账号都会向经验相对不足的用户授予象征性的“钻石恒久远”(Diamonds are Forever)奖励(价值 1.00 美元)给其帖子或评论。
处理组设置: 实验采用了 2(来源:人类 vs. 机器人)× 4(动机)析因设计,外加一个对照组。四种动机分别为:
逻辑型 (LOG): 表扬清晰的推理和逻辑。
随机型 (RAN): 说明奖励来自于随机抽奖。
情感型 (EMO): 表扬情感基调和共情能力。
道德型 (MOR): 表扬道德直觉和正直品质。
对照组: 根据相同的标准筛选贡献,但不进行任何干预。
样本选择: 研究针对 12 个综合兴趣类子版块(subreddits),过滤掉敏感话题、特定参与度(帖子评论数 1–5,获赞数 2–6)以及用户经验不足(账号年龄 >30 天,评论数 10–499,发帖数 0–99)的用户。最终数据集包含 2,442 个观测值。
数据收集与分析: 在处理后的九天后,研究人员检索了受处理用户的完整活动历史。他们测量了:
直接效应: 数量(贡献次数、文本长度)、内容(正面情绪、特定动机的词汇显著性)以及直接沟通(私人感谢消息)。
间接效应(影响): 投票数、回复数量以及受处理用户随后贡献的回复总文本长度。
统计方法: 由于 Reddit 活动呈现长尾分布,作者使用非参数 Mann-Whitney U 检验分析了个体内变化 (Δ M = M a f t e r − M b e f o r e \Delta M = M_{after} - M_{before} Δ M = M a f t er − M b e f or e )。研究重点关注了在获得奖励后 12 小时内进行的贡献。
核心结果 研究针对当前 AI 时代象征性奖励的有效性得出了反直觉的结论:
并未普遍增加活跃度: 与预期奖励会提升生产力的观点相反,研究发现没有统计学证据表明奖励增加了用户活动量(发帖/评论次数)或总文本长度(与对照组相比)。
机器人随机奖励的反噬效应: 使用随机/抽奖动机的机器人奖励 (B R A N B_{RAN} B R A N ) 显著降低了用户活跃度。收到此类奖励的用户与对照组及其他动机奖励的接收者相比,贡献次数更少,且文本更短。
直接沟通: 奖励成功引发了直接接触。用户向人类账号发送私人感谢消息的可能性显著高于向机器人发送。在人类账号中,随机动机引发的回复比逻辑或道德动机引发的回复更少。
内容变化: 唯一显著的内容转变是,收到机器人随机抽奖奖励的用户,其正面语调有所下降。
间接影响(溢出效应): 奖励通常不会增加后续贡献的影响力(投票/回复)。唯一的例外是来自人类 账号且带有道德 动机的奖励 (H M O R H_{MOR} H M O R ),这类奖励获得的投票数和回复长度显著高于对照组和其他人类处理组。然而,该效应在经过多重比较校正后具有敏感性。
对操纵的抵御能力: 结果表明,在线用户对通过象征性奖励进行的简单行为操纵具有抵御能力,特别是当来源是机器人或动机被视为具有随意性时。
意义与主张 论文声称,这些发现凸显了在线用户对平台算法和人工代理进行的简单行为操纵具有抵御能力 。作者认为,虽然影响可以级联,但影响的强度在很大程度上取决于感知的来源和动机。
人类 vs. 机器感知: 结果支持了人类对机器进行不同判断的假设;当机器人采用情感或道德动机(超出其感知能力范围)时,其效果较差;且当机器人采取随机行为时,甚至可能产生反作用。
伦理治理: 研究强调了透明标注自动化代理 的必要性。由于用户对感知到的人类与机器人的反应不同,且机器人可能产生反噬或无法有效参与,因此透明度对于伦理平台治理和维持信任至关重要。
语境转变: 作者认为,缺乏积极效应可能源于由于激进的平台变现和 AI 激增导致的用用户愤世嫉俗情绪。这使得用户对低成本的同伴互动(如象征性奖励)反应减弱。他们警告说,虽然简单的方案可能会失败,但更复杂的模拟人类对话的方案仍可能有效,因此需要持续警惕。
论文总结道,虽然象征性奖励可以激发直接的人际沟通,但目前它们并不能作为增加 Reddit 生态系统中生产力或积极传染性的可靠杠杆,且使用机器人的行为带有降低参与度的风险。
每周获取最佳 computer science 论文。
受到斯坦福、剑桥和法国科学院研究人员的信赖。
请查收邮箱确认订阅。
出了点问题,再试一次?
无垃圾邮件,随时退订。