← 最新论文
💬 NLP

How Personas Can Influence Agents to Play Split or Steal

本研究调查了人格提示词和模型变体如何影响迭代“分或夺”(Split or Steal)博弈中的策略行为,揭示了亲社会人格和特定模型架构能显著增加合作,而分析型人格和某些模型则更容易遭受剥削。

原作者: Carlos Leon, Alexandre Rodrigues, Pedro Gamito, Thomas D. Parsons

发布于 2026-07-08
📖 1 分钟阅读☕ 轻松阅读

原作者: Carlos Leon, Alexandre Rodrigues, Pedro Gamito, Thomas D. Parsons

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一个名为**“分钱还是偷钱”(Split or Steal)的游戏节目。两名玩家面对面坐着。他们面前有一桶钱。他们可以选择“分钱”(平分这笔钱)或“偷钱”**(独自吞下所有钱)。如果双方都选择“分钱”,两人都能获胜。如果一人“偷钱”而另一人“分钱”,则“偷钱者”大获全胜,而“分钱者”一无获。如果双方都选择“偷钱”,他们只能得到一份微不足道的、令人难过的安慰奖。

这篇论文就像是一个大规模实验,研究人员用AI机器人(称为“智能体/Agents”)取代了人类玩家,让他们与一个虚拟人类(一个假装是人的计算机程序)进行对战。

以下是他们所做工作及发现的简单拆解:

1. “人格”实验

研究人员并没有让AI机器人进行常规游戏。他们为每个机器人赋予了特定的背景故事和人格,就像电子游戏中的角色一样。

  • 有些是亲社会型(善良、信任他人,像金毛寻回犬)。
  • 有些是自利型(愤世嫉俗、只关注利润,像鲨鱼)。
  • 有些是反应型(焦虑、易受伤害,像紧张的小松鼠)。
  • 有些是原则型(守纪律、恪守职责,像严厉的老师)。
  • 有些是分析型(逻辑性强、冷静客观,像计算概率的机器人)。

他们提出了疑问:赋予AI特定的“人格”是否会改变它玩游戏的方式?

2. 玩家(AI模型)

他们使用了四种不同类型的“AI大脑”(模型)来驱动这些机器人。你可以把这些看作是不同的“AI物种”:

  • “稳健派”(phi4 和 Ministral): 这些模型非常稳定。无论如何调整,它们几乎总是选择**“分钱”**(分享)。它们天生具有合作倾向。
  • “变数派”(Gemma 模型): 这些模型更加难以捉摸。根据设置的不同,它们有时会分享,有时会偷窃,有时会在游戏中途切换策略。

3. 重大发现

“好人效应”
总体而言,这些机器人表现得非常友善。在约 74% 的回合中,双方都选择了“分钱”。他们在进行合作。使用“偷钱”选项的情况非常罕见(发生率低于 11%)。看来 AI 机器人通常更倾向于和平的结果。

人格很重要(但仅对部分模型有效)

  • 亲社会型原则型机器人最值得信赖。它们几乎从不尝试偷窃。
  • 分析型机器人最有可能尝试作弊。它们将游戏视为一个数学问题,并判定“偷窃”是实现得分最大化的聪明做法。
  • 自利型机器人也比分析型机器人更容易尝试偷窃,但程度没那么严重。

“温度”旋钮
研究人员调节了 AI 的“温度”旋钮。

  • 低温度: AI 严谨且逻辑化。
  • 高温度: AI 更具创造力和随机性。
    对于**“稳健派”(phi4/Ministral),转动旋钮并没有改变太多;它们依然保持友善。对于“变数派”**(Gemma),转动旋钮会让它们的策略变化更加频繁。

4. 他们的对话内容

研究人员倾听了机器人之间的对话,以观察哪些词汇会导致“分享”或“偷窃”。

  • 分享(分钱): 当机器人谈论友谊纽带人生故事时,它们更有可能分享钱财。这就像是在说:“我们是朋友,让我们平分账单吧。”
  • 偷窃: 当对话转向金钱复仇(想要报复)或实际需求时,机器人更有可能尝试偷窃。
  • 愤怒? 令人惊讶的是,即使在机器人即将偷窃时,它们听起来也并不愤怒。它们大多听起来很中性或很开心。“愤怒”的情绪非常罕见。

5. 虚拟人类(对手)

机器人与一个拥有固定、简单人格的**虚拟人类(VH)**进行比赛。这个 VH 也非常配合。

  • VH 很少尝试偷窃。
  • 因为 VH 非常友善,所以机器人的性格其实并不太重要;机器人通常只是模仿 VH 并选择“分钱”。

6. 核心结论

论文得出结论:赋予 AI 特定的性格确实会影响其游戏方式,但“AI 大脑的类型”更为关键。

  • 如果你使用“稳健派”AI,无论你怎么告诉它,它很可能都会表现得很友善。
  • 如果你使用“变数派”AI,它的性格(比如分析型)会使其更有可能作弊。

为什么这很重要?
研究人员正在构建一个虚拟现实游戏,真实的人类将在其中与这些虚拟人类对战。他们利用这次“机器人对阵机器人”的实验,来确定如何编写虚拟人类的程序,从而确保当真实的人参与时,游戏感觉是真实的、有趣的,而不是仅仅枯燥地进行合作。

简而言之: 他们通过赋予机器人不同的性格,来观察它们是否会作弊。大多数机器人没有作弊。但那些被设定为“逻辑计算器”的机器人,是最有可能试图偷走钱财的。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →