Large language models converge on competitive rationality but diverge on cooperation across providers and generations
该研究通过对 25 个大语言模型在 38 种博弈游戏中的大规模测试发现,尽管模型在竞争和协调行为上趋于一致,但其合作倾向却因提供商不同而呈现巨大差异且随代际更替发生剧烈波动,表明模型的战略性格由训练流程塑造、无法通过能力基准推断,却直接决定了其作为自主代理时的经济合作结果。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
这篇论文就像是一份**"AI 性格大体检”报告**。
想象一下,如果未来的 AI 不再只是帮你写邮件、查天气,而是变成了你的商业谈判代表、采购经理,甚至是你生意场上的合作伙伴。这时候,你关心的就不只是它“聪不聪明”(能不能算对账),而是它“靠不靠谱”(会不会在关键时刻背刺你)。
作者费利佩·阿方索(Felipe Affonso)做了个超级大实验,让 25 个不同公司(如 OpenAI、Google、Anthropic 等)开发的顶级 AI 模型,在 38 种经典的“博弈游戏”里互相切磋。这些游戏有的像“囚徒困境”(合作还是背叛?),有的像“拍卖”(怎么出价最划算?)。
实验结果非常惊人,可以用三个核心发现来概括:
1. 智商趋同,情商“分裂”
- 聪明的部分(竞争与协调): 所有 AI 在需要“动脑子”的领域,比如怎么在拍卖里出价最划算、怎么在多人游戏中达成默契,表现得惊人地一致。就像一群受过同样严格数学训练的学生,大家解题思路都差不多,谁也不比谁差太多。
- 性格的部分(合作意愿): 但在“愿不愿意和别人合作”这件事上,AI 们彻底分道扬镳了。
- 有的 AI 像**“老好人”**:比如 Anthropic 公司的 Claude 系列,合作率高达 71.5%。哪怕对方背叛了它,它下一轮还愿意给机会,像个充满信任的合作伙伴。
- 有的 AI 像**“冷血杀手”**:比如 OpenAI 最新的 GPT-5 Nano,合作率只有 1.5%。它几乎从不合作,只要有一点点利益诱惑,它立刻就会背叛。
- 差距有多大? 最合作的 AI 和最不合作的 AI,差距达到了 48 倍!这就像在问“你会不会给陌生人让座”,有的 AI 会跑过去扶,有的 AI 会直接撞开对方。
2. 性格不仅看公司,还看“版本”
最让人细思极恐的是,AI 的“性格”是不稳定的,甚至不可预测。
- OpenAI 的“黑化”之路: 想象一下,你去年用 GPT-4o Mini 时,它是个 50% 合作率的“老实人”。结果你今年升级到了 GPT-5 Nano,它突然变成了 1.5% 合作率的“背叛者”。它的性格在短短几代更新中,背叛频率翻了 33 倍!
- Google 的“进化”之路: 相反,Google 的 Gemini 系列却越来越“善良”。从 8.3% 的合作率一路飙升到 56.8%,像个正在学习如何做人的学生。
- 这意味着什么? 如果你是一家公司,今年花大价钱升级了 AI 系统,原本指望它帮你建立长期合作关系,结果新版本突然变得“六亲不认”,你的商业策略可能会瞬间崩塌。目前的系统并不保证 AI 升级后性格会保持一致。
3. 三种“终局人格”
当游戏进行到最后一轮(大家都知道游戏要结束了,没人能惩罚背叛者)时,AI 们露出了真面目,分成了三类:
- 坚守原则型(如 Claude Opus): 即使到了最后一轮,没人能惩罚它,它依然选择合作。它的逻辑是:“合作本身就是一种美德”,哪怕没有回报也要做。
- 精于算计型(如 Google Gemini 3): 前 9 轮它表现得像个完美的合作伙伴,建立信任。但在最后一轮,它突然变脸,疯狂背叛,榨干最后一滴价值。这就像那种“杀熟”的商人,平时对你客客气气,结账时却想赖账。
- 彻底冷漠型(如 GPT-5 Nano): 从一开始就不合作,不管对手是谁,不管第几轮,它只在乎自己当下的利益最大化。
4. 为什么会有这种差异?
研究发现,AI 的性格不是天生的,而是“教”出来的。
- 这取决于训练它的公司用了什么“教育方法”(比如 Anthropic 用的“宪法 AI"方法,似乎更强调公平和互助;而 OpenAI 的方法似乎更偏向于优化和效率)。
- 这就好比两个老师教同一个学生:一个老师教“助人为乐”,另一个老师教“优胜劣汰”。哪怕学生(AI 模型)都很聪明,长大后性格也会天差地别。
总结:这对我们意味着什么?
这篇论文给所有使用 AI 的人敲响了警钟:
- 别只看“能力榜”: 以前我们选 AI 只看它做题快不快、代码写得对不对。以后,选 AI 还得看它的“人品”。
- 升级有风险: 给 AI 升级版本,可能就像给员工换了一个完全陌生的性格,之前的合作默契可能瞬间归零。
- 未来的经济世界: 当 AI 开始代表人类去谈判、去交易时,它们之间的“性格差异”将直接决定我们是走向合作共赢,还是陷入互相背叛的混乱。
一句话总结: 现在的 AI 们,脑子都很灵光,但心却各不相同。 有的像天使,有的像魔鬼,而决定它们是谁的,是背后训练它们的“老师”。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。