Co-evolution of social reward and punishment under institutional interventions
这项研究表明,虽然同伴惩罚最有效地促进了合作,且同伴奖励使社会福利最大化,但制度性干预在补贴同伴激励策略而非无条件合作者或直接惩罚背叛者时最为成功,这凸显了最大化合作并不总是等同于优化整体社会效益。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一个每个人都试图和谐相处,但却存在着一种偷偷摸摸的背叛诱惑的世界。这就是经典的“囚徒困境”,一个进化博弈论领域的著名谜题。把它想象成一个小组项目:如果每个人都尽职尽责,大家都能拿“A”;但如果你在别人努力工作时偷懒,你就能白嫖到一个更好的成绩,而那些努力工作的人则会拿到差成绩。在现实生活中,这种情况随处可见:从邻里间分担垃圾清理义务,到各国试图控制污染。科学家们几十年来一直在问一个大问题:我们如何阻止背叛者并让所有人实现合作?
通常,我们认为有两种主要方式来解决这个问题。第一种是“同伴压力”,即普通人惩罚偷懒者或奖励勤奋者。第二种是“制度权力”,比如政府或裁判介入,进行罚款或发放奖金。但如果把这两者结合起来会发生什么呢?如果政府试图去监管那些已经在互相监督的人,情况会如何?这会有所帮助,还是会造成一场混乱?本文正是探讨这个问题,利用数学和计算机模拟来观察奖励与惩罚的不同组合如何改变整个群体的行为。
研究人员建立了一个数字世界,其中包含四种类型的角色:合作者(始终公平对待他人)、背叛者(始终背叛)、社会惩罚者(通过支付少量费用来惩罚背叛者的公平玩家)以及社会奖励者(通过支付少量费用来奖励其他公平玩家的公平玩家)。随后,他们观察了这些群体在两种不同环境下如何为生存而战:一种是“混合型”人群,其中每个人都随机与所有人互动;另一种是“结构化”邻里,人们只与他们的直接邻居互动,就像在一个巨大的棋盘上一样。
以下是他们的发现,其中的转折可能出乎你的意料。
首先,就个人自我监管而言,惩罚是促成合作的核心手段。如果你想阻止背叛者,让邻居愿意进行罚款是最有效的。然而,奖励则是整体幸福感的秘诀。虽然惩罚能制止坏人,但罚款需要成本,这降低了总体的“社会福利”(群体的总幸福感)。相比之下,奖励在增加价值的同时不会造成那么多损失,从长远来看,这会让整个社会更加富足。
现在,让我们引入“机构”(即裁判)。论文测试了当机构决定发放金钱或罚款时会发生什么。
好消息是: 如果机构想要提升合作水平,最好的做法是补贴执行者。给予社会惩罚者和社会奖励者额外的资金会让他们变得更强大,整个群体也会更加合作。这就像政府向社区治安小组提供拨款一样,有助于他们更好地履行职责。
坏消息是: 如果机构试图直接给普通的合作者(那些不惩罚也不奖励任何人的好人)发钱,这基本上毫无作用。这就像是给一个只是坐在教室里而不帮助任何人的学生发奖金;它并不会改变动态平衡。论文指出,如果目标是阻止背叛行为,那么补贴这些“平凡”的合作者是在浪费预算。
悲剧性的错误: 机构能做的最危险的事情是惩罚执行者。论文显示,如果政府开始惩罚社会惩罚者或社会奖励者,整个系统就会崩溃。这就像警察逮捕试图阻止小偷的社区治安小组一样。当你惩罚那些试图维护规则的人时,规则就会消失,背叛者会占据上风,最终所有人都会变得更糟。论文明确指出,最大化合作并不总是意味着最大化社会福利;有时,一个具有高合作率但伴随沉重惩罚成本的系统,实际上对社会是一种净损失。
“背叛者”问题: 一个令人惊讶的发现是,即使有了最好的政策,背叛者也极少完全消失。在模拟中,他们通常会在人群中徘徊。机构的目标并不是要彻底消灭他们(这在这些模型中似乎是不可能的),而是要找出哪些策略组合可以与他们共存,从而保持较高的社会福利。
最后,这项研究表明,如果你是一个试图修复破碎社会的领导者,不要仅仅把钱投给那些“好人”。相反,你应该支持那些积极维护和平的人(惩罚者和奖励者)。无论如何,千万不要惩罚维护和平的人。如果你这样做,你会发现背叛者赢了,好人离开了,整个社区变成了一片荒原。论文通过计算机模拟清晰地展示了这些模式,表明虽然我们无法强求完美的合作,但我们可以设计出能够抑制背叛者并保持总幸福感高水平的系统。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。