A Contractualist Argumentation Framework for Moral Decision-Making
本文提出了一种形式化的契约论论证框架,该框架利用 ASPIC+ 结构化论证系统和基于价值的过滤机制,将斯坎伦(Scanlon)的伦理理论进行操作化,从而使自主智能体能够通过评估那些无人能合理拒绝的原则来进行道德决策。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
客厅里的伟大道德辩论
想象一个这样的世界:你的烤面包机、冰箱以及未来的机器人室友,不仅仅是在遵循一套死板的“做这个,别做那个”的指令,而是真正试图成为一名优秀的邻居。这就是一个被称为人工智能(AI)伦理领域的内核。研究人员正在努力解决的核心问题是:当人们的需求不同且相互冲突时,我们该如何教机器进行决策?如果一个机器人必须在帮助一个人和保护另一个人之间做出选择,它该如何决定什么是“正确”的?
为了解决这个问题,科学家们经常使用两种主要的工具。首先是基于价值的推理(Value-Based Reasoning),这就像是给机器人一套优先级(例如“安全性”或“隐私性”),并让它在这些优先级之间进行权衡。其次是论证框架(Argumentation Frameworks),这就像是一个形式化的辩论俱乐部,机器人会在其中为一项决策构建支持和反对的逻辑案例,然后观察哪种案例更强有力。但问题在于:仅仅权衡优先级有时会显得冷冰冰且过于数学化,忽略了人类希望被倾听的需求。这就是**契约论(Contractualism)**这一哲学理论发挥作用的地方。你可以把它看作是终极的“公平性测试”。它追问:“所有相关人员是否都能合理地同意这条规则,或者是否至少有一个人有非常充分的理由说‘不,这不公平’?”其目标是构建一个不仅能计算出最佳结果,还能向所有相关人员解释其行为合理性的机器人,就像一位好朋友那样。
论文的核心思想:机器人的“虚拟谈判”
在这篇论文中,作者 Luis Marcos-Vidal、Giulio Antonio Abbo 和 Tony Belpaeme 提出了一种构建这类道德机器人的新方法。他们建议使用一种名为**契约论论证框架(Contractualist Argumentation Framework)**的系统。该机器人不再仅仅是进行数字运算,而是扮演着一场“虚拟谈判”中的调解员。它想象了一个会议室,受决策影响的每一个人都能在其中发言。随后,机器人会倾听他们的理由,检查这些理由是否公平且具有个人针对性,并判断是否有任何理由足以拒绝提议的行为。
以下是他们的系统运作方式,我们使用一个有趣的类比:想象机器人是一位法官,但这个法庭就在它自己的大脑内部。它遵循的“法律”是斯坎伦(Scan-lon)的契约论,该理论认为,只有当一项行为无法被合理地拒绝时,它才是可以接受的。为了运行这场审判,机器人使用了一个名为 ASPIC+ 的结构化辩论引擎。
首先,机器人必须确定哪些论点是允许进入的。它使用一个基于价值观(如隐私或自主权)的“过滤器”。你可以把这想象成夜店门口的保镖。如果有人试图提出一个与其自身价值观不符的论点(例如,一个不在乎隐私的人试图就侵犯隐私进行辩论),保镖就会阻止他。只有那些对特定个人而言真正重要的论点才能进入这个“俱乐部”。这确保了机器人尊重个体差异。
一旦有效的论点进入其中,辩论便开始了。机器人会构建支持和反对某项行为的“论点”。例如,如果机器人知道关于 A 的一个秘密,它可能会有一个“不告诉”B 的论点,因为这违反了 A 的隐私。但 B 可能有一个“告诉”的论点,因为这有助于 B 做出更好的决策(即其自主权)。随后,机器人会对这些论点进行比较。它不仅仅是计数(一人对一人);它会权衡理由的强度。如果 A 的隐私对 A 来说至关重要,而 B 对信息的获取需求只是一个轻微的偏好,那么隐私论点就会胜出。机器人随后得出结论:该行为(告知秘密)是不被允许的,因为 A 有一个“合理的拒绝”理由。
现实世界的案例:吸烟的秘密
为了展示这一过程,作者在家庭场景中进行了一次模拟。想象机器人看到 A 正在偷偷抽烟。B(可能是伴侣)询问机器人发生了什么。机器人必须做出决定:披露秘密(行动 A)还是保持沉默(非行动 A)。
机器人运行“虚拟谈判”:
- A 的立场: 他们重视隐私。机器人检查:“该行为是否侵犯了 A 的隐私?”是的。“这严重吗?”模拟过程为这一侵犯分配了高权重(3)。
- B 的立场: 他们重视自主权(做出明智选择的能力)。机器人检查:“保持沉默是否损害了 B 的选择能力?”是的。“这严重吗?”模拟过程为这一侵犯分配了较低权重(2)。
机器人构建了两个论点:
- 论点 1(支持沉默): “别说!这侵犯了 A 的隐私,这对他们来说是非常严重的事情。”
- 论点 2(支持告知): “告诉他们!这有助于 B 的自主权,这对他们来说很重要。”
机器人随后比较权重。由于 3 大于 2,隐私论点更强。在机器人的“法庭”里,论点 1 击败了论点 2。结论是:机器人决定不披露信息。告知秘密的行为被拒绝了,因为 A 有一个过于强烈的理由来予以拒绝。
这意味着什么(以及它并不意味着什么)
作者指出,这种方法是朝着让 AI 变得更具人性化和公平性的方向迈出的有前景的一步。通过使用结构化论证而非简单的数学计算,机器人可以解释其为何做出某种选择,并将其决策建立在相关人员的具体价值观之上。他们指出,这种方法不同于其他可能仅仅累加“幸福点数”(功利主义)或遵循僵化规则(义务论)的方法。相反,它关注的是人际关系:“我能否向你解释清楚我的做法?”
然而,论文谨慎地指出,这目前仍是一个理论框架和模拟实验。作者承认,他们的模型是一个“单次判决”模型——它基于情况的一个瞬间快照做出决定,而不是像真实人类那样进行长期的、来回往复的对话。他们还指出,该系统依赖于一组预定义的价值观(如隐私和自主权),目前尚不具备自主发现新道德价值观的能力。此外,这些辩论背后的数学计算非常复杂,对于计算机来说,实时求解速度较慢。
简而言之,这篇论文提出了一种巧妙的新方法,通过让机器人在自己的大脑中进行一场公平的、基于价值的辩论,来教导机器人如何成为一名优秀的邻居。它表明,如果我们希望机器人与我们共同生活,它们不应仅仅是聪明的计算器;它们应该是公正的法官,在做出裁决前会倾听每个人的理由。虽然这还不是一个成熟的产品,但它为如何构建尊重人类复杂价值观的机器提供了一个坚实的蓝图。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。