Why Sampling Is Not Choosing: Intentionality, Agency, and Moral Responsibility in Large Language Models
本文认为,大型语言模型不能被视为道德主体,因为无论其生成规范性可评估文本的能力如何,其基于概率和数据的输出都缺乏道德责任所必需的内在意向性、自我归属的承诺以及真正的选择。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
核心问题:AI 可以被责备吗?
想象一下,你要求一个非常先进的 AI 写一个故事、提供建议或解决问题。有时,AI 会说出一些刻薄、错误或不道德的话。这篇论文探讨的核心问题是:我们应该因为 AI 说了这些话而责备它吗?
作者约瑟夫·凯舍特(Joseph Keshet)说:不应该。尽管 AI 听起来像个真人,并且能产生看起来具有“思想”的文本,但它并不是一个道德主体。它无法为其行为承担责任。
核心论点:“承诺”的鸿沟
要承担道德责任(即被责备或被赞扬),一个存在需要具备主体性(Agency)。但不仅仅是任何形式的主体性——它需要一种特定类型的**“承担承诺的主体性”(Commitment-Bearing Agency)**。
可以这样理解:
- 人类: 当你答应和朋友喝咖啡时,你不仅仅是在发出声音。你是在做出一个承诺。你理解自己在做什么,你承担这个决定,如果你没出现,你会感到愧疚,因为是你违背了诺言。你是那个行为的“作者”。
- AI: AI 不会做出承诺。它不“拥有”自己的言语。它只是根据它以前读过的内容,计算下一个最可能出现的词。
论文认为,如果没有这种“我在做这件事,并且我对此负责”的内在意识,就不存在道德责任。
为什么 AI 并不是在“选择”
人们常认为,由于 AI 能够对同一个问题给出不同的答案(这归功于所谓的“采样/sampling”),所以它是在进行选择。论文指出这是一个误解。
类比:掷骰子的厨师
想象一位背诵了数百万个食谱的厨师。
- 人类厨师: 因为饥饿、喜欢吃意面并想要烹饪,所以决定做意大利面。他们会选择食材。
- AI 厨师(掷骰子的厨师): 这位厨师有一个巨大的骰子袋。每当有人询问食谱时,厨师就通过掷骰子来决定下一个词。
- 如果骰子落在“意面”上,厨师就写下“意面”。
- 如果骰子落在“面条”上,厨师就写下“面条”。
输出的结果可能看起来美味且结构完美。但厨师是选择了意面吗?不。是骰子选择了。厨师只是一个遵循掷骰结果的机器。
在 AI 世界中,“采样”仅仅是掷骰子。它创造了多样性,但它不是选择。选择需要理解“为什么”选择其中之一。AI 不知道“为什么”;它只知道统计学上的“下一个是什么”。
机器中的“幽灵”:意向性
论文使用了一个哲学概念——意向性(Intentionality)。这是指心灵能够“指向”某事物的能力。
- 内在意向性(人类): 当你想到一只狗时,你的想法是“关于”一只真实的狗。意义来自于你的内心,因为你体验过世界。
- 派生意向性(AI): 当 AI 写下“这只狗很可爱”时,它并不是在思考一只狗。它只是在操纵符号(单词),这些符号在书籍中经常出现在一起。
类比:字典与旅行者
- 旅行者(人类): 去过巴黎。当他们提到“巴黎”时,他们会想起面包的香气和埃菲尔铁塔的景象。这个词在他们内心是有意义的。
- 字典(AI): 包含了“巴黎”的定义。它知道“巴黎”后面经常跟着“法国”或“埃菲尔铁塔”。但字典从未去过巴黎。它不知道巴黎是什么。它只知道字母的模式。
AI 就像一本超快速的字典。它可以完美地模仿旅行者,但它从未旅行过。因此,它没有引导其行为的“内在生活”或“意图”。
那么“推理”模型呢?
你可能会说:“但有些 AI 可以进行逐步思考!它们能解决数学问题并编写代码。”
论文认为,即使是这些“推理”模型,也只是在以一种高级的方式进行统计猜测。
- 类比: 想象一个正在参加考试的学生,他并不了解答案,但他背下了答案解析以及老师出题的模式。他可以写出一长串逻辑严密的解释,来说明为什么“2+2=4”。但他并不是真正“弄懂了”;他只是预测了“4”是这个句子的最可能结尾。
即使 AI 生成了“思维链”(边思考边输出),它仍然只是基于模式来预测下一个词,而不是真正理解逻辑或关心真理。
结论:谁该负责?
既然 AI 只是一个复杂的模式匹配机器(就像掷骰子的厨师或字典),而不是一个“承担承诺的主体”(像人类那样),那么它不能被责备。
- 论文的判决: 如果 AI 说了一些有害的话,我们不能说“这个 AI 很坏”。我们必须看向人类。
- 谁是负责的? 开发 AI 的人、部署它的公司,以及提出问题的用户。
最终的比喻:
如果一把锤子砸到了人的脚趾,我们不会责备锤子。我们会责备挥动它的人。
- AI 是那把锤子。
- “采样”(随机性)只是锤子在以略微不同的弧度摆动。
- 人类才是握住手柄的人。
论文总结道,我们需要停止将 AI 视为道德人格,而应将其视为一种工具。我们监管的是工具和使用工具的人,而不是工具本身。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。