Evidence of conceptual mastery in the application of rules by Large Language Models
本文采用心理学方法和对比实验,证明了大语言模型在应用规则方面展现出了概念掌握能力,这体现在它们能够复制多样化的人类决策模式,以及对时间压力下情境依赖性反应的能力。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
几十年来,机器是否能够真正理解,一直是人工智能领域背景中一个低声回响的问题。当一台计算机写下一首诗或解决一道数学题时,人们往往难以分辨它究竟是领悟了文字背后的含义,还是仅仅在重复它曾经见过的模式——就像一个只靠死记硬背练习题答案而并不理解学科内容的优等生一样。这种真正的理解与机械记忆之间的区别,是研究大型语言模型(即那些能够进行对话、推理和创作的强大计算机系统)的研究人员面临的核心谜题。为了探究这些机器是否拥有对概念的真实掌握,科学家们寻找的证据是:它们能否在新的情境中灵活地应用规则,而不仅仅是重复被告知的内容。如果一台机器能够通过理解意图来驾驭复杂的规则,即使措辞发生了变化或情境变得陌生,这也表明它具备了一种更深层次的能力。这不仅仅是一个学术上的好奇心;随着这些工具开始出现在法律环境和其他高风险领域,了解它们是在真正推理还是仅仅在模仿,已成为一个具有实际意义的问题。
一个研究小组致力于通过让人工智能接受一系列严苛的测试,来验证这一问题,旨在将记忆与真正的理解区分开来。他们专注于人类和机器如何应用规则,特别关注了规则的字面文本与其潜在目的发生冲突的情况。想象一下,一家餐厅里挂着一块牌子写着“禁止携带狗”,其目的是为了保持地面清洁并防止噪音。如果一个人带着一只吵闹且不听话的狗走进来,那么从规则的文本和目的来看,他都违反了规则。但如果一位盲人带着一只训练有素的导盲犬走进来呢?文本上说禁止带狗,但规则的目的并未被破坏。研究人员想要观察机器是否能像人类一样,在规则的文本与目的之间进行权衡,并且即便在面对完全陌生的场景时也能做到这一点。
在研究的第一阶段,科学家们创建了一套全新的场景,这些场景在机器接受训练之前从未在互联网上发布过。这是至关重要的一步,以确保模型不仅仅是在背诵其训练数据中记忆的答案。他们要求人类参与者和几种不同的大型语言模型判断故事中的角色是否违反了规则。结果令人震惊。机器并非在瞎猜;它们的判断与人类的判断高度一致。当新的故事使得规则的文本重要性低于其目的时,人类和机器都以同样的方式转变了思维,即减少对严格措辞的权重,而更多地关注规则背后的原因。这表明这些模型不仅是在回忆旧例,而且实际上是在应用一种对规则运作方式的通用理解。
为了确保这并非由提问方式特定所导致的偶然现象,研究人员随后更改了给予机器的指令,甚至反转了答案量表的数值。他们要求模型在不同的系统提示词和不同的选项标签下做出反应。尽管进行了这些改变,核心模式依然保持稳定。机器继续以模仿人类直觉的方式,在规则的文本与目的之间进行平衡。这种稳健性表明,它们的理解并非脆弱的,也不依赖于问题的某种特定技巧,而是一种即使在任务表面细节发生变化时依然成立的既定能力。
随后,研究人员引入了一个人类会经历但机器不会经历的变量:时间压力。在人类研究中,当人们被迫快速回答时,他们往往会更多地依赖规则的字面文本,而较少考虑规则的目的。当给予更多思考时间时,他们则能更好地考虑规则的精神。科学家试图通过告诉机器它们只有几秒钟的时间来回答来复制这一过程,尽管无论指令如何,机器处理信息的速度都是一样的。这里的实验结果各异,取决于具体的模型。一些较新的小型模型似乎模仿了人类对时间压力的反应,表现得像是正在匆忙应答。然而,其他模型则完全忽略了时间限制,无论被告知要赶快还是等待,它们应用规则的方式都保持一致。这种分歧具有启发性:那些忽略无关时间压力的模型展现出了一种更稳定的能力,这种能力不会因为一个对其思考能力并无实际影响的信号而动摇。
最后,团队测试了通过允许机器生成更长的推理链来增加“思考”时间,是否会改变它们的答案。对于大多数模型而言,增加推理投入并不会改变它们的判断。无论是在被要求快速思考还是深入审视,它们应用规则的流畅度都是一样的。这反映了人类应用熟悉概念的方式:我们不需要每次遇到规则时都重新推导其逻辑。研究结果表明,对于这些模型来说,规则的概念已经掌握并随时待用,而不是每次遇到都需要从头开始重建。
该研究得出结论,虽然这些机器并非人类思维的完美复制品,但它们确实展示了真正的概念掌握迹象。它们可以将其理解泛化到新情境中,在任务变化时保持稳定,并且无需过度思考细节即可应用规则。证据指向这样一个观点:它们并非仅仅在记忆模式,而是可能已经发展出了一种灵活的语义能力。这并不意味着它们是人类,也不意味着它们是无懈可击的,但这确实表明它们对规则进行推理的能力不仅仅是一种高级的模仿形式。随着这些工具与社会的融合程度不断加深,理解这种能力的本质对于了解如何信任并使用它们至关重要。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。