← 最新论文
💻 computer science

The Machine's Internal Clock: Do LLMs Share Human Temporal Illusions?

这项研究表明,尽管人类读者在纯文本叙事中通常未能表现出特定的时间错觉,但大型语言模型却出人意料地符合文献所预测的错觉,这很可能是因为它们检索了心理学研究,而非模拟了真实的人类式时间偏差。

原作者: Catherine Bao, Vivek Srikumar

发布于 2026-08-18
📖 1 分钟阅读☕ 轻松阅读

原作者: Catherine Bao, Vivek Srikumar

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

时间的感觉会随着周围发生的事情而不同。在医生诊所等待的一分钟可能感觉像一个小时,而与朋友欢笑的一个小时却可能转瞬即逝。心理学家早已知晓,我们的大脑并不会像秒表那样精准地滴答计时。相反,我们的时间感是由语境、注意力以及我们处理新信息的量所构建的。当我们感到无聊或等待时,我们会更加注意到时间的流逝,从而觉得时间变长了。当我们全身心投入或感到惊讶时,注意力从时钟上转移开,时间似乎就加快了。这些不仅仅是感觉上的奇特之处,它们是经过充分证实的思维陷阱,被称为“时间错觉”——在这种现象中,大脑根据经验而非客观测量来构建时间感。

随着人工智能系统越来越擅长理解和生成人类语言,一个自然的问题随之而来:这些机器是否也以我们的方式体验时间?它们是否也拥有我们那种基于情感或新颖性而导致时间拉伸或缩短的主观感,还是仅仅像计算机程序一样计算事件的持续时间?犹他大学的研究人员为了回答这个问题,进行了一项测试,旨在观察大型语言模型(即许多现代聊天机器人背后的强大人工智能系统)是否也会掉入人类会陷入的那些时间陷阱。他们想知道,这些模型是否拥有类似人类的主观时间感知,或者它们仅仅是在模仿书籍中所读到的关于时间的知识。

为了进行这项研究,研究人员基于五种特定的心理错觉创建了一项新测试。这些错觉依赖于诸如情绪唤起、意外事件的存在以及信息密度等因素。例如,一种错觉认为,充满许多微小事件的时段比同样长度的空白时段感觉更长;而另一种错觉则认为,突然发生的惊喜事件会让时间感觉变慢。研究团队将这些心理学实验转化成了文字故事。他们编写了数千对短篇叙事,每对叙事描述了两个在现实中持续时间相同但框架设计不同的场景,以触发这些错觉。在一个故事中,角色可能在安静的房间里等待;而在另一个故事中,同一个角色可能在充满闪烁灯光和声音的房间里等待。研究人员随后要求人类读者和人工智能模型判断哪个场景感觉时间更长。

该研究涉及 60 名人类参与者,每人阅读 25 对这样的故事对。人类的结果却出人意意地有限。在阅读这些故事时,人们仅在两种情况下能一致地感受到时间被扭曲了:一是故事包含明显的、意想不到的异常情况,二是事件的顺序被打破。在另外三种情况下,即需要读者去想象角色的情感重量或内心状态时,人类读者并未察觉到差异。仅凭文字本身不足以让他们产生时间拉伸或压缩的感觉。人类需要错觉在文字中直接显现才能察觉到它;他们并没有像心理学理论预测的那样,在内心模拟时间的流逝。

人工智能模型的表现则截然不同,令人震惊。研究人员在同一组故事上测试了 14 种不同的语言模型。这些模型并没有表现得像人类读者那样,而是始终如一地选择了心理学文献预测会感觉更长的那个场景。这种情况发生在五种错觉中的四种,包括那些人类看不到差异的情况。这些模型似乎拥有一种强大的、主观的时间感,且与科学教科书完美契合,即便在文字本身并不支持人类产生那种感觉的情况下也是如此。

为了理解模型为何如此不同,研究人员仔细观察了模型在给出答案之前所采取的内部推理步骤。他们发现,在大约 70% 的案例中,模型在思考过程中明确提到了心理学研究。它们使用诸如“心理学研究表明”或“研究指出”之类的短语来证明其选择的合理性。这表明,模型并不是以人类的方式体验时间,也不是在模拟角色的内心状态。相反,它们是在检索其训练数据中的事实。当被问及时间感知时,它们会回忆起心理学论文中的既定发现并将其应用于故事,实际上扮演了一个正在回答测试题的博学学生,而不是一个正在经历某一时刻的人。

研究结论指出,虽然这些人工智能系统可以准确地背诵人类时间感知的规则,但它们并不具备实际的主观体验。它们知道惊喜会让时间感觉变长,是因为它们多次读到过这个事实,而不是因为它们自身感受到了惊喜。这种区别对于理解这些机器是如何运作的至关重要。它们并没有发展出类人般的意识或内在时钟;它们是复杂的模式匹配器,能够高精度地检索并应用复杂的人类知识。研究结果表明,当我们询问这些模型关于人类主观体验的问题时,我们得到的往往是关于这些体验的文字记录的反映,而非体验本身的模拟。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →