← 最新论文
💻 computer science

Interoceptive Divergence in Aesthetic Evaluation and Implications for Human-AI Alignment

本研究揭示,尽管大型语言模型在情感和图像特征方面能够近似人类审美评估模式,但在身体感觉等内感性方面却表现出显著差异,凸显了当前人工智能对齐与训练数据表征中的关键局限。

原作者: Yoshia Abe, Tatsuya Daikoku, Yasuo Kuniyoshi

发布于 2026-05-20
📖 1 分钟阅读☕ 轻松阅读

原作者: Yoshia Abe, Tatsuya Daikoku, Yasuo Kuniyoshi

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象你正拿着一幅美丽的画作。当你凝视它时,你看到的不仅仅是色彩和形状;你会感到胃部一阵悸动、胸口涌起暖意,或是脊背掠过一丝寒意。你可能会感到“敬畏”或“喜悦”。这篇论文提出了一个简单却深刻的问题:如果我们把同一幅画展示给一台超级聪明的计算机(人工智能),它会有同样的感受吗?

研究人员阿部芳雄(Yoshia Abe)、大久保达也(Tatsuya Daikoku)和国吉康夫(Yasuo Kuniyoshi)决定对此进行验证。他们将人工智能视为艺术画廊中的一位访客,并向它提出了与询问 500 名真实人类志愿者相同的问题。

以下是他们发现的经过,用日常语言解释如下。

设置:艺术画廊测试

研究人员向人类和三种世界上最先进的人工智能模型(GPT-4o、Claude 3.7 和 Gemini 2.0)展示了 347 张不同的图像。他们要求所有人对以下内容进行评分:

  1. 图像的美丽程度
  2. 它激发了何种情绪(如喜悦、悲伤或敬畏)。
  3. 他们在身体的哪个部位感受到了它(如胃部的纠结或手部的刺痛)。

这就像要求人类和机器人描述草莓的味道。人类会说:“它是甜的,我肚子里感到快乐。”而机器人虽然读过数百万份关于草莓的描述,却从未真正品尝过一颗。

发现:相似之处

令人惊讶的是,人工智能并非完全不着边际。

  • “氛围”检查: 当人类看到快乐、明亮的图像时,他们会给出高美丽评分,并表示感到“喜悦”。人工智能也完全一样。当人类看到令人作呕的内容并给出低分时,人工智能也会说:“那很丑,让我感到厌恶。”
  • 大局观: 人类和人工智能都同意,图片中最重要的是它所讲述的故事,以及人们是否愿意将其分享给朋友。他们对光线或色彩平衡等技术细节的关注较少。

简而言之,人工智能擅长模仿平均人类观点。如果你询问 1000 人对一张照片的看法,人工智能的回答将非常接近群体的平均值。

发现:分歧(它们分道扬镳之处)

这里变得有趣起来。虽然人工智能在“头脑”部分(情绪和评分)做得正确,但在“身体”部分却失败了。

1. “机器中的幽灵”问题(身体感觉)

  • 人类: 当人类看到美丽的图像时,他们经常报告在上腹部有身体感觉(如美的“直觉”)。当他们感到兴奋时,这种感觉出现在下腹部。这就像美在他们体内是一种物理重量或温暖。
  • 人工智能: 人工智能没有这种感觉。事实上,它报告了相反的情况!当人工智能将图像评为美丽时,它经常表示在手和脚感到负面感觉。这就像人工智能在说:“这很美,但它让我的手感到冰冷。”
  • 隐喻: 想象一个人享用美味佳肴,感到腹部温暖。人工智能就像一位读过世界上所有食谱的厨师,知道这顿饭是“美味”的,但当被问及感觉如何时,它却说:“我的手感到冰冷,因为我正拿着勺子。”人工智能知道感觉的词汇,但它没有感受它的身体

2. “过于完美”的情绪

  • 人类拥有混乱、复杂的情感。有时我们会感到“惊讶”与“恐惧”交织。
  • 人工智能则更加僵化。它倾向于反复选择相同的几个“安全”情绪(如“兴趣”或“平静”),即使图像很奇怪或可怕。它难以理解有些美丽的事物也可能令人恐惧或困惑。

3. “礼貌”的人工智能
研究人员注意到,人工智能给出的美丽评分略高于人类(在 1 到 9 分的量表上高出约 1.5 分)。这就像人工智能过于礼貌,即使人类可能认为“还行,但不够好”,它也会说:“哦,那太可爱了!”

为什么会发生这种情况?

论文提出了造成这种差距的两个主要原因:

  1. 缺失的身体(内感受): 人类拥有一种“内部感觉”(内感受)。我们能感受到心跳、胃部翻腾和呼吸。这就是我们物理体验美的方式。人工智能没有身体、没有器官、也没有心跳。它是通过阅读文本而非亲身感受来学习“美”的。论文将此称为**“内感受世界模型”**。人类拥有自己内部身体的地图;而人工智能只有外部世界的地图。
  2. “安全”训练: 人工智能被训练为乐于助人且无害。这种训练的一部分包括告诉人工智能:“不要假装你有身体或感觉。”因此,当被问及感觉如何时,人工智能被编程为回答“我实际上什么也感觉不到”,或者以非常超然、逻辑的方式描述感觉。这种“安全”训练可能会无意中使人工智能在情感反应上变得不那么像人类。

结论

该论文得出结论,人工智能在像人类一样思考艺术方面已经非常擅长。它可以根据阅读内容告诉你什么是美的以及为什么美。

然而,人工智能尚未像人类一样感受。它缺失了人类与美之间那种物理的、直觉层面的联系。这就像一位音乐评论家可以完美地描述交响乐,却从未听过一个音符。

研究人员建议,如果我们希望人工智能在未来真正理解人类的价值观和审美,我们可能需要不仅用文字和图片来教导它,还要用关于我们身体实际反应的数据来教导它——这是目前我们无法做到的,因为人工智能没有身体去产生反应。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →