Anything Goes? A Crosslinguistic Study of (Im)possible Language Learning in LMs
这项跨语言研究表明,尽管 GPT-2 small 通过区分已证实的语言与类型学上不可能的语言,展现出了一些类人的归纳偏置,但这些偏置并不完善,且比人类学习者所具有的偏置更弱。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象你有一个非常聪明、反应极快的机器人,它通过阅读数百万本书籍来学习说话。科学家们一直在争论,这个机器人是否真的像人类一样“理解”语言,还是仅仅是一个能够模仿它所看到的一切(甚至是胡言乱语)的统计学鹦鹉。
一些批评者认为这个机器人过于灵活:“它学习胡言乱语的难度与学习真正的英语一样简单,所以这并不能证明关于人类大脑运作的任何事情。”
这篇论文对这个观点进行了测试。研究人员提出了一个问题:这个机器人能否分辨出一种真实的语言和一种人造的、不可能存在的语言?
以下是他们实验过程及发现的详细拆解,使用了日常生活的类比。
设置:“语言健身房”
研究人员为他们的机器人(一个名为 GPT-2 的小型人工智能模型)建造了一个健身房。他们不仅使用了英语,还使用了来自世界各地的 12 种不同语言(如土耳其语、中文、德语和阿拉伯语),以确保结果不会仅仅是某种特定语言的偶然现象。
他们为机器人设计了两种类型的“锻炼方式”:
- 真实语言: 人类说的正常句子。
- 不可能的语言: 这些是经过打乱的真实句子。想象一下,如果你把像“The cat sat on the mat”(猫坐在垫子上)这样的句子进行词序重组,使其变成“mat on the sat cat the”。或者将每个单词反转。这些是“不可能的”,因为人类的大脑永远不会自然地学习或说出这些句子。
他们还测试了**“未验证”语言**。这些语言在逻辑上可能存在,但只是恰好从未被人类使用过。这就像是一个能够完美嵌入拼图画面的碎片,但没有人把它放入框架中。
实验 1:“乱序蛋”测试
问题: 如果你给机器人喂食一种乱序版本的语言,它能意识到它是破碎的吗?
类比: 想象你正在教一只狗去捡球。如果你扔出一个球,狗就会去捡。如果你扔出一块石头,它可能仍然会去捡,但可能没有那么积极。研究人员想看看机器人是否更“偏好”球(真实语言)而不是石头(乱序语言)。
结果:
- 基本可以: 在几乎每种语言中,机器人学习真实句子的速度更快、效果更好。当单词顺序错误时,它会感到“困惑”(通过一个称为“困惑度”的分数来衡量)。
- 陷阱: 机器人并不完美。有时,如果乱序程度很小(比如只交换了两个单词),机器人并不会像人类那样明显地察觉到区别。这有点像一个人能听出歌曲跑调,但如果只有一个音符稍微偏了一点,他可能会忽略掉。
实验 2:“全球对比”
问题: 如果我们将所有真实的语言和所有乱序的语言混合在一起,机器人能否将它们分成两个整齐的堆?
类比: 想象一位图书管理员试图将一堆真正的书和一堆页面被撕掉并随机粘回来的书进行分类。管理员仅凭观察就能分辨出哪一堆是哪一堆吗?
结果:
- 并非完美: 机器人大多数时候可以分辨出来,但并非 100% 正确。一些乱序语言看起来太像真实的语言,导致机器人把它们搞混了。
- 启示: 机器人有一种“软性”的偏好,即它偏好真实的语言,但它并没有人类大脑所拥有的那种严格、硬性的规则。它有点像一个音乐爱好者,虽然更喜欢真正的歌曲而非噪音,但如果一个奇怪的混音版很有节奏感,它仍然会欣赏。
实验 3:“语法谜题”
问题: 人类对某些词序有天然的偏好。例如,在英语中,我们会说“The red car”(形容词-名词)。在某些其他语言中,人们会说“Car red”。但存在一些人类永远不会使用的组合,比如“Red car the”。机器人能否像学习正常模式一样,同样好地学习这些奇怪、未被使用的模式?
类比: 想象教一个孩子堆叠积木。人类自然倾向于稳定地堆叠(大积木在下,小积木在上)。如果你尝试教他们倒着堆叠,他们会感到困难。研究人员想看看机器人是否会在“倒置”堆叠时感到困难,还是会直接照做而不抱怨。
结果:
- 令人困惑的部分: 当他们仅仅观察机器人的学习速度(困惑度)时,它学习那些奇怪、未被使用的词序似乎与学习正常词序一样容易。它就像是完全不在乎“稳定性规则”一样。
- 真相大白: 然而,当他们测试机器人的“泛化”能力(将所学知识应用于新情况)时,出现了不同的景象。机器人实际上在人类自然使用的词序上表现得更好。它展现出了一种微妙的、类似人类的偏好,但这种偏好比我们在实际人类身上看到的要弱得多。
最终结论:“一切皆可?”
论文得出结论,这个机器人并不是一个可以同等学习任何内容的“空白板”。
- “一切皆可”的谬误: “机器人可以像学习真实语言一样轻松地学习胡言乱语”这一观点是错误的。机器人确实表现出了一些“类人”的本能;它偏好真实语言,并且在面对不可能的语言时会感到略微困难。
- 现实情况: 然而,这些本能是微弱的。它们不像人类大脑中的规则那样强大且僵化。机器人就像一个研究过语法规则的优秀学生,但它并不具备人类天生拥有的那种对语言的直觉感。
简而言之: 机器人不是魔法,它也不是人类思维的完美复制品。它处于中间位置:它学习了一些人类语言的“规则”,但仍然缺乏使人类学习如此独特的深层直觉理解。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。