← 最新论文
🤖 machine learning

How Modular Is a Frontier Mixture-of-Experts? A Pre-registered Causal Test in Which Apparent Expert Modularity Mostly Dissolves

这项预注册因果研究表明,前沿混合专家模型中表象的功能模块化现象十分罕见且高度依赖于测量选择,因为在测试的六个语言家族中,只有一个表现出了稳健且具选择性的模块化,而其他家族则未能跨不同指标和语料库保持一致的效果。

原作者: Tony Salomone, Deep Gandhi, Ali Asaria

发布于 2026-06-25
📖 1 分钟阅读☕ 轻松阅读

原作者: Tony Salomone, Deep Gandhi, Ali Asaria

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一个拥有 128 位不同厨师(称为“专家”)的巨型、高功率厨房(即 AI 模型)。然而,对于 AI 写的每一句话,它只请 8 位厨师来帮忙。研究人员想要回答的核心问题是:这些厨师是否专业化了?

流行的一种理论认为,这个厨房就像一家组织严密的百货商店:一组厨师专门负责数学,另一组专门负责编程,还有一些人专门负责像西班牙语或阿拉伯语这样的特定语言。如果这是真的,那么这个 AI 就是“模块化”的——就像一个工具箱,你可以把“数学工具”取出来,而不影响“语言工具”。

研究人员决定在名为 Command A+ 的一款大规模、尖端 AI 上测试这一理论。以下是他们如何进行测试以及他们的发现,通过简单的语言进行了解释:

实验:“开除厨师”测试

研究人员并没有仅仅观察 AI 选择 了哪些厨师(这可能会产生误导),而是决定直接开除特定的厨师群体,看看会发生什么。

  1. 设置: 他们根据厨师通常从事的工作,将他们分为六组:数学、编程、通用推理、阿拉伯语、中文和西班牙语。
  2. 测试: 他们逐一“消减”(silenced)每个小组,同时让 AI 尝试解决问题。
  3. 规则: 要证明一个小组是真正的专业化模块,必须满足两个条件:
    • 破坏性: 让“数学”小组失能必须会破坏 AI 做数学的能力。
    • 选择性: 让“数学”小组失能必须不会破坏 AI 说西班牙语或写代码的能力。如果让数学小组失能同时也破坏了西班牙语能力,那么“数学”厨师就不是一个干净、独立的模块;他们与西班牙语厨师混杂在一起了。

他们在严格的条件下运行了这项测试:使用不同类型的测试问题、不同的语言,并使用非常严谨的数学计算,以确保结果并非偶然。

结果:一个令人惊讶的发现

结果令人震惊。AI 内部整齐地划分为“数学”、“编程”和“语言”部门的设想,被证明在很大程度上是错误的。

  • 唯一的真专家: 只有一个小组通过了测试,表现出色:那就是阿拉伯语厨师。当研究人员让这组厨师失能时,AI 完全忘记了如何说阿拉伯语,但它仍然可以完美地进行英语交流、做数学题和写代码。这是一个“干净的模块”。
  • “近乎”专家的群体: 其他组(西班牙语、数学、编程)乍一看似乎是专家。
    • 西班牙语: 在一组测试句子中它看起来像个专家,但当用另一组句子进行测试时,它开始弄乱阿拉伯语。它不是一个干净的模块;它与阿拉伯语团队存在重叠。
    • 数学与编程: 它们是深度纠缠在一起的。让“数学”厨师失能会损害 AI 的通用推理能力,而不仅仅是数学能力。让“编程”厨师失能则会影响 AI 理解文本的能力,而不仅仅是写代码的能力。它们不是独立的房间,而是一个共享的、混乱的工作空间。

“测量”陷阱

论文强调了一个至关重要的教训:你如何测量结果,会改变答案。

这就像测试一辆汽车。如果你只在土路上测试汽车,它的悬挂系统看起来很棒;如果你在赛道上测试,它的悬挂系统看起来就很糟糕。

  • 在这个 AI 中,如果你通过它解决某个特定谜题的能力来衡量“数学”,它看起来像个专家。
  • 如果你通过它理解谜题背后“逻辑”的能力来衡量,它看起来就与通用推理混杂在一起了。

研究人员发现,对于几乎每一个组别,他们的“专业化”程度都会根据你使用的测试、你测试的语言或你数学规则的严格程度而消失或发生变化。

结论

论文得出结论,对于这个特定的、大规模的 AI 模型:

  1. 模块化是罕见的。 你不能假设 AI 拥有整齐、独立的技能分区。
  2. 大多数技能是混合在一起的。 数学、编程和通用推理在同一批“厨师”中交织在一起。
  3. 语言是复杂的。 即使是像西班牙语这样的语言也不总是独立的;根据语境的不同,它们可能会渗透到其他语言(如阿拉伯语)中。
  4. 阿拉伯语是例外。 它是这个厨房中唯一真正孤立、专业的团队。

底线是: 如果你想理解或编辑这些 AI 模型,你不能仅仅假设它们是由像乐高积木那样可以拆分的独立砖块组成的。它们更像是一幅复杂的、编织而成的挂毯,如果你拉动其中一根线(使一组专家失能),可能会导致你意想不到的部分也随之散架,除非你在测试时非常小心。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →