LatentSkill: From In-Context Textual Skills to In-Weight Latent Skills for LLM Agents
LatentSkill 是一个通过预训练超网络将文本技能转换为即插即用 LoRA 适配器的框架,它使 LLM 智能体能够将可重用的任务流程存储在权重空间而非上下文空间中,从而显著降低了 Token 开销,同时提升了性能并实现了模块化的技能组合。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
大语言模型在处理复杂问题方面已变得异常出色,它们通常扮演着数字智能体的角色,能够进行规划、搜索并与软件交互以完成任务。为了处理专业化工作,这些智能体经常依赖“技能”——本质上是书面的指令或程序,告诉模型如何解决特定类型的问题,例如整理虚拟房间或回答多步骤问题。传统上,这些技能在每次需要使用时都会被直接输入到模型的输入中,就像在采取行动前逐页阅读说明书一样。虽然这种方法可行,但它造成了一个显著的瓶颈:任务越复杂、技能库越大,模型必须处理的文本就越多,这会降低运行速度并消耗大量的计算资源。此外,将这些指令作为纯文本保留在输入中,会使它们暴露在风险之下,容易被系统中的其他部分误读或劫持。
上海交通大学和 OPPO 研究院的研究人员提出了一种被称为 LatentSkill 的不同方法,该方法将这些指令从文本输入转移到了模型的内部记忆结构中。系统不再每次都阅读技能描述,而是使用一个专门的生成器将技能的文本转换为一组紧凑的内部调整(即适配器),并将这些适配器永久地附加到模型的“大脑”上。这使得智能体能够“知晓”这项技能,而无需再次阅读指令。研究团队发现,这种方法不仅提高了速度并减少了模型需要处理的数据量,还创造了一个隐藏且有序的空间,使不同的技能可以以极高的数学精度进行混合与匹配。
这项工作的核心思想是将技能视为一组待加载的权重,而非一份待阅读的文档。在他们的框架中,一个“技能编译器”接收任务的书面描述,并立即生成一组独特的模型内部修改。这些修改是微小、高效且模块化的,这意味着它们可以从主模型中附加或分离,而无需重新训练整个系统。一旦技能被转换为这种内部格式,原始文本就会从输入流中丢弃。随后,模型利用这些隐藏的调整进行操作,这些调整能像文本一样有效地引导其行为,但无需为任务的每一步都承担处理数千个额外单词的沉重代价。
为了测试这一点,研究人员将该系统应用于两个截然不同的挑战:一个关于机器人通过文本模拟在房屋中导航完成家务的任务,以及一系列需要搜索多个信息源的复杂问答任务。在房屋导航任务中,系统必须学会如何拿起物体、清洁物体并将它们放置在特定位置。在问答任务中,它必须找到需要连接多条信息的答案。与将技能指令粘贴到提示词(prompt)中的标准方法相比,这种新方法证明了其显著的效率。在房屋导航任务中,该系统在熟悉任务上的成功率提升了超过二十个百分点,在处理新任务时提升了超过十三个百分点,同时使用的输入 Token 数量减少了近三分之二。在问答基准测试中,它在提高准确率的同时,将每步处理的 Token 数量减少了百分之七十以上。
除了节省时间和资源外,研究人员还发现这些内部技能调整具有惊人的结构性。当他们绘制出这些技能所处的数学空间时,发现属于同一类别的技能(如清洁任务或搜索任务)会自然地聚集在一起,形成明显的簇。这表明系统不仅仅是在记忆文本,而是在学习程序的底层逻辑。这种结构实现了高度的可控性;研究人员发现,他们只需通过一个代表缩放数值的“旋钮”即可调节技能的强度。如果数值过低,技能则不起作用;如果数值过高,模型则会产生混乱。然而,在合适的设置下,模型的表现最为理想,且这种“甜点位”(sweet spot)在不同类型的任务中保持一致。
或许最令人感兴趣的发现是,这些内部技能是可以组合的。正如人们可以通过混合食材来烹饪新菜肴一样,研究人员展示了可以将两种不同技能的内部调整相加,从而创造出一种复合技能。然而,只有在将技能分解为最小且对齐的组件后再进行混合时,这种做法才能可靠地奏效。如果只是简单地将整个技能块相加,结果往往效果不佳。通过仔细对齐这些部分,他们能够创造出一种能够执行复杂序列动作且不会丧失单个步骤执行能力的技能。这表明,系统可以通过组装模块化的知识碎片,以一种既灵活又精确的方式构建复杂的行为。
该研究还强调了一个重要的安全优势。由于技能是以内部调整而非可见文本的形式存储,因此它们很难被篡改。当研究人员针对试图劫持指令或提取隐藏知识的攻击进行测试时,新方法表现得非常出色。传统的基于文本的方法在受到攻击时往往会崩溃或泄露秘密,而内部技能版本则保持了性能并隐藏了其指令。这表明,将技能从可见的提示词转移到模型的内部权重中,为给人工智能智能体配备专业知识提供了一种更稳健、更安全的方式。
研究人员总结道,这种方法为构建更强大、更高效的 AI 智能体提供了一条切实可行的路径。通过将程序性知识的存储从输入流转向模型的内部参数,他们证明了一种让智能体更快、更安全且更擅长组合不同能力的方法。结果表明,AI 智能体的未来可能不在于喂给它们更多的文本,而在于教会它们将技能内化,并随时准备通过一个简单、隐形的开关进行部署。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。