← 最新论文
🤖 machine learning

DuoMem: Towards Capable On-Device Memory Agents via Dual-Space Distillation

该论文介绍了 DuoMem,一种双空间蒸馏框架,它结合了上下文空间记忆增强与参数空间微调,使紧凑型端侧大语言模型能够在显著降低延迟和资源需求的同时,在复杂的程序化任务中达到接近教师模型的性能。

原作者: Peyman Hosseini, Ondrej Bohdal, Ahmed Alajrami, Andrea Maracani, Ignacio Castro, Matthew Purver, Mete Ozay, Savas Ozkan, Taha Ceritli

发布于 2026-06-30
📖 1 分钟阅读☕ 轻松阅读

原作者: Peyman Hosseini, Ondrej Bohdal, Ahmed Alajrami, Andrea Maracani, Ignacio Castro, Matthew Purver, Mete Ozay, Savas Ozkan, Taha Ceritli

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,你有一位才华横溢但精疲力竭的教授(老师),他能完美地解决复杂的家务活,但由于他太慢且雇佣成本太高,无法胜任每一项琐碎任务。然后,你还有一个聪明但缺乏经验的实习生(学生),他动作迅速且成本低廉,但经常迷失方向、忘记要做什么,或者还没走到抽屉跟前就想去开抽屉。

这篇论文介绍了一种名为 DuoMem 的训练系统,旨在通过两种特定的教学方法,将那个笨手笨脚的实习生培养成一名大厨。其目标是让这个小巧、快速的实习生能够胜任那个庞大、资深教授的工作,而且无需依赖超级计算机,在普通的智能手机或机器人上即可运行。

以下是 DuoMem 的工作原理,我们使用简单的类比来解释:

问题所在:“小脑瓜”的挣扎

大型 AI 模型就像是能在 14 步内解开谜题的天才。而小型 AI 模型(如测试中所使用的 40 亿参数模型)则像是试图通过瞎猜来解决同一个谜题的人。他们可能会在房子里乱转 30 步,试图从墙上拿起一个铲子,最后最终放弃。他们缺乏“程序性记忆”——即根据过往经验记住“如何做事”的能力。

解决方案:DuoMem(双重训练营)

DuoMem 通过同时使用两种不同的“空间”或方法来教导这个小实习生。

1. 上下文空间蒸馏(Context-Space Distillation): “小抄”

  • 传统方式: 当实习生尝试一项新任务时,他们必须根据自己(通常很糟糕的)记忆,自己动手写下操作笔记。
  • DuoMem 的方式: 在实习生开始之前,教授会根据自己过去解决类似任务的方式,写出一份完美的、高质量的“小抄”(程序化脚本)。
  • 运作机制: 当实习生面临新任务时,系统会将教授的小抄交给他们。实习生不需要从零开始摸索策略;他们只需阅读教授的笔记并照着执行即可。
  • 类比: 这就像是在考试前给学生一份教科书摘要,而不是要求他们在考试过程中自己边考边写摘要。

2. 参数空间蒸馏(Parameter-Space Distillation): “肌肉记忆”

  • 传统方式: 实习生读了小抄,但在实际操作时手脚依然笨拙,因为他们还没有练习过具体的动作。
  • DuoMem 的方式: 系统提取教授成功解决任务的所有经历,并利用这些经历来“微调”实习生的脑回路。这不仅仅是给笔记,更是通过重新布线实习生的神经通路,使其模仿教授成功的习惯。
  • 运作机制: 系统在实习生的脑部训练一个微小的、轻量级的插件(称为 LoRA)。这个插件学习了教授成功动作中的“肌肉记忆”。
  • 类比: 这就像是一位舞蹈教练观察大师的舞姿,然后调整学生的姿态和肌肉张力,使他们即使不看笔记,也能自然而然地做出大师般的动作。

结果:快速、廉价且聪明

论文在名为 ALFWorld 的虚拟房屋中测试了这一方法,其中的任务包括“清洗铲子并将其放入抽屉”等。

  • 没有 DuoMem: 这个 4B(40 亿参数)的小模型表现很差。它的成功率仅为 4.3%。完成一项任务大约需要 29 步,耗时近 19 秒。
  • 有了 DuoMem: 同一个小模型成功率达到了 77.9%。它仅需 21 步,耗时约 5 秒。
  • 对比: 搭载了 DuoMem 的小模型变得几乎与拥有 720 亿参数的庞大“教授”一样出色(教授的成功率为 87.1%),但它的速度快了 3 倍,且所需的计算能力仅为后者的一小部分。

为什么这很重要

论文声称,你不需要一个庞大、缓慢的超级计算机,也能在手机或机器人上拥有一个聪明的智能体。通过结合教授的小抄(上下文)与教授的肌肉记忆(参数),一个小巧、快速的模型可以实时完成复杂任务。

核心要点: DuoMem 证明了,如果教学方法得当,小模型并不会显得“笨拙”。它可以借用巨型模型的脑力,而无需承担巨型模型本身的沉重负担。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →