Federated Continual Learning as a Distributed Drift-Plus-Penalty Control Problem
本文提出了联邦队列调节持续学习(FedQCL),这是一个将联邦持续学习视为随机控制问题的新颖框架,该框架利用李雅普诺夫漂移加惩罚优化,通过虚拟队列显式地管理遗忘,从而在无需梯度投影或额外通信开销的情况下,在异构基准测试上实现了卓越的准确性和更低的遗忘率。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
在数字世界中,机器被越来越多地要求进行持续学习,而不只是学习一次,而是要随着新信息的到来不断适应,同时记住之前学到的知识。这一挑战被称为持续学习(continual learning)。想象一个学生必须每天参加一场新的考试,但教室规则禁止他保留旧的教科书或笔记。他必须在学习新材料的同时,还不失去回答前几天问题的能力。在现实世界中,这种情况发生在数百万台设备上,从智能手机到医疗传感器,每台设备都持有无法与中央服务器共享的私密数据。这种设置被称为联邦学习(federated learning),即许多设备协同工作以训练一个单一的智能模型,而无需泄露其私密信息。困难在于,当这些设备面临不同类型的任务和随时间变化的各种任务时,模型往往会在学习新知识的过程中遗忘旧的教训,这被称为灾难性遗忘(catastrophic forgetting)。
来自德里高等教育研究院(IIIT Delhi)和达尔瓦德理工学院(IIT Dharwad)的研究人员通过将学习过程不仅视为一系列数学问题,而是视为一个需要不断调节的动态系统,解决了这一特定问题。他们开发了一种名为 FEDQCL 的新方法,该方法将信息的遗忘视为一种可以被测量和控制的物理量。该方法并非试图通过僵化的规则强迫模型记住一切,而是使用了一个虚拟追踪系统。可以将这个系统想象成每个设备上的一个本地计数器,它记录着模型对过去任务遗忘程度的运行总计。如果遗忘程度过高,系统会自动调整学习过程,以减慢速度并保护旧知识。这使得模型既能保持足够的灵活性来学习新事物,又能保持足够的稳定性来保留已掌握的知识,且无需设备之间发送额外的辅助数据。
这项工作的核心在于研究人员如何管理学习新任务与记住旧任务之间的张力。在以往的方法中,设备通常会尝试孤立地解决每个新任务,或者使用复杂的数学技巧来防止可能损害过去性能的模型变化。这些方法在处理不同设备间差异巨大的数据时往往表现挣扎,导致全局模型变得混乱或不稳定。新方法引入了一个名为“虚拟队列”的概念。在学习过程的每一步,每个设备都会检查当前的学习在多大程度上损害了其在过去任务上的表现。如果性能下降,虚拟队列就会增长,发出信号表明设备正在遗忘过多。这个信号随后充当了学习过程的一个温和刹车,鼓励模型优先考虑稳定性。如果模型表现良好且没有遗忘,队列就会保持较小规模,允许模型快速学习新事物。
这种方法的独特之处在于,它不需要设备共享其私密数据,甚至不需要向中央服务器发送额外信息即可实现。追踪过程完全在本地设备上进行,在保护隐私的同时,仍能为稳定的全局模型做出贡献。研究人员在标准的图像识别任务上测试了该系统,其中模型必须按顺序学习识别不同的物体类别。他们将该方法与几种现有技术进行了对比,包括那些依赖存储过去样本或使用复杂数学投影来保护旧知识的技术。结果显示,我们的新方法始终能获得更高的任务准确率,并显著减少了遗忘信息的量。在涉及数百个类别和数千张图像的测试中,该方法优于现有的最佳方法,证明了将遗忘管理为一个持续的、受监管的过程,比事后尝试修复更为有效。
研究还探讨了该方法在不同条件下的表现,例如当每个设备上的数据非常不均衡,或者存储过去样本的内存有限时。即使在数据高度不平衡的情况下——即某些设备主要看到一种类型的图像,而其他设备看到的则是完全不同的类型——该方法依然保持稳健。它维持了高准确率和低遗忘率,而其他方法则在维持模型稳定性方面表现挣扎。研究人员发现,他们可以通过调节一个单一的控制旋钮,来决定模型应该在多大程度上优先学习新事物与记住旧事物之间进行权衡。这种灵活性使他们能够找到一个“甜点区”,即模型既能快速适应,又不会失去其基础。研究结果表明,将学习过程视为一个动态控制问题,即实时监测并调节遗忘情况,为构建能够持续学习的现实世界智能系统提供了一种强大的方式。
这项工作并不声称已经解决了机器学习中的所有问题,但它为其中一个最持久的挑战提供了一个清晰且有效的框架:即在学习过程中保持模型的稳定性。通过将重心从静态规则转向动态调节,研究人员展示了平衡“可塑性”与“稳定性”需求的可能性。该方法无需设备间额外的通信即可运行,这使得它在带宽和隐私受到关注的现实应用场景中具有实用性。随着机器越来越多地部署在数据不断变化的各种环境中,像这样能够进行自我适应和自我调节的方法,对于构建可靠且长效的人工智能将变得至关重要。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。