← 最新论文
💻 computer science

DeltaBox: Scaling Stateful AI Agents with Millisecond-Level Sandbox Checkpoint/Rollback

本文介绍了 DeltaBox,这是一种新颖的沙盒系统,它利用操作系统级别的抽象 DeltaFS 和 DeltaCR,通过仅复制状态变更而非完整系统状态来实现毫秒级的检查点与回滚,从而支持由大语言模型驱动的 AI 智能体进行高频探索。

原作者: Yunpeng Dong, Jingkai He, Yuze Hou, Dong Du, Zhonghu Xu, Si Yu, Yubin Xia, Haibo Chen

发布于 2026-05-22
📖 1 分钟阅读☕ 轻松阅读

原作者: Yunpeng Dong, Jingkai He, Yuze Hou, Dong Du, Zhonghu Xu, Si Yu, Yubin Xia, Haibo Chen

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象你正在玩一款非常复杂的游戏,试图解开一个难题。你是一个 AI 智能体,为了获胜,你必须尝试成千上万种不同的策略。有时你尝试移动一个棋子,结果发现这是一步臭棋。你需要立即“撤销”这步棋,并尝试另一条路径。

在现实世界的 AI 编程智能体中,这个“撤销”按钮极其缓慢且笨拙。通常,若要回退,计算机必须在尝试新操作之前,保存整个游戏世界(所有文件、所有打开的程序、内存)的完整副本。这需要几秒钟。如果你需要这样做数百次,你的 AI 将把更多时间花在保存和加载上,而不是实际思考上。

DeltaBox 是一个旨在解决此问题的新系统。它充当 AI 智能体的超快“时间机器”,允许它们在眨眼之间(毫秒级)保存和恢复其状态。

以下是其工作原理,使用简单的类比:

核心理念:“仅保存变更”

大多数系统的工作方式就像摄影师,每当你移动一本书时,都要为凌乱的房间拍一张完整的照片。拍照需要很长时间,而将房间恢复原状甚至需要更久。

DeltaBox 意识到,当你移动一本书时,99% 的房间并未改变。与其为整个房间拍一张新照片,它只需记下一条小笔记,说明“书从桌子移到了椅子上”。若要回退,只需读取笔记并将书移回原位。这就是“关键洞察”:不要复制整个状态,只复制变更。

两个魔法技巧

为了实现这一目标,研究人员构建了两个协同工作的特殊工具(操作系统级机制):

1. DeltaFS:“分层蛋糕”文件系统

想象你的计算机文件是一个多层蛋糕。

  • 传统方式: 如果你想保存蛋糕的状态,你必须将整个蛋糕复制到一个新盒子中。如果你想回退,就必须扔掉当前的蛋糕,拿出旧的盒子。
  • DeltaBox 方式: 蛋糕放在一叠透明托盘上。
    • 最底层的托盘是原始蛋糕(只读)。
    • 当你进行更改(例如添加一颗樱桃)时,你并不触碰底层蛋糕。你只需在顶部放一个新的、空的托盘,并将樱桃放在那里。
    • 检查点(保存): 你只需冻结当前的顶层托盘,并在其上滑入一个新的空托盘。这只需一瞬间。
    • 回滚(撤销): 你只需滑掉顶层托盘,查看下面的那一层。樱桃消失了,蛋糕完全恢复到了之前的样子。无需复制,无需费力搬运。

2. DeltaCR:“冻结克隆”内存管理器

现在想象 AI 智能体是一个正在赛跑的人。为了保存进度,你通常必须让他停下来,记下他所有的想法,并冻结他的身体。若要重启,你必须阅读笔记并唤醒他。这很慢。

DeltaBox 使用了一种称为**“从冻结模板派生”**的技巧。

  • 设置: 当 AI 暂停思考时,DeltaBox 会创建该智能体大脑(内存)的“冻结克隆”,并将其固定在原地。这就像在一个人屏住呼吸时对其大脑拍一张快照。
  • 保存: 它还将关于变更(“增量”)的小笔记写入安全位置。
  • 撤销: 当 AI 需要回退时,DeltaBox 不是唤醒一个沉睡的人并阅读长长的笔记列表,而是立即克隆那个冻结的大脑。因为克隆体已经处于完全正确的冻结状态,它能瞬间苏醒。
  • 安全网: 如果冻结克隆太旧或被丢弃以节省空间,系统有一个备用计划,即读取笔记并重建大脑,但这较慢。系统会尝试保留足够多的冻结克隆,以便几乎总是使用即时方法。

为什么这很重要

该论文在现实世界的编程任务(修复 Django 或 SymPy 等软件中的错误)中测试了这一点。

  • 旧方法: 保存和恢复需要数百毫秒到数秒。这太慢了,以至于阻碍了 AI 探索深层策略。
  • DeltaBox 方法: 保存大约需要14 毫秒,恢复需要5 毫秒

结果:
由于“撤销”按钮现在如此快速,AI 可以在相同的时间内探索更多的路径。这就像一位棋手,因为重置棋盘需要一小时,只能思考一步棋;而另一位棋手可以瞬间重置棋盘,在原本尝试一步棋的时间内尝试 100 种不同的走法。

总结

DeltaBox 是一个允许 AI 智能体在其自身的计算机环境中玩“如果……会怎样”游戏的系统。通过认识到大多数变更都很小,它停止复制整个世界,而只保存微小的差异。这将一个缓慢、沉重的过程转变为一个闪电般快速的过程,使 AI 能够通过尝试更多解决方案来解决更难的问题。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →