← 最新论文
💻 computer science

The OpenHands Software Agent SDK: A Composable and Extensible Foundation for Production Agents

本文介绍了 OpenHands 软件代理 SDK,这是一个对流行框架进行重构的模块化、可扩展工具包,旨在通过提供灵活的代理开发接口、安全的沙箱执行环境及多样化的人机交互方式,解决构建和生产部署软件工程代理的复杂性挑战。

原作者: Xingyao Wang, Simon Rosenberg, Juan Michelini, Calvin Smith, Hoang Tran, Engel Nyst, Rohit Malhotra, Xuhui Zhou, Valerie Chen, Robert Brennan, Graham Neubig

发布于 2026-04-23
📖 1 分钟阅读☕ 轻松阅读

原作者: Xingyao Wang, Simon Rosenberg, Juan Michelini, Calvin Smith, Hoang Tran, Engel Nyst, Rohit Malhotra, Xuhui Zhou, Valerie Chen, Robert Brennan, Graham Neubig

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

这篇文章介绍了一个名为 OpenHands Software Agent SDK 的新工具包。为了让你轻松理解,我们可以把构建一个能写代码、修 Bug 的"AI 程序员”比作开一家高科技的“自动修车厂”

在 OpenHands V0(旧版本)时代,这家修车厂虽然能干活,但设计得很糟糕:

  • 太死板:不管修什么车,都必须把车开进一个巨大的、昂贵的“隔离车库”(沙箱)里,哪怕只是换个灯泡也得走全套流程,效率极低。
  • 容易乱套:所有的零件(代码、配置、界面)都堆在一个大仓库里,像一锅乱炖的粥。只要动了一个螺丝,整个锅可能都翻车。
  • 难管理:如果两个修车工(用户)同时工作,一个把车库堵死了,另一个就动不了了。

为了解决这些问题,OpenHands V1(新版本)推出了一套全新的**“模块化修车厂 SDK"**。它的核心理念可以概括为以下四个生动的比喻:

1. 从“强制隔离”到“灵活切换” (可选沙箱)

  • 旧模式:就像不管你是要修自行车还是造火箭,都必须先把你关进一个全封闭的防弹玻璃房里,还得穿全套宇航服。这太麻烦了,而且一旦玻璃房坏了,整个系统就瘫痪。
  • 新模式:SDK 允许你默认在自家车库(本地)直接干活,灵活又快速。只有当你需要处理高危任务(比如修改核心系统)时,才一键切换到“防弹玻璃房”(沙箱容器)里。
  • 好处:平时干活快如闪电,关键时刻安全无忧。

2. 从“乱涂乱画”到“黑匣子记录” (事件溯源)

  • 旧模式:修车工脑子里记着步骤,如果中途被打断,或者电脑死机,他可能忘了刚才拧到第几颗螺丝了,导致修了一半的车没法恢复。
  • 新模式:SDK 引入了一个**“黑匣子记录仪”**。AI 做的每一个动作(比如“打开文件”、“运行代码”)都会被像写日记一样,按顺序、不可篡改地记录下来。
  • 好处:哪怕系统突然崩溃,只要把“日记”重新读一遍,AI 就能瞬间回到崩溃前的状态,继续干活,而且完全不会出错。这就像玩视频游戏时的“自动存档”功能,但更智能。

3. 从“大杂烩”到“乐高积木” (模块化设计)

  • 旧模式:以前的系统是一个巨大的单体建筑,你想换个窗户(工具),可能得把整面墙拆了。
  • 新模式:现在的 SDK 是一套乐高积木,分成了四个独立的盒子:
    • 核心大脑 (SDK):负责思考。
    • 工具箱 (Tools):负责具体干活(如写代码、查网页)。
    • 工作间 (Workspace):负责提供干活的地方(本地电脑或云端服务器)。
    • 服务器 (Server):负责远程指挥。
  • 好处:你可以只拿“核心大脑”在笔记本上测试,也可以把“核心大脑”和“云端工作间”组合起来,直接部署到公司服务器上。想换什么零件就换什么,互不干扰。

4. 从“盲目自信”到“安全审核” (安全与确认)

  • 旧模式:AI 想干什么就干什么,如果它不小心删错了文件,后果不堪设想。
  • 新模式:SDK 给 AI 配了一个**“安全审核员”**。
    • 当 AI 想做一个危险动作(比如删除整个文件夹)时,审核员会先评估风险。
    • 如果风险太高,AI 会暂停,并弹窗问人类用户:“嘿,这个操作有点危险,确定要执行吗?”
    • 只有人类点头,AI 才会继续。
  • 好处:既保留了 AI 的自动化能力,又防止了它“手滑”闯祸。

实际效果如何?

作者用真实数据证明了这套新设计有多牛:

  • 更稳定:在 15 天的实际运行中,新系统因为自身架构问题导致的故障率降低了 61%。以前那些因为网络波动、容器崩溃导致的“翻车”几乎绝迹了。
  • 更聪明:经过测试,新系统在各种复杂的编程任务(如修复 Bug、写新软件)中,表现依然顶尖,甚至因为支持了更先进的 AI 模型,性能还提升了。
  • 更省钱:通过智能压缩历史记录,它能在不牺牲智能的前提下,减少一半的 API 调用成本。

总结

OpenHands Software Agent SDK 就像是给 AI 程序员行业制定了一套**“工业级标准”。它不再是一个只能在学校实验室里跑跑的小玩具,而是一个可以真正放入工厂、安全、稳定、灵活地处理真实世界软件工程的生产级工具**。

它让开发者可以像搭乐高一样,轻松地把 AI 从“本地小助手”变成“云端大管家”,同时确保它们既聪明又听话,不会乱来。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →