HarnessBridge: Learnable Bidirectional Controller for LLM Agent Harness
本文介绍了 HarnessBridge,一种轻量级的、可学习的双向控制器,它通过观测与动作投影实现了智能体与环境接口的自动化,在多种大语言模型中实现了与专门的人工控制台相当甚至更优的性能,同时显著降低了 Token 使用量和轨迹长度。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下,你正在雇佣一位才华横溢但略显散漫的侦探(即 AI Agent)来破解一个需要数日才能破案的复杂谜案。这位侦探极其聪明,但有一个坏习惯:他会在笔记本上写下所见、所闻、所想的一切。最终,笔记本变得如此厚重,以至于侦探再也找不到重要的线索,并陷入了反复阅读那些无用页面的死循环中。
与此同时,侦探不断尝试打开已经锁上的门,或者敲击并不存在的墙壁,白白浪费了时间和精力。
这就是这篇论文所针对的问题。所谓的“护栏”(Harness)是位于侦探与世界之间的系统,负责管理信息的流动。通常,这个系统是由人类通过僵化的规则(例如“始终保留最后 10 页”)构建的。但本文的作者提出了 HarnessBridge,他们问道:如果我们能教会系统本身如何像一名聪明的助手一样,去管理侦探的笔记本和行动,情况会怎样?
以下是 HarnessBridge 的工作原理,通过简单的概念进行拆解:
1. 双向桥梁
可以将 HarnessBridge 想象成站在侦探(AI)与犯罪现场(计算机环境)之间门口的一名聪明的保安。它有两个主要职责,分别向相反的方向工作:
职责 A:“编辑” (观察投影/Observation Projection)
- 问题: 犯罪现场向侦探发送海量的数据流:他们打开的每一个文件、每一条错误信息、每一个死胡同。侦探的记忆(AI 的上下文窗口)因此变得拥挤不堪。
- HarnessBridge 的解决方案: “编辑”查看侦探的笔记本并执行三个动作:
- 保留 (Keep): 它保存关键线索(例如“嫌疑人在下午 5 点被发现”或“代码失败是因为缺少文件”)。
- 总结 (Summarize): 它压缩冗长乏味的章节。与其粘贴侦探已经读过的 50 行代码,它会写道:“你检查了数据库文件,发现错误在于第 42 行。”
- 丢弃 (Drop): 它扔掉垃圾。如果侦探花了 10 分钟寻找一个不存在的文件,编辑会删除整个部分,这样侦探就不会在重复阅读上浪费时间。
- 结果: 侦探得到的是一份清晰、简短、高质量的简报,而不是一部百页的小说。这节省了成本(Token 使用量),并帮助侦探保持专注。
职责 B:“教练” (行动投影/Action Projection)
- 问题: 有时侦探会陷入循环。他们可能会尝试打开一扇已知锁上的门,或者试图通过随机猜测而非逻辑推理来解开谜题。他们不断重复这些行为,浪费步骤。
- HarnessBridge 的解决方案: 在侦探的行动被发送到犯罪现场之前,“教练”会进行检查。
- 通过 (Pass): 如果行动合理,教练会说“请继续”。
- 拒绝 (Reject): 如果行动是在浪费时间(例如尝试运行一个尚未修复的测试),教练会拦截它。
- 反馈 (Feedback): 至关重要的是,教练不仅仅是说“不”。它会给出具体的提示:“先不要运行那个测试。你还没有修复
login.py文件中的 Bug。先去修复它。”
- 结果: 侦探停止了无意义的错误,并能立即从反馈中学习。
2. 它是如何学习的(“训练”阶段)
你可能会问:“这个保安是如何知道该做什么的?”
作者并没有编写规则列表。相反,他们像培养学生一样训练了 HarnessBridge。
- 他们提取了数千个成功侦破案件(即 AI 解决问题)的案例。
- 他们向系统展示:“这是侦探当时混乱的笔记本。这是能帮助他们更快破案的清晰版本。这是他们采取的行动,以及他们本该采取的更好行动。”
- 系统学会了模仿这些决策。它学会了成为一种“可学习的策略”,这意味着它会适应情况,而不是遵循静态的规则手册。
3. 结果:更聪明、更便宜
论文在现实世界的编程挑战(如修复软件漏洞)上测试了这个系统。
- 性能: HarnessBridge 帮助 AI 解决问题的表现,足以媲美甚至超过了最优秀的真人构建系统。
- 效率: 这是最大的胜利。由于系统压缩了信息并阻止了 AI 进行无用的操作,它使用了显著更少的“Token”(AI 计算的货币)。在某些情况下,它将成本降低了 50% 甚至 90% 以上。
- 泛化能力: 该系统是在一种类型的 AI 侦探上进行训练的,但当它与其他、甚至是更大的 AI 模型配对时,依然能完美运行。这就像一位教练,虽然学会了训练特定的运动员,但却能瞬间提升任何与其合作的运动员的表现。
总结类比
如果 AI Agent 是赛车手,那么传统的护栏就是一个静态 GPS,给每个人提供相同的指令。而 HarnessBridge 则是一个聪明的副驾驶,它:
- 过滤掉无线电静电,让赛车手能清晰地听到赛道情况。
- 总结比赛历史,让赛车手无需阅读整本手册即可了解当前策略。
- 当赛车手试图转向会导致撞墙的方向时,它会拍拍赛车手的手,并告诉他应该往哪里转向。
论文声称,这种方法使 AI Agent 运行得更快、更便宜,并且在处理长期、复杂的任务时表现得更好,而无需人类每次都手动重写规则。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。