← 最新论文
💻 computer science

Codified Context: Infrastructure for AI Agents in a Complex Codebase

本文介绍了一种由热记忆宪法、19 个领域专家代理及冷记忆知识库组成的三组件“编码化上下文”基础设施,旨在解决大型复杂代码库中 LLM 智能体缺乏持久记忆的问题,并通过 283 次开发会话的定量数据与案例研究验证了其在跨会话保持连贯性与一致性方面的有效性。

原作者: Aristidis Vasilopoulos

发布于 2026-02-25
📖 1 分钟阅读☕ 轻松阅读

原作者: Aristidis Vasilopoulos

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

这篇论文讲述了一个非常有趣的故事:一位化学家(非计算机专业)如何仅凭 AI 助手,在 70 天内从零开始构建了一个拥有 10 万多行代码的大型复杂软件系统。

为了解决 AI 助手“记性不好”、容易“忘事”和“重复犯错”的痛点,作者设计了一套**“编码化上下文基础设施”**。

为了让你更容易理解,我们可以把开发这个大型软件系统比作经营一家超大型的跨国连锁餐厅

1. 核心问题:AI 是个“健忘的实习生”

普通的 AI 编程助手就像是一个极其聪明但只有 7 秒记忆的实习生

  • 你每次打开软件(开始新会话),它都像是刚入职一样,完全不记得昨天你教过它的规矩,也不记得项目里有哪些特殊的“潜规则”。
  • 如果你只给它一张小纸条(传统的 .md 配置文件),就像给这家拥有 10 万道菜的餐厅只给了一张菜单。对于小餐馆(小项目)够用,但对于大餐厅(大项目),这张纸条根本装不下所有细节,AI 很快就会晕头转向,做出难吃的菜(写出有 Bug 的代码)。

2. 解决方案:三层“记忆宫殿”

作者没有试图让 AI 变聪明,而是给 AI 建了一套分层的记忆系统,就像给餐厅配备了总厨手册、专家顾问团和中央知识库

第一层:热记忆——《餐厅总纲》(The Constitution)

  • 比喻:这是挂在厨房最显眼处的一张**“铁律海报”**。
  • 作用:无论 AI 做什么菜,这张海报永远在它眼前。上面写着最基本的规矩:比如“所有菜必须用盐”、“不能放香菜”、“必须穿白色制服”。
  • 技术对应:这是一个约 660 行的文件,每次 AI 启动时都会自动加载。它规定了代码风格、命名规则、构建命令等永远不能违反的原则。

第二层:专家顾问团——19 位“特级厨师”(Specialized Agents)

  • 比喻:餐厅里不仅有普通厨师,还有19 位各怀绝技的专家
    • 有人专门管“海鲜”(网络协议),有人专门管“甜点”(UI 界面),有人专门管“食品安全”(代码审查)。
    • 当你需要做一个复杂的“海鲜大餐”时,系统会自动呼叫“海鲜专家”来接手,而不是让普通厨师瞎琢磨。
  • 作用:这些专家不仅知道怎么做,脑子里还自带了**“避坑指南”**。比如“海鲜专家”知道如果盐放多了会死鱼(数据不同步),它一看到代码就会警觉。
  • 技术对应:19 个专门的 AI 代理,每个都内置了特定领域的深厚知识(比如网络同步、坐标系统),它们能处理普通 AI 搞不定的复杂任务。

第三层:冷记忆——《中央食谱库》(Knowledge Base)

  • 比喻:这是一个巨大的云端图书馆,里面存着 34 本厚厚的**“分册食谱”**。
  • 作用:平时这些书不摆在桌面上(节省空间),只有当“海鲜专家”需要查“如何腌制特殊鱼类”时,系统才会瞬间把那一页书翻出来给它看。
  • 技术对应:34 个详细的文档,描述各个子系统的具体运作方式。当 AI 遇到不懂的细节,它会通过搜索工具(MCP 检索服务)按需调取这些文档。

3. 这套系统是如何工作的?(自动导航)

在这个系统中,人类不需要时刻盯着 AI 说“嘿,去查一下那个文档”或者“叫那个专家来”。

  • 自动路由:系统里有一张**“触发地图”**。当 AI 看到你要修改“网络文件”时,它会自动知道:“哦,这得找‘网络协议专家’";当看到你要改“存档文件”时,它会自动去查“存档系统食谱”。
  • 结果:人类只需要说“我想加个新道具”,剩下的找谁、查什么、怎么改,系统自动安排得明明白白。

4. 实际效果:从“试错”到“精准”

论文中举了几个生动的例子:

  • 案例 1(存档系统):因为《总纲》和《食谱》里写清楚了“临时状态”和“永久数据”的区别,AI 在 74 次不同的操作中,一次都没有把临时数据存成永久的,避免了数据丢失。
  • 案例 2(UI 同步):以前 AI 做界面同步总是出错,后来人类把“怎么同步”的经验写进了《食谱》。下次再做类似功能,AI 直接照着《食谱》做,第一次就成功了,不再需要反复试错。
  • 案例 3(发现知识空白):有一次 AI 想修改“掉落系统”,结果发现《食谱》里没有这一章。这个“查无此书”的信号反而帮了大忙,提醒人类:“嘿,这个系统还没被记录,先写文档再改代码!”于是人类先补全了文档,再安全地进行了重构。
  • 案例 4(联合调试):遇到一个极其隐蔽的“时间同步”Bug,普通 AI 查了 5 次都没找到。但“网络协议专家”因为它脑子里自带了“确定性随机数”的深层理论,一眼就指出了错误所在。

5. 总结与启示

这篇论文的核心思想是:不要指望 AI 变聪明,而是要把“知识”变成“基础设施”。

  • 对于开发者:把文档当成代码的一部分来维护。如果文档过时了,AI 就会照着错误的文档干活,导致“静默失败”(代码能跑,但逻辑是错的)。
  • 对于非专业人士:即使你不是程序员,只要把业务逻辑、规则、避坑经验整理成结构化的“说明书”和“专家人设”,AI 就能成为你强大的执行者。

一句话总结
这就好比给一个天才但健忘的实习生,配了一本永远在手的铁律手册、一个随时待命的专家团和一个随叫随到的图书馆。这样,哪怕项目再大、再复杂,AI 也能像老手一样,稳定、准确地把活干好。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →