Microskill Architecture: A Modular Skill-Driven Framework for AI-Native Code Generation
本文介绍了 MicroSkill 架构,这是一种将知识划分为原子技能胶囊并利用动态路由器仅选择相关上下文的模块化框架,从而将 Token 消耗降低了 90% 以上,并显著提升了 AI 原生代码生成中的编译成功率与架构完整性。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下,你正在试图教一位才华横溢但非常健忘的助手如何建造一座宏大且复杂的城市(一个软件项目)。
旧方法:“消防栓”式方法
目前,当开发者使用 AI 编写代码时,他们试图通过将整个城市的蓝图、每一张街道地图以及每一栋建筑的说明书全部一次性倾倒进 AI 的记忆中来帮助 AI。
- 问题所在: AI 会感到不堪重负。这就像是在一个被灌入了数百万本书籍的图书馆里寻找一本特定的食谱。AI 会变得困惑,在指令中间遗忘重要的细节(这就是论文中所说的“迷失在中部”问题),并开始犯下昂贵的错误。它可能会在试图修理公园时,不小心拆掉了一座桥,因为它无法追踪规则。此外,每次你提出一个小改动时,“阅读”这些书籍都要花费巨资。
新方法:“微技能”架构
该论文提出了一种名为 MicroSkill Architecture(微技能架构) 的新系统。与其给 AI 整个图书馆,不如给它一组专门的、上锁的工具箱。
工具箱(技能胶囊):
把项目分解为一个个微小且具体的任务。- 一个工具箱贴着“安全门”的标签(它只知道如何处理密码和身份验证)。
- 另一个工具箱贴着“水管”的标签(它只了解数据库)。
- 还有一个是“交通灯”(它只了解用户界面)。
每个工具箱仅包含处理该特定工作所需的精确指令、规则和示例。除非需要,否则 AI 永远不会看到其他的工具箱。
智能管家(动态路由):
当你要求 AI “增加一个新的安全门”时,一个聪明的管家(路由器)会倾听你的请求。它不会把整个图书馆交给 AI,而是快速挑选出“安全门”工具箱并将其交给 AI。- 结果: AI 不会被无关信息干扰。它的工作速度更快,成本更低(因为阅读的词汇更少),也更不容易出错,因为它在修理“安全门”时不会误触“水管”。
自我学习循环:
这里是神奇之处。如果 AI 发现了一个修复“水管”问题的绝妙新方法,并且这个方法效果很好,系统并不会仅仅把这个想法丢弃。- 系统会自动提取这个新方案,对其进行整理,并将其放入一个全新的工具箱中。
- 现在,下次 AI 需要修理管道时,它已经准备好了这份新的、更好的说明书。系统实际上在无需人类记录的情况下,随着时间的推移,不断构建自己的技能库,变得越来越聪明。
论文的研究结果
作者在一个大型软件项目(内容管理系统)上测试了这一点,要求 AI 构建 15 个复杂的功能。他们将“消防栓”方法与“微技能”方法进行了对比:
- 成本: 新方法减少了 93% 的“阅读量”(Token)。这就像是从阅读百科全书切换到了阅读一张索引卡片。
- 成功率: AI 第一次就能写对代码的概率为 86%(而旧方法仅为 40%)。
- 安全性: AI 犯下破坏整体构建规则错误的次数为 零。在旧方法中,它违反规则了 12 次。
- 成长性: 系统在测试期间自动创建了 7 个新工具箱(技能),并将其用于后续的任务中。
总结
论文认为,要利用 AI 构建软件,我们不应该试图让 AI 记住一切。相反,我们应该为当前特定的工作提供微小且完美的指令,并让它在执行过程中学习新的指令。这使得 AI 更便宜、更快速、更安全,并且能够自学成才。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。