Vulcan: Instance-specialized, Verifiable Systems Heuristics Through LLM-driven Search
Vulcan 是一个利用大语言模型(LLM)来合成安全的、针对特定实例的系统启发式算法的框架,它通过将决策逻辑隔离在一种受限语言(Anvil)中并提供可信的运行时抽象,在实现执行安全性保证的同时,在竞价虚拟机(spot-VM)调度、缓存驱逐以及分层存储系统中实现了显著的性能提升。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下,你是一位大型高科技仓库的经理。你的工作是决定哪些物品应该放在快速且昂贵的货架上(比如 CPU 缓存或快速内存),哪些应该被移到缓慢且廉价的地下室(比如硬盘或竞价实例)。
几十年来,仓库经理一直依赖于手写的规则手册。这些规则手册很聪明,但它们非常僵化。它们是为某种特定类型的仓库和特定的产品组合而编写的。如果更换了建筑、产品或客户,旧的规则手册往往就会失效。为每一种场景编写新的规则手册既慢又贵,而且无法实现规模化。
最近,人们尝试使用 AI(神经网络) 来学习新规则。但这些 AI “黑盒”难以让人信任。你无法轻易看出它为什么做出某个决策,而且如果它导致仓库崩溃,那将是一场灾难。
随后出现了 大语言模型(LLM)——即会写代码的 AI。人们的想法是:“让我们让 AI 来为我们编写规则手册吧!”但这样做有一个大问题:如果你让 AI 编写整个规则手册,它可能会写出导致系统崩溃、内存泄漏或破坏仓库安全锁的代码。这就像给一个蹒跚学步的孩子一整套电动工具,然后对他说:“给我盖座房子。”他们可能会造出一些酷炫的东西,但很可能会割伤手指或烧掉整个地方。
Vulcan 是一个全新的框架,它通过改变我们向 AI 求助的方式解决了这个问题。你可以把它看作是为 AI 构建了一个安全、专业的车间。
Vulcan 的三大支柱
1. “主厨与副厨”的分工协作
在餐厅里,主厨(人类开发者)了解厨房布局、安全规范以及如何处理危险的刀具。副厨(AI)则擅长发明新的口味组合。
Vulcan 将工作进行了拆分:
- 人类(主厨): 处理“重活”。他们构建厨房,管理库存(状态),并确保门锁好。他们定义了问题的结构。
- AI(副厨): 仅被允许编写决策逻辑。他们得到一份食材清单(数据),并必须写出一个简单的食谱:“如果汤很热,就加盐;如果汤很冷,就加胡椒。”他们不被允许接触炉灶、移动家具或管理库存。
这意味着 AI 可以专注于在规则方面进行创意发挥,而不会意外破坏厨房。
2. “神奇仪表盘”(监听器)
通常,为了做出智能决策,你需要知道诸如“过去一小时内的平均温度是多少?”或“过去 5 分钟内该物品被取走的次数是多少?”之类的信息。
如果让 AI 去编写追踪这些数字的代码,它很可能会出错(例如忘记重置计数器)。
Vulcan 提供了一个神奇仪表盘(称为 libVulcan)。
- 人类开发者设置好仪表盘,其中包含预制的仪表(监听器)。
- AI 只需要观察仪表盘即可。它不需要知道仪表是如何工作的,它只需读取数值。
- 这确保了 AI 能够获得丰富、准确的数据,而无需编写复杂且易错的代码来追踪数据。
3. “辅助轮”语言(Anvil)
即使 AI 只是在写一个简单的食谱,它也可能写出一个死循环,或者尝试使用超出实际存在的内存。
Vulcan 强制要求 AI 使用一种特殊的、受限的语言,叫做 Anvil。
- 没有危险工具: AI 不能使用指针(这会导致系统崩溃),不能分配无限内存,也不能编写永不停止的循环。
- 通过构造实现安全: 因为这种语言在物理层面阻止了这些危险行为,所以 AI 编写的任何代码都能保证是安全的。这就像是给了 AI 一个玩具锤而不是一把大锤。它仍然可以盖房子,但它不会不小心把屋顶撞塌。
结果:它奏效吗?
研究人员在三个真实的“仓库”场景中测试了 Vulcan:
云端竞价虚拟机(“廉价货架”调度器):
- 问题: 云服务商提供价格低廉但随时可能被收回的计算机。你需要一条规则来决定何时使用这些便宜的机器,以及何时切换到昂贵且可靠的机器。
- 结果: Vulcan 创建的规则比最好的真人编写规则节省了 4.9 倍的资金。它学会了识别人类忽略的可用性模式。
缓存驱逐(“货架清理员”):
- 问题: 当 Web 缓存满了,应该扔掉哪个物品来腾出空间给新物品?
- 结果: 对于特定类型的网站,Vulcan 的规则比标准规则减少了 2 倍的“未命中率”(即用户需要等待数据的情况)。它发现不同的网站需要不同的“清理”策略。
内存层级管理(“快与慢的货架”):
- 问题: 在快速内存和慢速内存之间移动数据,以保持应用程序运行顺畅。
- 结果: Vulcan 的规则比现有系统提升了 10% 的应用程序性能,并且当这些规则在它们从未见过的真实硬件上进行测试时,依然有效。
核心结论
Vulcan 并不试图取代人类专家。相反,它创建了一个安全的沙盒,让 AI 可以在其中做它擅长的事(寻找完美的模式或规则),同时让人类做他们擅长的事(保持系统的安全和结构)。
通过将 AI 限制在一个小而安全的工作范围内,并为它提供一个预制工具的仪表盘,Vulcan 能够创造出比人类单独编写更安全、更快、更智能的计算机规则,而不会带来让系统崩溃的风险。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。