← 最新论文
💻 computer science

From Skill Text to Skill Structure: The Scheduling-Structural-Logical Representation for Agent Skills

本文介绍了调度 - 结构 - 逻辑(SSL)表示法,这是一种新颖的代理技能结构化框架,它将调度、执行和逻辑证据解耦,从而在技能发现与风险评估任务中显著超越纯文本基线。

原作者: Qiliang Liang, Hansi Wang, Zhong Liang, Yang Liu

发布于 2026-04-28
📖 1 分钟阅读☕ 轻松阅读

原作者: Qiliang Liang, Hansi Wang, Zhong Liang, Yang Liu

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象你拥有一个庞大的 AI 智能体“食谱”图书馆。这些不仅仅是食材清单;它们是复杂的多步骤指令,告诉 AI 如何使用工具、访问文件以及执行任务。目前,这些食谱被写成冗长、杂乱的文本段落(类似于 SKILL.md 文件)。

问题出在哪里?人类可以轻松阅读这些段落,但计算机却难以理解其中的具体步骤、操作顺序或隐藏在文本中的潜在危险。这就像试图在一部小说中寻找特定的食材;信息确实存在,但被埋没在故事之中。

本文提出了一种组织这些食谱的新方法,称为SSL(调度 - 结构 - 逻辑)。将 SSL 想象成将那部杂乱的小说转化为计算机可即时扫描的清晰三部分流程图。

以下是 SSL 如何运用简单类比来分解一项技能:

1. 调度层: “菜单卡”

它是什么: 这是顶层摘要。它告诉你这项技能做什么何时使用以及启动它需要什么。
类比: 想象你走进一家餐厅。你不需要阅读厨师的完整传记或厨房的历史,就能知道是否想要“辣面条”。你只需查看菜单卡。它列出了菜名、价格(输入)以及你获得的回报(输出)。
在论文中: 这一层提取“目标”、“标签”和“输入/输出”,以便 AI 能够快速决定“是的,这项技能符合我的请求”,而无需阅读整份文档。

2. 结构层: “电影剧本”

它是什么: 这将技能分解为主要的场景或阶段。
类比: 想想一部电影。它不会一次性发生;它具有情节结构:第一幕(准备)、第二幕(旅程)、第三幕(高潮)和第四幕(结局)。
在论文中: SSL 不是将技能堆砌成文字墙,而是将其组织成“准备”、“获取”、“执行”和“验证”等场景。这有助于计算机理解任务的流程。它知道必须先“准备”才能“执行”。

3. 逻辑层: “行动清单”

它是什么: 这是每个场景中实际发生的具体细节。它列出了具体的动作以及它们触及的资源(如文件或密码)。
类比: 这是电影中特定场景的分镜头脚本。它写道:“镜头 1:读取文件”,“镜头 2:调用 API",“镜头 3:写入数据库”。它还注明镜头是否触及了“危险区域”(如密码文件)。
在论文中: 这一层识别原子动作(如“读取”或“写入”),并精确标记涉及哪些资源。这对于识别风险至关重要,例如“哦,这项技能即将读取密码文件并将其发送到互联网”。


他们为什么要这样做?(实验部分)

研究人员在两个主要方面将这种新的“流程图”系统与旧的“杂乱文本”系统进行了测试:

1. 找到正确的食谱(技能发现)

  • 测试: 他们询问计算机:“我需要一个修复写作的技能”,并观察它在包含 6,000 项技能的图书馆中多快能找到正确的那一个。
  • 结果: 当计算机使用SSL 流程图时,它更快、更准确地找到了正确的技能。这就像从逐本通读图书馆书籍进行搜索,转变为使用完美、有序的卡片目录。
  • 成果: 成功率显著提高(从 0.573 提升至 0.707)。

2. 发现危险的食谱(风险评估)

  • 测试: 他们要求计算机查看 500 项技能并回答:“这危险吗?它会窃取数据或删除文件吗?”
  • 结果: 当计算机拥有SSL 流程图作为文本的补充时,它在识别具体危险(如“数据泄露”或“破坏性行为”)方面表现更好。结构化的行动列表使风险像地图上的红旗一样“跃然纸上”。
  • 成果: 风险识别的准确性得到提升(从 0.744 提升至 0.787)。

核心结论

论文认为,SSL 并非旨在取代原始文本。你仍然需要原始的“小说”(即 SKILL.md 文件)来获取完整的故事、示例和人类语境。

相反,SSL 是一个“翻译器”,它将那部小说转化为结构化的、机器可读的地图。

  • 它帮助计算机快速找到正确的工具。
  • 它帮助计算机清晰地看到风险。
  • 它将原始文本作为“事实来源”安全保留,同时为机器提供清晰、有序的工作视图。

简而言之:论文表明,如果你希望 AI 智能体更安全、更智能,你不应该只是向它们灌输更多文本;而应该为它们提供一份关于该文本实际作用的结构化地图。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →