← Derniers articles
💻 computer science

From Skill Text to Skill Structure: The Scheduling-Structural-Logical Representation for Agent Skills

Cet article présente la représentation Scheduling-Structural-Logical (SSL), un nouveau cadre structuré pour les compétences des agents qui dissocie la planification, l'exécution et les preuves logiques pour surpasser nettement les références basées uniquement sur le texte dans les tâches de découverte de compétences et d'évaluation des risques.

Auteurs originaux : Qiliang Liang, Hansi Wang, Zhong Liang, Yang Liu

Publié 2026-04-28
📖 5 min de lecture🧠 Analyse approfondie

Auteurs originaux : Qiliang Liang, Hansi Wang, Zhong Liang, Yang Liu

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez que vous possédez une immense bibliothèque de « recettes » pour des agents IA. Il ne s'agit pas de simples listes d'ingrédients, mais d'instructions complexes et multi-étapes indiquant à une IA comment utiliser des outils, accéder à des fichiers et exécuter des tâches. Actuellement, ces recettes sont rédigées sous forme de longs paragraphes de texte désordonnés (comme un fichier SKILL.md).

Le problème ? Les humains peuvent lire ces paragraphes facilement, mais les ordinateurs peinent à comprendre les étapes spécifiques, l'ordre des opérations ou les dangers potentiels cachés dans le texte. C'est comme essayer de trouver un ingrédient précis dans un roman ; l'information est là, mais elle est enfouie dans l'histoire.

Ce papier présente une nouvelle façon d'organiser ces recettes, appelée SSL (Scheduling-Structural-Logical). Considérez SSL comme la transformation de ce roman désordonné en un organigramme clair en trois parties qu'un ordinateur peut scanner instantanément.

Voici comment SSL décompose une compétence, en utilisant des analogies simples :

1. La couche de Planification (Scheduling) : La « Carte du Menu »

Ce que c'est : Il s'agit du résumé de haut niveau. Il indique ce que fait la compétence, quand l'utiliser et ce dont elle a besoin pour démarrer.
L'Analogie : Imaginez entrer dans un restaurant. Vous n'avez pas besoin de lire toute la biographie du chef ou l'histoire de la cuisine pour savoir si vous voulez les « Nouilles Piquantes ». Vous regardez simplement la Carte du Menu. Elle liste le nom du plat, le prix (les entrées) et ce que vous obtenez en retour (les sorties).
Dans le papier : Cette couche extrait l'« Objectif », les « Étiquettes » et les « Entrées/Sorties » afin que l'IA puisse décider rapidement : « Oui, cette compétence correspond à ma demande », sans avoir à lire tout le document.

2. La couche Structurelle : Le « Scénario de Film »

Ce que c'est : Elle décompose la compétence en scènes ou phases majeures.
L'Analogie : Pensez à un film. Il ne se déroule pas tout d'un coup ; il possède une Structure de l'Intrigue : Acte 1 (Préparation), Acte 2 (Le Voyage), Acte 3 (Le Climax), et Acte 4 (Résolution).
Dans le papier : Au lieu d'un mur de texte, SSL organise la compétence en scènes telles que « Préparer », « Acquérir », « Agir » et « Vérifier ». Cela aide l'ordinateur à comprendre le flux de la tâche. Il sait que vous devez « Préparer » avant de pouvoir « Agir ».

3. La couche Logique : La « Liste des Actions »

Ce que c'est : C'est le détail concret de ce qui se passe réellement dans chaque scène. Elle liste les actions spécifiques et les ressources (comme des fichiers ou des mots de passe) qu'elles touchent.
L'Analogie : Il s'agit de la Liste des Plans pour une scène spécifique du film. Elle indique : « Caméra 1 : Lire le fichier », « Caméra 2 : Appeler l'API », « Caméra 3 : Écrire dans la base de données ». Elle note également si la caméra touche une « Zone Dangereuse » (comme un fichier de mots de passe).
Dans le papier : Cette couche identifie les actions atomiques (comme « LIRE » ou « ÉCRIRE ») et signale exactement quelles ressources sont impliquées. Cela est crucial pour repérer les risques, comme « Oh, cette compétence est sur le point de lire un fichier de mots de passe et de l'envoyer sur Internet ».


Pourquoi l'ont-ils fait ? (Les Expériences)

Les chercheurs ont testé ce nouveau système d'« organigramme » contre l'ancien système de « texte désordonné » de deux manières principales :

1. Trouver la Bonne Recette (Découverte de Compétences)

  • Le Test : Ils ont demandé à l'ordinateur : « J'ai besoin d'une compétence pour corriger mon écriture », et ont observé à quelle vitesse il pouvait trouver la bonne dans une bibliothèque de 6 000 compétences.
  • Le Résultat : Lorsque l'ordinateur utilisait l'organigramme SSL, il trouvait la bonne compétence beaucoup plus vite et avec plus de précision. C'était comme passer de la recherche dans une bibliothèque en lisant chaque livre de la première à la dernière page à l'utilisation d'un catalogue de cartes parfaitement organisé.
  • Le Gain : Le taux de réussite a considérablement augmenté (de 0,573 à 0,707).

2. Repérer les Recettes Dangereuses (Évaluation des Risques)

  • Le Test : Ils ont demandé à l'ordinateur d'examiner 500 compétences et de dire : « Est-ce dangereux ? Cela vole-t-il des données ou supprime-t-il des fichiers ? »
  • Le Résultat : Lorsque l'ordinateur disposait de l'organigramme SSL en plus du texte, il était bien meilleur pour repérer des dangers spécifiques comme l'« Exfiltration de Données » (vol de données) ou le « Comportement Destructif » (suppression de fichiers). La liste structurée d'actions faisait ressortir les risques comme des drapeaux rouges sur une carte.
  • Le Gain : La précision du repérage des risques s'est améliorée (de 0,744 à 0,787).

La Grande Conclusion

Le papier soutient que SSL n'est pas destiné à remplacer le texte original. Vous avez toujours besoin du « roman » original (le fichier SKILL.md) pour l'histoire complète, les exemples et le contexte humain.

Au lieu de cela, SSL est un « traducteur » qui transforme ce roman en une carte structurée et lisible par machine.

  • Il aide les ordinateurs à trouver rapidement le bon outil.
  • Il aide les ordinateurs à voir clairement les risques.
  • Il maintient le texte original en tant que « source de vérité » tout en offrant à la machine une vue propre et organisée sur laquelle travailler.

En bref : le papier montre que si vous voulez des agents IA plus sûrs et plus intelligents, vous ne devriez pas simplement leur donner plus de texte ; vous devriez leur fournir une carte structurée de ce que ce texte fait réellement.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →