← Derniers articles
🤖 AI

Observability for Delegated Execution in Agentic AI Systems

Cet article traite de l'incapacité des journaux d'audit standards à identifier de manière unique les portées de délégation dans les systèmes d'agents dynamiques basés sur les LLM en proposant un substrat d'observabilité conscient de l'agent qui lie le contexte de délégation au moment de l'exécution afin de permettre une reconstruction forensique fiable et sans heuristique.

Auteurs originaux : Abhinav Mishra, Kumar Sharad

Publié 2026-06-09
📖 6 min de lecture🧠 Analyse approfondie

Auteurs originaux : Abhinav Mishra, Kumar Sharad

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez que vous engagiez une équipe d'assistants hautement qualifiés et autonomes (des agents IA) pour gérer un projet complexe. Vous leur donnez un objectif large : « Organisez nos données de vente et partagez le résumé avec l'équipe. »

Par le passé, si vous engagiez un employé humain, vous pouviez facilement suivre sa journée : il ouvrait un fichier, envoyait un e-mail et imprimait un rapport. Mais ces agents IA sont différents. Ils ne suivent pas une ligne droite. Ils peuvent :

  • Diviser le travail en tâches plus petites et les envoyer à d'autres sous-assistants IA.
  • Essayer un outil, échouer, puis en essayer un autre.
  • Exécuter plusieurs tâches exactement en même temps sur différents ordinateurs.
  • Être confus par un document complexe et faire accidentellement quelque chose qu'ils n'étaient pas censés faire, tout en agissant toujours sous votre permission initiale.

Le Problème : Le « Fantôme » de la Délégation
Les auteurs de cet article soutiennent que notre façon actuelle de suivre ces agents est défaillante. Nous avons des « journaux d'audit » (comme une caméra de surveillance) et des « traces » (comme une carte du chemin parcouru).

Cependant, l'article affirme que vous ne pouvez pas déterminer quelles actions appartenaient à votre délégation spécifique simplement en regardant ces journaux.

Voici une analogie : Imaginez deux chauffeurs de livraison différents (Délégation A et Délégation B) travaillant dans la même ville. Ils utilisent tous deux les mêmes routes (outils) et se croisent parfois.

  • L'ancienne méthode : Nous disposons seulement d'un journal de chaque voiture ayant passé un carrefour spécifique et de l'heure à laquelle cela s'est produit.
  • Le problème : Si le Chauffeur A et le Chauffeur B passent tous deux le carrefour à 14h00, et que leurs chemins se ressemblent, nous ne pouvons pas savoir quel chauffeur a fait quoi en regardant simplement le journal de trafic. Nous pourrions supposer qu'ils étaient ensemble parce qu'ils étaient proches dans le temps, mais ce n'est qu'une supposition. Si leurs chemins se chevauchent, s'ils tentent à nouveau ou se séparent, la supposition devient impossible.

L'article prouve mathématiquement que sans un étiquetage spécifique attaché à la permission elle-même, il est impossible de reconstruire exactement ce que votre délégation a fait. L'« autorité » (qui a donné l'ordre) est complètement séparée de la « causalité » (l'ordre dans lequel les choses se sont produites).

La Solution : La « Passerelle Intelligente » et le « Badge Universel »
Pour corriger cela, les auteurs proposent un nouveau système appelé CIM (Modèle d'Information Commun) et une Passerelle.

  1. La Passerelle (Le Gardien de Sécurité) : Imaginez un garde de sécurité debout à la porte de chaque outil que l'IA veut utiliser (comme un serveur de fichiers, une application de chat ou une base de données).
  2. Le Badge Universel (L'ID de Délégation) : Lorsque l'IA commence un travail, le système délivre un « ID de Badge » unique et immuable pour cette délégation spécifique.
  3. La Règle : Chaque fois que l'IA touche à quoi que ce soit, la Passerelle vérifie la présence du Badge. Si l'IA agit sous votre permission, la Passerelle appose votre ID de Badge sur cette action avant qu'elle ne se produise.

Cela diffère de l'ajout d'un simple « ID de Session » (comme un numéro de ticket pour un voyage unique). Un ID de Session se brise si l'IA divise le travail en sous-équipes ou réessaie une tâche. Le Badge ID reste lié à l' autorité, même si l'IA génère un sous-agent, exécute des tâches en parallèle ou fait des va-et-vient.

Ce que cela nous permet de faire
Avec ce nouveau système, poser des questions devient facile et précis, comme rechercher un client spécifique dans une base de données plutôt que de deviner en fonction de qui se trouvait près de la porte.

  • La question du « Rayon d'action » : Au lieu de deviner : « Quels fichiers l'IA a-t-elle touchés entre 14h00 et 14h30 ? » (ce qui pourrait inclure le travail d'autres personnes), vous pouvez demander : « Montrez-moi chaque fichier touché par le Badge n°123, quel que soit l'outil utilisé ou le moment. »
  • La question du « Sous-agent » : Si l'IA principale a engagé un sous-agent pour faire le travail difficile, le Badge garantit que les actions du sous-agent sont toujours clairement liées à votre délégation d'origine.
  • La question de la « Dérive » : Si l'IA a commencé par lire des fichiers sûrs mais a soudainement commencé à lire des fichiers secrets, le système peut détecter cette « dérive » dans le journal d'activité du Badge, même si l'IA n'a pas demandé la permission pour changer.

Limitations Importantes (Ce que l'article ne prétend PAS)

  • Il ne lit pas les pensées : Le système ne sait pas si l'IA avait l'intention de faire quelque chose ou si elle a été trompée (comme par une « injection de prompt »). Il enregistre seulement que l'action a eu lieu sous votre délégation. Si l'IA a été trompée pour voler un fichier, le système dira : « Votre délégation a fait cela », et non « L'IA a été piratée ».
  • Il a besoin d'une porte : Le système ne fonctionne que si l'IA passe par la « Passerelle ». Si l'IA trouve une porte dérobée ou utilise un outil que la Passerelle ne surveille pas, ces actions sont invisibles.
  • Ce n'est pas un outil de prévention : Il ne l'empêche pas de faire de mauvaises choses ; il permet simplement de voir avec précision ce qui s'est passé après coup.

En Résumé
L'article soutient qu'à mesure que les agents IA deviennent plus chaotiques et complexes, notre ancienne façon de les suivre (en observant le temps et les chemins) échoue. Nous avons besoin d'une nouvelle façon de suivre qui suit la permission elle-même, et non pas seulement le chemin. En attachant un « Badge » permanent à chaque action au moment où elle se produit, nous pouvons enfin reconstruire exactement ce que notre IA déléguée a fait, même lorsqu'elle tourne en rond, se divise en équipes ou travaille à travers de nombreux systèmes différents.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →