Towards Cybersecurity SuperIntelligence (CSI): What's the best harness for cybersecurity?
Ce papier présente la Cyberintelligence SuperIntelligente (CSI), une architecture de méta-échafaudage qui unifie des ensembles d'agents hétérogènes pilotés par des LLM via un tableau noir partagé, démontrant que la combinaison d'échafaudages structurellement diversifiés permet d'atteindre une couverture (57,6 %) et une efficacité des défis de cybersécurité nettement supérieures à celles d'un échafaudage unique.
Article original placé dans le domaine public sous CC0 1.0 (http://creativecommons.org/publicdomain/zero/1.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète
Imaginez que vous essayez de résoudre un puzzle massif et complexe (un défi de cybersécurité). Vous avez un assistant très intelligent (un modèle d'IA) qui peut vous aider, mais la manière dont vous lui donnez des instructions compte tout autant que l'intelligence de l'assistant.
Ce document pose une question simple : Quelle est la meilleure façon de « canaliser » ou de guider cette IA pour résoudre des problèmes de cybersécurité ?
Les chercheurs ont découvert qu'il n'existe pas une seule façon « parfaite » de donner des instructions. Au contraire, le secret du succès réside dans l'utilisation d'une équipe de différents styles d'instructions travaillant ensemble.
Voici la décomposition de leurs résultats à l'aide d'analogies simples :
1. Le Problème : Une Taille Ne Convient Pas À Tous
Considérez les modèles d'IA comme un détective brillant. Cependant, vous pouvez engager ce détective dans cinq « uniformes » ou « styles » différents (appelés échafaudages) :
- Style A (CSI::Claude) : Le détective qui vous parle, pose des questions et teste des outils un par un.
- Style B (CSI::Codex) : Le détective qui écrit du code pour résoudre le problème automatiquement.
- Style C (CSI::GCAI) : Un détective minimaliste qui va droit au but avec très peu de mots.
- Style D (CSI::CAI) : Un détective strict qui suit un ensemble très serré et limité de règles.
- Style E (CSI::Mistral) : Un détective qui travaille par impulsions uniques plutôt que par longues conversations.
Les chercheurs ont testé ces cinq styles sur 33 puzzles de cybersécurité différents. Ils ont constaté qu'aucun style unique n'était le meilleur pour tout.
- Parfois, le Style A résolvait un puzzle que le Style B ne pouvait pas résoudre.
- Parfois, le Style C résolvait un puzzle que le Style A avait manqué.
- Parfois, le Style D trouvait une solution que personne d'autre n'avait vue.
C'est comme une équipe sportive : vous ne voudriez pas une équipe composée de cinq gardiens de but. Vous avez besoin d'un gardien de but, d'un attaquant et d'un défenseur. Chacun possède une force unique.
2. Le Résultat « Union » : Les Mettre Dans Une Pièce
D'abord, les chercheurs ont essayé d'exécuter ces cinq styles l'un après l'autre (ou simplement en choisissant le meilleur).
- Le meilleur style unique a résolu environ 45 % des puzzles.
- S'ils combinaient les résultats des quatre styles principaux (en ignorant le cinquième un instant), ils résolvaient 51,5 % des puzzles.
Cela a prouvé que les styles sont complémentaires. Ils échouent sur des choses différentes. Si vous avez une équipe de styles différents, vous couvrez plus de terrain que n'importe quel expert seul.
3. La Révélation « Tableau Noir » : La Vraie Magie
Les chercheurs ne se sont pas arrêtés à la simple possession d'une équipe ; ils ont construit un système où l'équipe pouvait se parler en temps réel.
Ils ont créé un « Tableau Noir » (un tableau blanc numérique partagé).
- Fonctionnement : Tous les différents styles d'IA fonctionnent en même temps. Au fur et à mesure qu'ils travaillent, ils écrivent leurs découvertes, leurs indices et leurs solutions partielles sur ce tableau noir partagé.
- La Magie : Si le « Style A » est bloqué, il peut regarder le tableau noir et voir que le « Style B » vient de trouver un indice qui l'aide. Si le « Style C » trouve un petit morceau du puzzle, le « Style D » peut utiliser ce morceau pour terminer le travail.
Le Résultat :
- En leur permettant de partager des informations, ils ont résolu 57,6 % des puzzles.
- C'est 27 % de mieux que le meilleur style unique travaillant seul.
- Ils l'ont fait plus rapidement (20,2 heures contre 26,8 heures) et pour un coût similaire.
4. La Grande Conclusion
Le document conclut que la « meilleure canalisation » pour l'IA en cybersécurité n'est pas d'essayer de construire un seul agent d'IA parfait et surintelligent.
Au contraire, la meilleure approche consiste à construire une équipe diversifiée d'agents différents, utilisant tous le même cerveau sous-jacent (le même modèle d'IA), mais avec des « personnalités » ou des façons de travailler différentes. Lorsque vous leur permettez de partager un « tableau noir » pour échanger des idées, ils deviennent beaucoup plus intelligents que la somme de leurs parties.
En bref : Ne cherchez pas l'outil parfait unique. Construisez une boîte à outils avec différents outils, laissez-les travailler ensemble et regardez-les résoudre des problèmes qu'aucun d'eux ne pourrait résoudre seul.
Noyé(e) sous les articles dans votre domaine ?
Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.