Towards Cybersecurity SuperIntelligence (CSI): What's the best harness for cybersecurity?
Dit artikel introduceert Cybersecurity SuperIntelligence (CSI), een meta-scaffold-architectuur die heterogene door LLM-aangedreven agent-harnassen verenigt via een gedeeld zwartbord, en aantoont dat het combineren van structureel diverse scaffolds aanzienlijk bredere cybersecurity-uitdagingen (57,6%) en efficiëntie bereikt dan enige enkele scaffold op zichzelf.
Oorspronkelijk artikel vrijgegeven aan het publieke domein onder CC0 1.0 (http://creativecommons.org/publicdomain/zero/1.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je voor dat je probeert een enorme, complexe puzzel op te lossen (een cyberveiligheidsuitdaging). Je hebt een zeer slimme assistent (een AI-model) die je kan helpen, maar de manier waarop je hen instructies geeft, is net zo belangrijk als de intelligentie van de assistent.
Dit artikel stelt een simpele vraag: Wat is de beste manier om deze AI te "benutten" of te sturen bij het oplossen van cyberveiligheidsproblemen?
De onderzoekers ontdekten dat er geen enkele "perfecte" manier is om instructies te geven. In plaats daarvan is het geheim van succes het gebruik van een team van verschillende instructiestijlen die samenwerken.
Hier is de uiteenzetting van hun bevindingen met behulp van eenvoudige analogieën:
1. Het Probleem: Eén maat past niet bij iedereen
Stel je de AI-modellen voor als een briljante detective. Je kunt deze detective echter in vijf verschillende "uniformen" of "stijlen" inhuren (zogenaamde scaffolds):
- Stijl A (CSI::Claude): De detective die met je praat, vragen stelt en tools één voor één probeert.
- Stijl B (CSI::Codex): De detective die code schrijft om het probleem automatisch op te lossen.
- Stijl C (CSI::GCAI): Een minimalistische detective die met zeer weinig woorden direct ter zake komt.
- Stijl D (CSI::CAI): Een strenge detective die een zeer strakke, beperkte reeks regels volgt.
- Stijl E (CSI::Mistral): Een detective die werkt in enkele bursts in plaats van lange gesprekken.
De onderzoekers testten alle vijf stijlen op 33 verschillende cyberveiligheidspuzzels. Ze ontdekten dat geen enkele stijl in alles het beste was.
- Soms loste Stijl A een puzzel op die Stijl B niet kon oplossen.
- Soms loste Stijl C een puzzel op die Stijl A had gemist.
- Soms vond Stijl D een oplossing die niemand anders zag.
Het is als een sportteam: je wilt geen team van vijf keepers. Je hebt een keeper, een spits en een verdediger nodig. Iedereen heeft een unieke kracht.
2. Het "Unie"-resultaat: Ze in één kamer zetten
Eerst probeerden de onderzoekers deze vijf stijlen achter elkaar te draaien (of gewoon de beste één te kiezen).
- De beste enkele stijl loste ongeveer 45% van de puzzels op.
- Als ze de resultaten van alle vier hoofdstijlen combineerden (de vijfde even negerend), losten ze 51,5% van de puzzels op.
Dit bewees dat de stijlen aaneensluitend zijn. Ze falen op verschillende dingen. Als je een team van verschillende stijlen hebt, dek je meer grond af dan welke enkele expert ook alleen zou kunnen.
3. De "Zwarte Bord"-doorbraak: De echte magie
De onderzoekers hielden niet op bij het hebben van een team; ze bouwden een systeem waarin het team in real-time met elkaar kon praten.
Ze creëerden een "Zwarte Bord" (een gedeeld digitaal whiteboard).
- Hoe het werkt: Alle verschillende AI-stijlen draaien tegelijkertijd. Terwijl ze werken, schrijven ze hun bevindingen, aanwijzingen en deels oplossingen op dit gedeelde zwarte bord.
- De magie: Als "Stijl A" vastloopt, kan het kijken naar het zwarte bord en zien dat "Stijl B" net een aanwijzing heeft gevonden die het helpt. Als "Stijl C" een klein stukje van de puzzel vindt, kan "Stijl D" dat stukje gebruiken om de klus te klaren.
Het resultaat:
- Door hen informatie te laten delen, losten ze 57,6% van de puzzels op.
- Dit is 27% beter dan de beste enkele stijl die alleen werkt.
- Ze deden dit sneller (20,2 uur versus 26,8 uur) en voor een soortgelijke kost.
4. De grote conclusie
Het artikel concludeert dat de "beste benutting" voor cyberveiligheids-AI niet ligt in het proberen om één perfecte, super-slimme AI-agent te bouwen.
In plaats daarvan is de beste aanpak het bouwen van een divers team van verschillende agenten, die allemaal dezelfde onderliggende hersenen gebruiken (hetzelfde AI-model), maar met verschillende "persoonlijkheden" of werkmethoden. Als je ze een "zwart bord" laat delen om ideeën uit te wisselen, worden ze veel slimmer dan de som van hun delen.
Kortom: Zoek niet naar het ene perfecte gereedschap. Bouw een gereedschapskist met verschillende gereedschappen, laat ze samenwerken en zie hoe ze problemen oplossen die geen van hen alleen had kunnen oplossen.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.