← Nieuwste papers
🤖 AI

KYA: A Framework-Agnostic Trust Layer for Autonomous Systems with Verifiable Provenance and Hierarchical Policy Composition

KYA is een open-source, framework-onafhankelijke vertrouwenslaag voor autonome systemen die vijf kernprimitieven inzet – waaronder een beveiligde vier-poort toepassingpijplijn, hiërarchische beleidscompositie en een geünificeerde vertrouwensscore – om agentdrift, lekken en adversariale aanvallen te detecteren, terwijl sub-milliseconde latentie en een hoge doorvoer worden gehandhaafd.

Oorspronkelijke auteurs: Kolawole Quadri

Gepubliceerd 2026-05-26
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Kolawole Quadri

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een vloot autonome robots (AI-agenten) hebt die voor je werken. Ze solliciteren voor leningen, sorteren medische patiënten of handelen in aandelen. De tools die we momenteel gebruiken om deze robots in de gaten te houden (zogenaamde "observability") zijn als het dashboard van een auto: ze vertellen je of de motor heet loopt, of de auto traag rijdt of of een onderdeel kapot is.

KYA (Know Your Agents) is een nieuw systeem dat niet alleen de motor in de gaten houdt; het fungeert als een beveiliger, een rechercheur en een notaris in één. Het beantwoordt de vragen die het dashboard niet kan beantwoorden: Liegt deze robot? Drijft hij af van koers? Lekt hij geheimen? En als er iets misgaat, wie is dan eigenlijk verantwoordelijk?

Hieronder wordt uitgelegd hoe KYA werkt, opgesplitst in vijf eenvoudige onderdelen met dagelijkse analogieën:

1. De Vier-poortse Veiligheidscontrole (De "Portier")

Voordat een AI-agent iets nieuws mag doen of zijn regels mag wijzigen, moet hij door vier strenge veiligheidsporten. Denk hierbij aan een hoogbeveiligde bankkluis:

  • Poort 1: Heeft de persoon die de sleutel heeft, dit verzoek daadwerkelijk ondertekend? (Controle van digitale handtekening).
  • Poort 2: Is dit verzoek nog geldig, of is het verlopen? (Tijdcontrole).
  • Poort 3: Maakt dit verzoek de regels strenger of laxer? KYA staat alleen toe dat regels strenger worden (veiliger), nooit laxer. Het is alsof een ouder zegt: "Je mag meer klusjes toevoegen, maar je mag de klusjes die je al hebt niet verwijderen."
  • Poort 4: Heeft een mens daadwerkelijk "ja" gezegd? Standaard moet een mens de wijziging goedkeuren.

2. De Alleen-verstrakken-regel (De "Veiligheidsrooster")

Stel je een regelboek voor voor je robots. Het bedrijf (het platform) stelt de basisregels vast. Jij (de huurder) kunt je eigen strengere regels erbovenop toevoegen, maar je kunt de veiligheidsregels van het bedrijf nooit verwijderen.
KYA gebruikt een speciaal wiskundig systeem om ervoor te zorgen dat, ongeacht hoeveel mensen regels toevoegen, het systeem nooit per ongeluk minder veilig wordt. Het is als een stapel veiligheidsnetten: je kunt meer netten toevoegen, maar je kunt er nooit één van onderuit weghalen.

3. KYP: "Know Your Principal" (De "Universele Identiteitskaart")

In het verleden hadden we aparte identiteitskaarten voor mensen, aparte scores voor robots en aparte logs voor geautomatiseerde scripts. KYA zet ze allemaal op één enkel identiteitskaartsysteem.
Of de actor nu een menselijke werknemer, een AI-robot of een achtergrondscript is, KYA geeft hen een "Vertrouwensscore". Als een robot zich begint mis te gedragen, daalt zijn score. Als een mens een fout maakt, daalt hun score. Het behandelt iedereen op dezelfde manier, waardoor het gemakkelijk is om te zien wie betrouwbaar is en wie risicovol.

4. De "Interactie-veelvoud" (De "Gevaarlijke Combinatie")

Soms is een enkele actie prima, maar zijn twee acties samen gevaarlijk.

  • Voorbeeld: Een robot een "schrijf"-tool geven is riskant. Een robot toegang geven tot "privégegevens" is riskant.
  • De Veelvoud: Als je een robot zowel een schrijf-tool als toegang tot privégegevens geeft, is het gevaar niet alleen "riskant + riskant". Het is "supergevaarlijk".
    KYA heeft een speciale lijst van deze "gevaarlijke combinaties". Wanneer het ze ziet, vermenigvuldigt het de risicoscore, waardoor de menselijke operator wordt gewaarschuwd dat deze specifieke combinatie extra scrutiny vereist.

5. De "Schuldspel" (De "Verantwoordelijkheid van de Orkestrator")

Dit is een van de belangrijkste functies. Stel je een "Manager-robot" voor die drie "Werkrobotjes" huurt om een klus te doen. Als één Werkrobotje de baas wordt en data steelt, wie krijgt dan de schuld?

  • Oude manier: De Werkrobot krijgt de schuld. De Manager-robot loopt er schoon vandaan.
  • KYA-methode: De Manager-robot krijgt de schuld.
    KYA gaat ervan uit dat als je een riskante werknemer huurt, jij verantwoordelijk bent voor wat ze doen. Als een sub-agent zich misdraagt, trekt het systeem direct punten af van de vertrouwensscore van de Manager. Dit voorkomt dat managers zich verstoppen achter "schone" sub-agenten om vuile werk te doen.

Hoe het Bewijs behandelt (Het "Verstoorde Dagboek")

Elke keer dat een agent iets doet, schrijft KYA het in een digitaal dagboek. Maar dit is niet zomaar een logboek; het is een cryptografisch geketend dagboek.

  • Elke vermelding is gekoppeld aan de vorige met een speciaal wiskundig slot (HMAC).
  • Als iemand probeert terug te gaan en een oude vermelding te wijzigen (zoals het wissen van een fout), breekt het slot en wordt het hele dagboek gemarkeerd als "verstoord".
  • Dit creëert een voor de rechtbank toelaatbaar verslag van precies wat er gebeurd is, wie het heeft gedaan en wanneer.

Wat het Artikel Eigenlijk Vond

De auteurs testten dit systeem met enkele zware uitdagingen:

  • Snelheid: Het is ongelooflijk snel. Het kan duizenden agenten per seconde controleren zonder ze te vertragen.
  • Compatibiliteit: Het werkt met meer dan 15 verschillende soorten AI-frameworks (zoals LangChain, CrewAI, enz.). Het maakt niet uit welke software je gebruikt; KYA past erbovenop.
  • Hacktests: Het team huurde "red team"-hackers in om de agenten te proberen te misleiden. KYA ving 89% van de aanvallen op, waaronder een zeer lastige nieuwe aanvalstijp waarbij hackers een keten van robots gebruiken om hun sporen te verbergen.
  • Realistische Scenario's: Ze testten het op een gesimuleerd bankleningssysteem en een ziekenhuis triagesysteem. In beide gevallen slaagde het erin risicovolle agenten te identificeren en slecht gedrag terug te traceren naar de juiste persoon (of robot).

De Conclusie

KYA is een open-source tool (gratis te gebruiken) die zich bevindt tussen je AI-agenten en de echte wereld. Het vertelt je niet alleen of de AI werkt; het vertelt je of de AI veilig, eerlijk en verantwoordelijk is. Het zorgt ervoor dat als een AI een fout maakt, we precies weten wie we ter verantwoording moeten roepen, en we een verstoorde record hebben om dit te bewijzen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →