← Nieuwste papers
💬 NLP

On the Importance and Evaluation of Narrativity in Natural Language AI Explanations

Dit paper pleit voor het gebruik van narratieve verklaringen in Explainable AI om menselijk begrip te bevorderen via vier kernkenmerken, introduceert zeven nieuwe automatische metrieken om deze kwaliteit te meten en stelt generatieregels voor om narratieve XAI-verklaringen te produceren die superieur zijn aan bestaande methoden.

Oorspronkelijke auteurs: Mateusz Cedro, David Martens

Gepubliceerd 2026-04-21
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Mateusz Cedro, David Martens

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een complexe machine hebt, zoals een slimme creditcard-app die beslist of je een lening krijgt. De machine zegt: "Ja, je krijgt het." Maar waarom?

De meeste huidige systemen geven je een lijstje: "Fout 1: Je leeftijd. Fout 2: Je inkomen. Fout 3: Je huur." Het is technisch correct, maar het voelt als een recept zonder instructies. Je weet wat er belangrijk was, maar niet hoe die dingen samenwerken om tot dat besluit te komen.

Dit artikel van Mateusz Cedro en David Martens zegt: "Stop met lijsten. Vertel een verhaal."

Hier is de kern van hun onderzoek, vertaald in een eenvoudig verhaal met een paar creatieve vergelijkingen.

1. Het Probleem: De "Telefoonnummer-lijst" vs. De "Detective"

Stel je voor dat je een detective bent die een moord moet oplossen.

  • De huidige AI (De Lijst): De AI geeft je een stapel foto's van verdachten en zegt: "Suspect A had een mes. Suspect B was op het toneel. Suspect C had een motief." Het is waar, maar het vertelt je niet wie de dader is of hoe het gebeurde. Je moet zelf het verhaal in je hoofd reconstrueren.
  • De nieuwe AI (Het Verhaal): Een echte detective zegt: "We beginnen met Suspect A, die een mes had. Maar toen we Suspect B zagen, zagen we dat hij de dader was, omdat hij het mes gebruikte om... en daardoor..."

De auteurs zeggen dat mensen niet denken in lijsten, maar in verhalen. We begrijpen de wereld door oorzaak en gevolg, door een begin, een midden en een einde. Als AI-explanaties (verklaringen) dit niet doen, blijven ze onbegrijpelijk, zelfs als ze grammaticaal correct zijn.

2. De Oplossing: Wat maakt een "Goed Verhaal"?

De auteurs zeggen dat een goede AI-uitspraak (een "XAI Narrative") vier dingen moet hebben, net als een goed boek:

  1. Een doorlopende structuur: Het moet niet uit losse zinnen bestaan die op elkaar lijken. Het moet vloeiend zijn, zoals een rivier die stroomt, niet als een stenen muur van losse blokken.
  2. Oorzaak en Gevolg: Het moet uitleggen waarom. "Hij kreeg de lening omdat zijn inkomen hoog was, ondanks dat hij jong was."
  3. Vloeiendheid: Het moet lezen als menselijk taal, niet als een robot die woorden herhaalt.
  4. Woordrijkdom: Het moet verschillende woorden gebruiken, niet steeds dezelfde termen herhalen.

3. Het Grote Probleem: Hoe meet je of iets een "verhaal" is?

Hier komt het slimme deel. De auteurs zeggen: "De standaard meetlatjes van computers werken niet."

Stel je voor dat je wilt weten of iemand een goed verhaal vertelt. Je zou kunnen kijken naar:

  • Hoe makkelijk de zinnen te voorspellen zijn? (Computers houden van voorspelbaarheid).
  • Hoe vaak woorden herhaald worden?

Het probleem? Je kunt een onzin-tekst schrijven die perfect scoort op deze testen, maar die niets uitlegt.

  • Voorbeeld: "De machine besliste. De uitkomst is wat hij is, omdat de machine besliste. Het resultaat volgt het invoer, omdat de feature belangrijk is."
  • Dit klinkt als een verhaal, heeft de juiste woorden, en is makkelijk te voorspellen. Maar het zegt niets. Het is als een lege doos die perfect is verpakt.

De auteurs zeggen: "We hebben nieuwe meetlatjes nodig die kijken naar de structuur van het verhaal, niet alleen naar de woorden."

4. De Nieuwe Meetlatjes (De "Story-Checkers")

Ze hebben 7 nieuwe regels bedacht om te testen of een tekst echt een verhaal is. Denk hierbij aan:

  • De "Herschikkingstest": Als je de zinnen van een echt verhaal door elkaar haalt, wordt het onbegrijpelijk (de computer raakt in paniek). Als je de zinnen van een saaie lijst door elkaar haalt, maakt het niet veel uit. Dit meet ze met een slimme berekening.
  • De "Verbindings-Test": Een goed verhaal gebruikt woorden als "daardoor", "echter", "omdat". Een saaie lijst doet dat niet.
  • De "Actie-Test": Verhalen gebruiken veel werkwoorden (handelingen). Lijsten gebruiken veel zelfstandige naamwoorden (dingen).

Met deze nieuwe regels kunnen ze zien welke AI-systemen echte verhalen schrijven en welke alleen maar lijsten maken.

5. Wat hebben ze ontdekt?

Ze hebben verschillende AI-systemen getest.

  • De oude systemen: Deze maakten vaak saaie lijsten. Ze scoorden goed op de oude meetlatjes (want ze waren voorspelbaar), maar slecht op de nieuwe "verhaal-test".
  • De nieuwe systemen (met hun regels): Als ze de AI vertelden: "Schrijf een verhaal, gebruik 'omdat' en 'daardoor', en maak een begin en eind", dan veranderde het resultaat. De AI begon echte verhalen te vertellen die mensen makkelijker konden begrijpen.

Conclusie: Waarom is dit belangrijk?

Dit onderzoek zegt eigenlijk: "Vergeet de technische lijsten. Als je wilt dat mensen AI begrijpen en vertrouwen, moet je met ze praten zoals een mens praat: in verhalen."

Het is het verschil tussen een arts die zegt: "Je hebt koorts, een hoge bloeddruk en een rode huid" (de lijst), en een arts die zegt: "Je bent ziek omdat je een infectie hebt, die zorgt voor je koorts, en daarom is je huid rood" (het verhaal).

De auteurs hebben nu een handleiding gemaakt voor AI-ontwikkelaars om deze verhalen te genereren, zodat de AI niet alleen slim is, maar ook begrijpelijk.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →