Realistic Counterfactual Explanations via Denial Constraints
Dit artikel stelt een nieuwe aanpak voor voor het genereren van realistische contrafactische verklaringen in Explainable AI door ontkenningsrestricties uit relationele databases te integreren om te waarborgen dat gegenereerde instanties voldoen aan gegevensgeldigheidsregels, waardoor de praktische toepasbaarheid wordt verbeterd met minimale concessies aan afstand- en diversiteitsmetrieken.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
In de wereld van kunstmatige intelligentie nemen machines vaak beslissingen die ons leven beïnvloeden, van het goedkeuren van leningen tot het diagnosticeren van ziekten. Wanneer deze systemen "nee" zeggen, is het nuttig om te weten waarom. Een populaire manier om een beslissing uit te leggen, is door een iets andere versie van de situatie voor te stellen die tot een "ja" zou hebben geleid. Als een leningaanvraag wordt afgewezen, kan een nuttige uitleg suggereren dat het verdienen van iets meer geld of het hebben van een iets hogere kredietscore de uitkomst zou hebben veranderd. Deze verbeelde alternatieven worden contrafectualen genoemd. Ze fungeren als een spotlight die precies laat zien welke kenmerken van een persoon of object het meest telden voor het oordeel van de machine. Echter, om deze uitleg echt nuttig te laten zijn, moeten ze zinvol zijn in de echte wereld. Een uitleg die suggereert dat een klein appartement in een drukke stad plotseling tien slaapkamers zou kunnen hebben, is wiskundig mogelijk maar fysiek onmogelijk. Als de gesuggereerde wijzigingen onrealistisch zijn, faalt de uitleg om de persoon te helpen hun situatie te begrijpen of te verbeteren.
Onderzoekers van Tel Aviv University, eBay en de Hebrew University of Jerusalem hebben dit probleem van onrealistische suggesties aangepakt. Ze ontdekten dat de meest geavanceerde tools die momenteel worden gebruikt om deze uitleg te genereren, vaak resultaten produceren die de basisregels van de werkelijkheid schenden. Bijvoorbeeld, een tool zou kunnen suggereren dat een huis in een specifieke buurt een bepaald aantal badkamers heeft dat simpelweg niet bestaat in dat gebied, of dat de leeftijd en het opleidingsniveau van een persoon in strijd zijn met bekende feiten over hoe mensen leven. Om dit op te lossen, combineerde het team de methoden die worden gebruikt om AI uit te leggen met technieken uit databasebeheer, het vakgebied dat ervoor zorgt dat gegevens in computers consistent en accuraat blijven. Ze introduceerden een systeem dat elke gesuggereerde wijziging controleert tegen een reeks logische regels afgeleid van echte gegevens. Deze regels, bekend als denial constraints, fungeren als een filter die ervoor zorgt dat elk nieuw scenario dat als uitleg wordt voorgesteld, binnen de grenzen past van wat daadwerkelijk mogelijk is.
De onderzoekers testten hun nieuwe aanpak op vier verschillende datasets, waaronder informatie over vastgoed in New York, belastinggegevens en demografische gegevens. Ze vergeleken hun methode met de leidende bestaande tool, die bekend staat om het vinden van diverse en nabije verklaringen, maar negeert of die verklaringen wel realistisch zijn. De resultaten waren schokkend. In de vastgoeddataset overtrad bijna alle door de standaardtool gegenereerde verklaringen minstens één regel van de werkelijkheid. In sommige gevallen was elke suggestie die het maakte onmogelijk. Daarentegen produceerde het nieuwe systeem verklaringen die nul regels overtraden. Elk scenario dat het aanbood, was consistent met de gegevens die het had gezien. Dit ging niet ten koste van veel. De nieuwe verklaringen waren slechts iets verder verwijderd van de oorspronkelijke situatie dan de onrealistische verklaringen, en ze bleven even divers, waarbij ze een breed scala aan verschillende redenen voor de beslissing boden. Sterker nog, op sommige datasets bood de nieuwe methode zelfs betere verklaringen, omdat de standaardtool gedwongen was in onmogelijk gebied te dwalen om een oplossing te vinden.
Een grote uitdaging in dit werk was snelheid. Het controleren van elke mogelijke wijziging tegen duizenden regels kan ongelooflijk traag zijn, tot het punt waarop een enkele controle uren kan duren. Het team ontwikkelde een reeks slimme afkortingen om het proces snel genoeg te maken voor praktisch gebruik. In plaats van elke regel elke keer tegen elke stukje data te controleren, leerde hun systeem te identificeren welke regels daadwerkelijk relevant waren voor de specifieke situatie op dat moment. Ze bouwden ook een manier om eerdere controles te onthouden, zodat ze het werk niet opnieuw hoefden te doen. Deze optimalisaties maakten het systeem tot drieënzestig keer sneller dan een directe, niet-geoptimaliseerde aanpak. Deze snelheid is cruciaal omdat het betekent dat het systeem kan worden gebruikt in real-time toepassingen zonder te hoeven wachten tot een computer een uur lang getallen verwerkt.
De studie keek ook naar andere methoden die proberen verklaringen realistisch te maken, zoals die welke complexe modellen gebruiken om te raden hoe gegevens eruitzien, of die alleen voorbeelden uit een bestaande lijst selecteren. De onderzoekers ontdekten dat zelfs deze geavanceerde methoden vaak faalden om de harde regels van de gegevens te respecteren. Een model zou een combinatie van kenmerken kunnen suggereren die statistisch waarschijnlijk lijkt, maar nog steeds een specifieke logische regel overtreedt, zoals een belastingvrijstelling die niet van toepassing is op een bepaalde staat. De nieuwe aanpak is uniek omdat het garandeert dat de verklaring geen enkele regel zal breken. Dit doet het door de regels te behandelen als absolute wetten in plaats van zachte suggesties. Als een suggestie een regel overtreedt, past het systeem deze aan totdat het past, waardoor de uiteindelijke verklaring niet slechts een gok is, maar een feitelijk geldig scenario.
Dit werk benadrukt een kritische kloof in hoe we momenteel vertrouwen op en kunstmatige intelligentie begrijpen. Het laat zien dat dicht bij de oorspronkelijke gegevens zijn niet genoeg is; een uitleg moet ook geworteld zijn in de realiteit van de wereld die het beschrijft. Door ervoor te zorgen dat contrafactualen realistisch zijn, hebben de onderzoekers deze verklaringen betrouwbaarder en nuttiger gemaakt voor de mensen die ze nodig hebben. Of het nu een huiseigenaar is die zich afvraagt waarom de waarde van zijn woning laag is, of een werkzoekende die wil begrijpen waarom hij is afgewezen: weten dat het gesuggereerde pad naar een andere uitkomst daadwerkelijk mogelijk is, maakt het verschil tussen een verwarrende wiskundige truc en een helder, actiegericht inzicht. Het succes van het team in het balanceren van realisme met diversiteit en snelheid suggereert dat de toekomst van uitlegbare AI niet alleen ligt in het vinden van het dichtstbijzijnde antwoord, maar in het vinden van het ware antwoord.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.