Axiomatic Foundations of Counterfactual Explanations
Dit artikel introduceert een axiomatisch kader dat onmogelijkheid- en representatiestellingen vaststelt om systematisch vijf verschillende families van contrafactische verklaringen te karakteriseren, waardoor de kloof tussen lokale en globale interpreteerbaarheid in autonome systemen wordt overbrugd.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je voor dat je voor een mysterieuze, high-tech verkoopautomaat staat. Je stopt je geld erin, drukt op een knop en de automaat geeft je een frisdrank. Maar dan vraag je: "Waarom kreeg ik geen sapje?"
De meeste huidige AI-uitleggers proberen dit te beantwoorden door naar jouw specifieke transactie te kijken. Ze zeggen: "Nou, je stopte 1,50." Dit is een lokale uitleg. Het is nuttig, maar het vertelt je alleen iets over dit ene specifieke moment.
Het paper dat je hebt verstrekt, "Axiomatic Foundations of Counterfactual Explanations" door Amgoud en Cooper, betoogt dat we dit probleem te nauw bekeken hebben. Ze hebben een nieuwe "regelset" (een axiomatisch kader) gebouwd om alle mogelijke manieren te categoriseren waarop een AI zijn beslissingen kan uitleggen, niet alleen de manieren die we gewoonlijk zien.
Hier is de uiteenzetting van hun bevindingen in eenvoudige termen:
1. De twee grote families van uitleg
De auteurs ontdekten dat alle contrafeitelijke verklaringen (antwoorden op "Waarom niet?") in twee hoofdkampen vallen, als twee verschillende manieren om een puzzel op te lossen:
Het "Noodzakelijke" kamp (Het ontbrekende stukje):
- De Logica: "Als je dit specifieke ding verwijdert, verandert het resultaat."
- De Metafoor: Stel je een cake voor die niet is gerezen. Een noodzakelijke uitleg zegt: "De cake is niet gerezen omdat je de bakpoeder bent vergeten." Als je de bakpoeder niet vergeten was, had de cake misschien wel gerezen. Het identificeert het cruciale ingrediënt dat aanwezig was en de huidige uitkomst veroorzaakte.
- De Haken en ogen: Soms is er geen enkel "ontbrekend stukje". Bijvoorbeeld, als een lening werd geweigerd vanwege een complexe mix van een laag inkomen en een slechte kredietwaardigheid, is het verwijderen van slechts één factor misschien niet genoeg om een "ja" te garanderen. In die gevallen kunnen noodzakelijke uitlegjes helemaal niet bestaan.
Het "Voldoende" kamp (De magische schakelaar):
- De Logica: "Als je dit specifieke ding toevoegt of verandert, zal het resultaat definitief veranderen."
- De Metafoor: Stel je een lichtschakelaar voor. Een voldoende uitleg zegt: "Als je deze schakelaar omzet, gaat het licht aan." Het maakt niet uit wat er verder in de kamer gebeurt; het omzetten van de schakelaar garandeert de verandering.
- De Haken en ogen: Er zijn vaak veel schakelaars die je kunt omzetten. Je kunt de schakelaar omzetten, of je kunt de lamp vervangen, of je kunt een zaklamp meenemen. Dit type uitleg garandeert een resultaat, maar kan overweldigend zijn omdat er zoveel opties zijn.
2. De vijf soorten uitleg
De auteurs stopten niet bij "Noodzakelijk" vs. "Voldoende". Ze hebben dit verder onderverdeeld in vijf verschillende typen op basis van hoe strikt of breed de regels zijn. Zie dit als verschillende "persoonlijkheden" van uitleggers:
Globaal Noodzakelijk (De Regelboekbewaker):
- Wat het doet: Legt de volledige machine uit, niet alleen jouw specifieke bestelling. Het zegt: "Deze machine geeft altijd frisdrank als de knop rood is."
- Wie het helpt: Mensen die de algemene logica van het systeem willen begrijpen.
- Beperking: Het kan niet bestaan als de machine te chaotisch is (bijv. soms geeft rood frisdrank, soms sap).
Lokaal Noodzakelijk (De Specifieke Detective):
- Wat het doet: Kijkt naar jouw bestelling en zegt: "Voor jouw specifieke geval is het feit dat je een hoed draagt de reden dat je frisdrank kreeg."
- Wie het helpt: Mensen die willen weten wat er precies aan hen de oorzaak was van het resultaat.
- Beperking: Net als de globale versie, kan het niet bestaan als jouw situatie te uniek is.
Globaal Voldoende (De "Wat als"-simulator):
- Wat het doet: Kijkt naar de hele machine en zegt: "Als iemand de blauwe knop indrukt, krijgt diegene sap."
- Wie het helpt: Mensen die willen weten welke veranderingen een ander resultaat zouden garanderen voor iedereen.
- Beperking: Het kan veranderingen suggereren die niet deel uitmaken van jouw huidige situatie (bijv. "Als je een robot was...").
Lokaal Sceptisch (De Strikte Scepticus):
- Wat het doet: Kijkt naar jouw bestelling en zegt: "Als je je hoed verandert in een volledig nieuw item (dat je momenteel niet hebt), krijg je sap."
- Wie het helpt: Mensen die willen weten welke nieuwe dingen ze zouden kunnen doen.
- Beperking: Het kan niet bestaan als er geen nieuwe items zijn die een verandering garanderen.
Lokaal Gelovig (De Optimist):
- Wat het doet: Kijkt naar jouw bestelling en zegt: "Als je je hoed verandert in een andere hoed (zelfs een die er vergelijkbaar uitziet), krijg je misschien sap."
- Wie het helpt: Dit is het type dat de meeste huidige AI-tools gebruiken. Het is het meest flexibel en garandeert dat je een antwoord krijgt.
- Beperking: Het is minder "onderscheidend". Het kan een verandering suggereren die voor jou werkt, maar die voor iemand anders niet zou werken.
3. De "Onmogelijke" Regels
Het paper bewijst een fascinerend wiskundig feit: Je kunt niet alles hebben.
Ze toonden aan dat bepaalde combinaties van "goede kwaliteiten" (zoals gegarandeerd bestaan, het kortste antwoord zijn en strikt waar zijn voor iedereen) wiskundig onverenigbaar zijn.
- Analogie: Het is als het proberen te bouwen van een auto die tegelijkertijd de snelste, de veiligste én de goedkoopste is. De wetten van de fysica (of in dit geval, de logica) zeggen dat je er twee moet kiezen.
- Het Resultaat: Als je een uitleg wilt die altijd bestaat (gegarandeerd), moet je opgeven dat het de "kortste" of "meest specifieke" mogelijk is. Als je de "kortste" uitleg wilt, krijg je misschien een antwoord dat voor sommige mensen niet bestaat.
4. Waarom dit ertoe doet
Vóór dit paper waren de meeste AI-tools simpelweg "Lokaal Gelovige" uitleggers (Type 5). Ze waren als de Optimist: ze gaven je altijd een antwoord, maar ze vertelden je niet of dat antwoord de enige manier was, of de beste manier.
Dit paper biedt een kaart. Het vertelt ons:
- Als je de regels van het systeem wilt begrijpen, zoek dan naar Globaal Noodzakelijke redenen.
- Als je wilt weten wat jouw resultaat precies heeft veranderd, zoek dan naar Lokaal Noodzakelijke redenen.
- Als je gewoon elke mogelijke manier wilt vinden om een ander resultaat te krijgen, zoek dan naar Lokaal Gelovige redenen.
Samenvatting
De auteurs hebben geen nieuwe AI-tool uitgevonden; ze hebben een taxonomie (een classificatiesysteem) uitgevonden. Ze bewezen dat er vijf fundamenteel verschillende manieren zijn om "Waarom niet?" uit te leggen en dat geen enkele tool tegelijkertijd de beste kan zijn op alle vlakken. Ze toonden ook aan dat de meeste huidige tools slechts één specifiek type zijn (het "Optimistische" of Gelovige type) en dat we andere, potentieel nuttigere soorten uitleg missen die gebouwd zouden kunnen worden als we de regels kenden.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.