A Geometric Theory of Robust Fairness Audits
Dit artikel introduceert een geometrisch kader om de robuustheid van op de buurt gebaseerde rechtvaardigheidsaudits tegen feature-perturbaties te analyseren en te kwantificeren, waarbij voorwaarden voor stabiliteit worden vastgesteld en een nieuwe metriek genaamd "audit volatiliteit" wordt voorgesteld om hun gevoeligheid te meten.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
In de moderne wereld nemen algoritmen steeds vaker beslissingen die het menselijk leven vormgeven, van het goedkeuren van leningen en het diagnosticeren van ziekten tot het bepalen van de kans op vervroegde vrijlating. Naarmate deze systemen krachtiger worden, heeft de samenleving een kritische behoefte ontwikkeld om te waarborgen dat ze mensen rechtvaardig behandelen. Een belangrijke benadering om op eerlijkheid te controleren, richt zich op het idee dat vergelijkbare individuen vergelijkbare uitkomsten zouden moeten krijgen. Om dit te testen, kijken auditors vaak naar de gegevens van een persoon en vergelijken deze met de resultaten van hun dichtstbijzijnde buren in de dataset. Als twee mensen nagenoeg identiek zijn in hun kenmerken maar een zeer verschillend scoren, wordt het systeem als potentieel onrechtvaardig gemarkeerd. Deze methode, bekend als een buurtgebaseerde audit, is een standaardinstrument geworden voor het evalueren van machine learning-modellen omdat het flexibel is en lokale onrechtvaardigheden kan opsporen die brede statistieken mogelijk missen.
Er is echter een nieuwe zorg ontstaan over de betrouwbaarheid van deze audits zelf. Het proces van het vinden van de "buren" van een persoon hangt af van de precieze positie van datapunten in een wiskundige ruimte. In de echte wereld is data zelden perfect; het bevat kleine fouten, ontbrekende waarden of lichte variaties veroorzaakt door de manier waarop informatie is opgenomen of opgeschoond. Deze minuscule verschuivingen kunnen een persoon net genoeg verplaatsen om te veranderen wie hun dichtstbijzijnde buren zijn. Als de buren veranderen, verandert de eerlijkheidsscore, zelfs als de voorspelling van het onderliggende model voor die persoon exact hetzelfde blijft. Dit roept een verontrustende vraag op: is een bevinding van onrechtvaardigheid een werkelijke fout in het systeem, of is het slechts een artefact van een wankel meetproces?
Onderzoekers aan het Indian Institute of Technology, Gandhinagar, hebben een nieuwe manier ontwikkeld om dit probleem te begrijpen. Zij behandelden het auditingproces niet alleen als een statistische controle, maar als een geometrische controle, waarbij ze precies in kaart brachten hoe kleine veranderingen in data de stabiliteit van deze groepen buren beïnvloeden. Hun werk stelt vast dat de stabiliteit van een eerlijkheidsaudit volledig afhangt van hoe duidelijk de buren van een persoon gescheiden zijn van de rest van de dataset. Ze ontdekten dat als iemands buren duidelijk dichterbij zijn dan alle andere niet-buren, de auditresultaten stabiel blijven, zelfs als de data licht wordt verstoord. Maar als de buren dicht op elkaar gepakt zitten met de rest van de populatie, kan zelfs een kleine verschuiving hen uitwisselen, waardoor de eerlijkheidsscore wild kan schommelen.
Het team introduceerde een concept dat zij "audit volatiliteit" noemen om te meten hoeveel een eerlijkheidsscore naar verwachting zal fluctueren wanneer de data wordt onderworpen aan herhaalde, kleine verstoringen. Door hun theorie te testen op echte datasets met betrekking tot inkomen, bankmarketing en strafrechtelijke gegevens, bevestigden ze dat de geometrie van de data de primaire drijfveer van stabiliteit is. In datasets waar individuen duidelijk gegroepeerd zijn met hun eigen soortgenoten, bleven de audits robuust en consistent. In contrast hiermee vertoonden datasets waar individuen meer door elkaar waren gemengd een hoge volatiliteit, wat betekende dat de oordelen over eerlijkheid zeer gevoelig waren voor kleine verschuivingen in de data. De onderzoekers toonden aan dat de keuze van hoe de resultaten worden gemiddeld ook uitmaakt; het gebruik van methoden die minder gevoelig zijn voor extreme waarden kan deze instabiliteit verder verminderen.
Cruciaal is dat de studie aantoont dat de onvoorspelbaarheid van eerlijkheidsaudits geen mysterie is, maar een berekenbare geometrische eigenschap. De onderzoekers bewezen dat de mate van verandering in een eerlijkheidsscore direct verbonden is met het aantal buren dat wordt uitgewisseld tijdens een perturbatie. Ze ontdekten dat de maximale verandering in afstand tussen twee punten beperkt wordt door de omvang van de verstoring, en deze limiet bepaalt hoeveel de lokale buurt kan verschuiven. Toen ze deze bevindingen toepasten op standaard datasets, kwam het waargenomen gedrag perfect overeen met hun voorspellingen. De audits waren het meest stabiel in regio's waar de "lokale scheidingsmarge" – de kloof tussen de dichtstbijzijnde buren van een persoon en de eerstvolgende groep – groot was.
Dit werk verschuift de focus van het simpelweg bouwen van betere modellen naar het begrijpen van de betrouwbaarheid van de instrumenten die worden gebruikt om hen te meten. Het suggereert dat auditors, voordat ze een systeem onrechtvaardig verklaren, eerst moeten verifiëren of de buurtstructuur stabiel genoeg is om zo'n conclusie te ondersteunen. Als de datageometrie te los is, wordt de audit zelf een onbetrouwbaar instrument, niet in staat om onderscheid te maken tussen echte bias en willekeurige ruis. De onderzoekers bieden een kader om precies te berekenen hoeveel vertrouwen men kan stellen in een beoordeling van eerlijkheid op basis van de onderliggende datastructuur. Door deze kwetsbaarheid te kwantificeren, bieden ze een manier om meer robuuste auditingprocedures te ontwerpen die bestand zijn tegen de onvermijdelijke imperfecties van real-world data, om ervoor te zorgen dat het oordeel over eerlijkheid even solide is als de data waarop het rust.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.