Synthetic Legal Data Generation for Saudi Family Law Courts Using Multi-Role Simulation
Dit artikel stelt een multi-role simulatieframework voor met behulp van Large Language Models en Human-in-the-Loop validatie om een hoogwaardige, door experts geverifieerde synthetische dataset van Saoedische familierechtelijke echtscheidingszaken te genereren, waarmee het tekort aan echte gerechtelijke verslagen als gevolg van privacybeperkingen effectief wordt overwonnen.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je een wereld voor waarin computers kunnen lezen, schrijven en argumenteren als advocaten. Dit is de opwindende, lichtelijk angstaanjagende grens van "Legal Artificial Intelligence". Maar hier komt de crux: om een computer te leren hoe hij een advocaat moet zijn, moet hij miljoenen echte rechtszaken lezen. In de meeste plaatsen is dit gemakkelijk omdat gerechtelijke dossiers openbaar zijn. Maar in sommige plaatsen, zoals Saoezdal-Arabië, zijn familierechtzaken uiterst geheim om de privacy van mensen te beschermen. Het is alsof je een chef-kok probeert te leren koken volgens een geheim familie recept zonder hem ooit het eten te laten proeven. Zonder echte data kan de computer de regels niet leren, en als hij gokt, kan hij wetten verzinnen die niet bestaan. Dit artikel pakt precies dat probleem aan: hoe bouw je een slim juridisch brein voor Saoedische familierechtbanken wanneer je niet naar de echte zaken kunt kijken? Het antwoord houdt het creëren van een "nep" maar perfecte wereld in die computers in staat om te oefenen, te leren en het goed te doen zonder ooit iemands privacy te schenden.
De onderzoekers achter deze studie, Zarah Shibli, Areej Alhothali en Lulwah Al-Harigy van de King Abdulaziz Universiteit, besloten een digitale speeltuin te bouwen om dit puzzelstuk op te lossen. Ze richtten zich op een specifiek, lastig type zaak: wanneer een vrouw naar de rechtbank gaat om te bewijzen dat haar man haar eigenlijk gescheiden heeft, ook al heeft hij dat nooit opgeschreven of officieel aan haar medegedeeld. In het Saoedische recht wordt dit "Ithbat Talaq" (vaststelling van echtscheiding) genoemd. Het is een juridisch mijnenveld omdat de man kan zeggen: "Ik heb dat nooit gezegd," of "Ik maakte maar een grapje," terwijl de vrouw zegt: "Hij heeft het absoluut gezegd!"
Om een trainingsdataset voor hun AI te maken, hebben de onderzoekers niet simpelweg een computer gevraagd om "een verhaal te verzinnen." In plaats daarvan bouwden ze een geavanceerd rollenspel. Ze programmeerden een krachtige AI (specifiek een model genaamd Gemini 3.1 Pro) om een volledig rechtszaaldrama uit te spelen. Maar hier komt de twist: de AI moest niet slechts één personage spelen. De AI moest van hoed wisselen en iedereen in de kamer tegelijkertijd spelen. De AI moest de Rechter zijn (die strikt moet zijn en de wet moet volgen), de Vrouw (de eiser), de Man (de gedaagde), en zelfs de Griffier (die alles opschrijft).
De AI kreeg een "script" gebase gebaseerd op echte Saoedische wetten, inclusief het Familierecht en de Wet van Bewijs. De AI kreeg de opdracht om 200 verschillende scenario's te genereren. In sommige gaf de man toe dat hij van zijn vrouw gescheiden was; in andere ontkende hij het. Soms werd de echtscheiding hardop uitgesproken, soms werd deze opgeschreven, en soms was deze voorwaardelijk (zoals: "Als je het huis verlaat, ben je gescheiden"). De AI moest de juridische uitkomst voor elk van deze 200 complexe situaties bepalen, waarbij de regels van het Saoedische recht strikt werden gevolgd.
Maar het team wist dat een computer die advocaat speelt, de feiten misschien wel juist krijgt, maar klinkt als een robot of een klein juridisch nuance detail mist. Daarom voegden ze een "Human-in-the-Loop"-stap toe. Dit betekent dat echte menselijke juridische experts — zes van hen, specialisten in het Saoedische familierecht — elke van de 200 door de AI gegenereerde zaken lazen. Zij beoordeelden ze op een schaal van 1 tot 5 voor zaken als: "Gebruikte de rechter de juiste juridische termen?" en "Was de redenering logisch?".
De resultaten waren indrukwekkend. Voordat de mensen ingrepen, was de AI al behoorlijk goed in het zware juridische werk, maar soms was de AI wat te langdradig of gebruikte het lichtelijk verkeerde juridische termen. Nadat de menselijke experts het werk van de AI hadden bijgesteld, waren de resultaten bijna perfect. De experts waren het in 94,6% van de gevallen eens over de kwaliteit van het werk van de AI (wanneel zij een kleine marge van één punt verschil toelieten). Sterker nog, de door AI gegenereerde zaken scoorden een perfecte "5" op de rubric van de experts in meer dan 70% van de evaluaties.
Het artikel is echter voorzichtig om niet te zeggen dat dit een toverstaf is die rechters vervangt. De AI worstelde nog steeds een beetje met de meest complexe, randgevallen waar de wet zeer genuanceerd is, zoals het bepalen of een echtscheiding geldig was wanneer de man extreem boos was of wanneer de vrouw zich in een specifieke fysieke staat bevond. De onderzoekers vonden dat de AI het beste gebruikt kan worden als een superkrachtige assistent die de juridische redenering opstelt, waarna een menselijke expert deze controleert en verfijnt.
Kortom, dit artikel laat zien dat door een multi-role simulatie te gebruiken — waarbij een AI een heel rechtszaaldrama naspeelt — en vervolgens menselijke experts het werk te laten controleren, we hoogwaardige, privacy-veilige juridische data kunnen creëren. Deze "synthetische" data is een gamechanger omdat het toekomstige AI-systemen in staat stelt om te leren hoe ze door het Saoedische familierecht moeten navigeren zonder ooit in de echte, privé juridische dossiers te mogen kijken. Het is als het bouwen van een vluchtsimulator voor juristen: de AI kan crashen en falen in de simulatie, leren van zijn fouten, en klaar zijn voor de echte lucht, terwijl ieders geheimen veilig blijven.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.