Ansari: A Retrieval-Grounded Islamic AI Assistant -- Architecture, Deployment, and Lessons from 140,000 Conversations
Dit artikel introduceert Ansari, een ingezette, op retrieval gebaseerde islamitische AI-assistent die feitelijke fabricage en waarden-misalignment mitigeert door vragen strikt te beantwoorden op basis van geauthenticeerde religieuze teksten met citaties, waarmee een superieure prestatie op islamitische benchmarks wordt aangetoond en kritieke lessen worden geboden voor geloofsgevoelige LLM-implementaties.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
In de moderne wereld wenden mensen zich vaak tot kunstmatige intelligentie om antwoorden te vinden, waarbij ze machines vragen complexe ideeën uit te leggen, problemen op te lossen of begeleiding te bieden. Deze systemen, bekend als grote taalmodellen, zijn getraind op enorme hoeveelheden tekst van het internet en hebben geleerd te voorspellen welke woorden als volgende in een zin moeten komen. Ze zijn opmerkelijk vloeiend en kunnen zeer overtuigend klinken. Deze vloeiendheid gaat echter gepaard met een verborgen gevaar: de neiging om feiten te verzinnen. Wanneer een machine het antwoord niet weet, kan deze vol vertrouwen iets verzinnen, waardoor een verhaal ontstaat dat waarachtig klinkt maar volledig onjuist is. Dit is een ernstig probleem in vakgebieden waar nauwkeurigheid cruciaal is, zoals de geneeskunde of de rechtsgeleerdheid, maar het wordt nog gevoeliger in de sfeer van religieus geloof. Voor miljoenen moslims worden religieuze teksten zoals de Koran en de collecties van de uitspraken van de Profeet Mohammed als heilig en onveranderlijk beschouwd. Een enkele verzonnen vers of een verkeerd toegeschreven uitspraak zou ertoe kunnen leiden dat iemand zijn geloof onjuist beoefent, wat spirituele schade veroorzaakt. De uitdaging is dan om een machine te bouwen die met de gemakkelijkheid van een menselijk gesprek kan spreken, maar de discipline bezit om nooit te spreken zonder een bron.
Een team van onderzoekers heeft een systeem gebouwd genaamd Ansari om precies dit probleem op te lossen. De naam komt van een historische term voor de helpers van de Profeet Mohammed in de stad Medina, wat de doelstelling van het systeem weerspiegelt om een ondersteunende tool voor de gemeenschap te zijn. Sinds juni 2023 heeft deze assistent meer dan 140.000 gesprekken gevoerd met mensen die meer dan 25 verschillende talen spreken. In tegen tegenstelling tot standaard chatbots die vertrouwen op hun interne geheugen om antwoorden te genereren, werkt Ansari volgens een strikte regel: het mag niets zeggen, tenzij het dat eerst heeft gevonden in een betrouwbaar boek. Het systeem werkt als een ijverige onderzoeker. Wanneer een gebruiker een vraag stelt, probeert de computer niet onmiddellijk een reactie te schrijven. In plaats daarvan gebruikt het eerst speciale instrumenten om door geauthenticeerde digitale bibliotheken te zoeken die de Koran, collecties van religieuze uitspraken en gedetailleerde encyclopedieën van de islamitische wet bevatten. Het leest de resultaten van deze zoekopdrachten en construeert het antwoord uitsluitend op basis van de tekst die het heeft gevonden, waarbij specifieke verwijzingen worden toegevoegd zodat de gebruiker de bron kan verifiëren. Dit proces zorgt ervoor dat de machine geen religieuze regel of een heilig verhaal kan verzinnen; het kan alleen rapporteren wat al geschreven staat in de vertrouwde bronnen die het heeft gekregen.
De onderzoekers ontdekten dat mensen dit hulpmiddel gebruiken op manieren die veel verder gaan dan eenvoudige feitencontrole. Door een willekeurige steekproef van 10.000 gesprekken te analyseren, ontdekten zij dat de meest voorkomende verzoeken niet gingen over het leren van geschiedenis of theologie, maar over hoe zij hun dagelijks leven moeten leiden. Bijna 40 procent van de vragen ging over praktische zaken, zoals of bepaalde voedingsmiddelen toegestaan zijn, hoe men met specifieke medische situaties omgaat tijdens het vasten, of hoe men navigeert door ethische dilemma's in het moderne leven. Een ander aanzienlijk deel van de vragen kwam van mensen die steun zochten tijdens tijden van rouw, angst of familiecrises. Het systeem is ontworpen om deze momenten van nood te herkennen en te reageren met warmte, waarbij de gebruiker wordt aangemoedigd om met een lokaal gemeenschapsleider te spreken en tegelijkertijd toegang krijgt tot hulplijnen. De studie toonde ook aan dat religieuze leiders en leraren de assistent regelmatig gebruiken om preken en lesplannen voor te bereiden, waarbij zij het behandelen als een partner bij het opstellen van inhoud in plaats van slechts een zoekmachine.
Om te waarborgen dat het systeem correct functioneerde, testte het team het tegen verschillende strenge standaarden. Ze lieten de assistent onafhankelijke examens doorlopen die de kennis van de islamitische wet en religieuze teksten meten, waarbij het beter presteerde dan andere toonaangevende kunstmatige intelligentiemodellen die beschikbaar zijn voor het publiek. In één specifieke test, ontworpen om te zien of een machine met een onjuiste bewering zou instemmen enkel om beleefd te zijn, slaagde Ansari erin de fout in meer dan 96 procent van de gevallen uit te dagen, terwijl andere modellen vaak in de val liepen door de fout te bevestigen. Tijdens een menselijke evaluatie die werd uitgevoerd tijdens de heilige maand Ramadan, beantwoordde de assistent vragen met een hoge nauwkeurigheid en, het belangrijkste, verzonde het in de geteste steekproef geen enkele onjuiste bron. De onderzoekers merkten op dat hoewel het systeem zeer effectief is, het niet perfect is. Het komt soms vast te zitten in lussen waarbij het naar informatie zoekt zonder een duidelijk antwoord te vinden, en het kan incidenteel fouten maken met datums of tijdsgevoelige feiten. Deze fouten herinneren de makers eraan dat het systeem een hulpmiddel is om het menselijk begrip te ondersteunen, en geen vervanging voor het oordeel van gekwalificeerde geleerden of de wijsheid van de gemeenschap.
Het project biedt een duidelijke les voor iedereen die kunstmatige intelligentie probeert te bouwen die te maken heeft met diepgewortelde waarden of gevoelige onderwerpen. De onderzoekers stellen dat het trainen van een machine op simpelweg meer data niet voldoende is. In plaats daarvan moeten de regels die de machine beheersen expliciet worden opgeschreven en openstaan voor inspectie. In het geval van Ansari zijn de instructies die de computer vertellen hoe hij om moet gaan met meningsverschillen tussen verschillende stromingen, hoe hij bronnen moet citeren en hoe hij zich in een crisis moet gedragen, opgeslagen in een document dat voor iedereen leesbaar is. Deze transparantie verandert de systeemprompt van een verborgen technische instelling in een publieke verklaring van beleid. Het team vond ook dat hoewel het verankeren van de antwoorden in echte teksten voorkomt dat de machine dingen verzint, dit niet elk probleem oplost. Het onderliggende computermodel draagt nog steeds de vooroordelen en beperkingen van de data waarop het oorspronkelijk is getraind, die niet is gecreëerd door de religieuze gemeenschap die het nu dient. Deze kloof betekent dat het systeem nooit volledig de menselijke gemeenschap kan vervangen die eeuwenlang deze tradities heeft verfijnd. Uiteindelijk laat het succes van Ansari zien dat het mogelijk is om een nuttige religieuze assistent te bouwen die de heiligheid van zijn bronnen respecteert, mits het ontwerp prioriteit geeft aan waarheid en verantwoording boven snelheid en gemak.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.