The RAIL Principles for Neurosymbolic AI: Reasoning, Assurances, Interfacing and Learning
Dit artikel introduceert het RAIL-framework (Reasoning, Assurances, Interfacing, and Learning) als een verenigd perspectief voor het analyseren en ontwerpen van betrouwbare, vertrouwenswaardige neurosymbolische AI-systemen die machine learning integreren met formeel redeneren over diverse toepassingen heen.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je voor dat je een robot probeert te leren hoe hij door de wereld moet navigeren. Je hebt twee zeer verschillende leraren. De eerste is een "Super-Observer", een machine die leert door miljoenen uren aan video te bekijken, patronen te herkennen en te voorspellen wat er hierna gebeurt. Het is ongelooflijk snel en goed in het herkennen van gezichten of het schrijven van gedichten, maar het verzint vaak feiten, vergeet wat het gisteren heeft geleerd en kan niet uitleggen waarom het denkt dat een rood licht betekent "stop". De tweede leraar is een "Strikte Bibliothecaris", een machine die een rigide regelboek volgt. Het weet precies wat een rood licht betekent omdat een mens het in een logisch boek heeft opgeschreven, en het zal die regel nooit breken. Maar de Bibliothecaris is traag, heeft een mens nodig om elke regel te schrijven, en raakt volledig in de war als het iets ziet dat niet in het regelboek staat vermeld.
Lama tijd dachten wetenschappers dat deze twee leraren in aparte kamers moesten werken. Maar onlangs is er een nieuw idee naar voren gekomen: wat als we ze samen laten werken? Dit vakgebied, genaamd Neurosymbolische AI, probeert de patroonherkennende kracht van de "Super-Observer" te combineren met het logische, regelvolgende brein van de "Strikte Bibliothecaris". Het doel is om systemen te bouwen die niet alleen slim en flexibel zijn, maar ook veilig, uitlegbaar en betrouwbaar — vooral in situaties met hoge inzet, zoals zelfrijdende auto's of medische diagnoses. De grote vraag is: hoe bouwen we deze hybride breinen zonder dat ze met elkaar in conflict komen?
Een nieuw artikel van een team onderzoekers van universiteiten en laboratoria wereldwijd suggereert een routekaart. Ze stellen dat we geen nieuw type AI vanaf nul hoeven uit te vinden. In plaats daarvan volgen veel van de meest geavanceerde systemen die we al hebben — zoals de systemen die mensen verslaan in schaken of eiwitten vouwen — stiekem een specifieke set ontwerpregels. De auteurs noemen deze regels RAIL, wat staat voor Reasoning, Assurances, Interfacing, en Learning (Redeneren, Zekerheden, Interfacing en Leren). Ze stellen voor dat we, door AI-systemen door deze vier lenzen te bekijken, kunnen begrijpen hoe ze werken, hun zwakke plekken kunnen vinden en betere systemen voor de toekomst kunnen ontwerpen.
De Vier Zuilen van de RAIL-routekaart
Het artikel suggereert dat elk neurosymbolisch systeem beschreven kan worden door waar het zich bevindt op een glijdende schaal voor vier principes. Beschouw dit niet als schakelaars die "aan" of "uit" staan, maar als draaiknoppen waarmee je het systeem kunt balanceren.
1. Reasoning: De "Hoe denk je?" Draaiknop
Deze draaiknop meet hoe het systeem de punten verbindt. Aan de ene kant heb je Implicit Reasoning (impliciet redeneren), waarbij de AI het antwoord raadt op basis van patronen die het eerder heeft gezien, zoals een student die het antwoordmodel uit het hoofd leert maar de wiskunde niet begrijpt. Aan de andere kant heb je Explicit Reasoning (expliciet redeneren), waarbij de AI een stapsgewijze logische keten volgt, zoals een detective die aanwijzingen opschrijft om een zaak op te lossen.
Het artikel wijst erop dat de krachtigste systemen, zoals de Alpha-familie van Google (die spelletjes spelen en wiskundige bewijzen oplossen), ergens in het midden zitten. Ze gebruiken neurale netwerken om snelle gissingen te doen (impliciet), maar gebruiken vervolgens strikte logica om te controleren of die gissingen kloppen (expliciet). De auteurs suggereren dat het vertrouwen op alleen de "gok"-kant leidt tot fouten en "hallucinaties" (dingen verzinnen), dus toekomstige systemen moeten het hele bereik van de draaiknop gebruiken om echt betrouwbaar te zijn.
2. Assurances: De "Kunnen we het vertrouwen?" Draaiknop
Dit gaat over veiligheidsgaranties. Aan de ene kant heb je systemen die Verified Ex-Post zijn, wat betekent dat je ze eerst traint en ze dan achteraf test om te zien of ze veilig zijn. Dit is riskant omdat je een gevaarlijke bug pas ontdekt als het te laat is. Aan de andere kant zijn er systemen die Verified by Design zijn, wat betekent dat de veiligheidsregels vanaf het begin in het brein van het systeem zijn ingebakken.
Het artikel beargumenteert dat we voor kritieke taken moeten bewegen naar "Verified by Design". Als een systeem bijvoorbeeld een wiskundig bewijs oplost, zou het zo gebouwd moeten zijn dat het niet kan een onjuist bewijs produceren, en niet alleen dat het dat waarschijnlijk niet zal doen. De auteurs merken op dat hoewel dit moeilijk is voor complexe neurale netwerken, het combineren ervan met symbolische regels het mogelijk maakt om te garanderen dat het systeem niet crasht of iets onveiligs doet.
3. Interfacing: De "Kunnen we communiceren?" Draaiknop
Dit principe vraagt: hoe gemakkelijk is het voor een mens om met de AI te praten, en voor de AI om zichzelf uit te leggen? Aan de ene kant heb je Pure Embeddings, waarbij de AI denkt in een geheime code van getallen die mensen niet kunnen lezen. Aan de andere kant heb je Pure Symbolic Representations, waarbij alles in een heldere, logische taal of code wordt geschreven die mensen kunnen inspecteren.
Het artikel belicht een probleem: veel krachtige AI-systemen zijn "black boxes". We kunnen niet in hen kijken om te weten waarom ze een beslissing hebben genomen. Het RAIL-framework suggereert dat we "Mixed Representations" nodig hebben: systemen die hun geheime getalberekeningen kunnen vertalen naar iets dat mensen kunnen begrijpen, zoals een grafiek of een logische uitleg. Dit is cruciaal voor zaken als medische AI, waarbij een arts moet weten waarom de computer een specifieke behandeling adviseert.
4. Learning: De "Hoe leren we het?" Draaiknop
Ten slotte kijkt deze draaiknop naar hoe het systeem leert. Aan het ene extreme is Data-Only Learning, waarbij de AI in een waterval van data wordt gegooid en alles zelf moet uitzoeken. Aan het andere extreme is No Learning, waarbij een mens elke regel schrijft.
De "sweet spot", suggereert het artikel, is Knowledge-Guided Learning (kennisgestuurd leren). Dit is waar we de AI enkele regels of feiten geven om mee te beginnen (zoals een natuurkundige AI vertellen dat energie niet gecreëerd of vernietigd kan worden) en hem vervolgens de rest laten leren van data. Dit zorgt ervoor dat de AI sneller leert, minder data nodig heeft en minder domme fouten maakt. Sommige geavanceerde systemen gebruiken zelfs Bidirectional Learning, waarbij de AI leert van data, maar ook zijn eigen regels bijwerkt op basis van wat het leert, wat een cyclus van verbetering creëert.
Wat dit betekent voor de toekomst
De auteurs beweren niet dat ze alle problemen van AI hebben opgelost. In plaats daarvan suggereren ze dat het RAIL-framework een hulpmiddel is om ingenieurs te helpen betere keuzes te maken. Door bestaande systemen door deze vier principes te bekijken, ontdekten ze dat veel "neurosymbolische" systemen al geweldige dingen doen, zelfs als ze zichzelf niet zo noemen. Systemen die bijvoorbeeld tools gebruiken (zoals een AI die code schrijft om een probleem op te lossen) of systemen die natuurkundige wetten leren, gebruiken al deze principes om veilig en accuraat te blijven.
Het artikel waarschuwt echter ook voor afwegingen (trade-offs). Als je een systeem te veel richting "pure logica" duwt, kan het te rigide worden om met de rommelige werkelijkheid om te gaan. Als je het te veel richting "pure learning" duwt, kan het onvoorspelbaar en onveilig worden. Het doel is om de juiste balans te vinden voor de specifieke taak die voorhanden is.
Kortom, dit artikel is een oproep tot actie voor de AI-gemeenschap. Het suggereert dat de toekomst van betrouwbare AI niet gaat over het kiezen tussen "slim gokken" en "strikte regels", maar over het bouwen van systemen die weten hoe ze beide moeten gebruiken. Door de RAIL-principes te gebruiken, kunnen ingenieurs AI ontwerpen die niet alleen krachtig is, maar ook veilig, uitlegbaar en klaar om ons te helpen de moeilijkste problemen van de wereld op te lossen.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.