Mathematical Scientific Discovery Using Large Language Models: A Systematic Literature Review
Deze systematische literatuurstudie, die voldoet aan de PRISMA 2020-richtlijnen, analyseert 32 studies over het gebruik van grote taalmodellen voor wiskundige ontdekking om zeven technische paradigma's te identificeren, de superieure effectiviteit van evolutionaire zoektocht gecombineerd met formele verificatie te benadrukken, en een taxonomie te bieden om toekomstig onderzoek in het veld te begeleiden.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je een wereld voor waarin wiskunde niet alleen gaat over het oplossen van puzzels die iemand anders heeft opgeschreven, maar over het zelf uitvinden van de puzzels. Eeuwenlang werd gedacht dat het meest opwindende deel van de wiskunde — het "Eureka!"-moment van het ontdekken van een gloednieuwe waarheid, een vreemde nieuwe patronen, of een regel die nog nooit eerder door iemand is gezien — een superkracht was die uniek is voor mensen. Het vereiste een speciaal soort intuïtie, een vonk van creativiteit die computers simpelweg niet konden hebben. Maar onlangs heeft een nieuw soort kunstmatige intelligentie, een "Large Language Model" (of LLM), het spel begonnen te veranderen. Denk aan een LLM niet als een rekenmachine, maar als een superleesmachine die bijna elk wiskundig boek, elke handleiding voor code en elk wetenschappelijk artikel dat ooit geschreven is, heeft verslonden. Het onthoudt ze niet alleen; het leert de "grammatica" van wiskunde en code zo goed dat het zijn eigen zinnen kan gaan schrijven. De grote vraag die onderzoekers stellen is: kan deze machine-lezende superhersenen meer doen dan alleen vragen beantwoorden? Kan het daadwerkelijk nieuwe wiskunde ontdekken die mensen nog niet hebben gevonden?
Dit is precies wat een team van onderzoekers van Clemson University en Colorado College wilde onderzoeken in een enorme nieuwe studie. Ze keken niet naar één enkel interessant experiment; ze gingen op een digitale schattenjacht door honderden onderzoeksartikelen te doorzoeken die gepubliceerd zijn tot eind 2025, om de artikelen te vinden waar AI daadwerkelijk nieuwe wiskundige kennis creëerde. Ze gebruikten een strikte, wetenschappelijke checklist (genaamd PRISMA) om ervoor te zorgen dat ze niets belangrijks misten en om studies te filteren die alleen over het oplossen van oude problemen gingen. Nadat de stof was neergedaald, vonden ze 32 studies die iets werkelijk opmerkelijks lieten zien: AI begint een partner te worden in wiskundige ontdekkingen, niet alleen een rekenmachine.
De onderzoekers ontdekten dat de meest succesvolle AI-"wiskundigen" niet zomaar willekeurig gokken. In plaats daarvan gebruiken ze een paar slimme trucs. Een van de krachtigste methoden is een digitale versie van evolutie. Stel je voor dat een computer duizenden kleine, eenvoudige wiskundige programma's maakt. Het test ze, houdt degenen die het beste werken vast, en gebruikt vervolgens de AI om ze te "muteren" — kleine, creatieve veranderingen aanbrengen om te zien of ze er nog beter van worden. In de loop van de tijd evolueert dit proces oplossingen die zo goed zijn dat ze records verbreken die mensen decennialang hebben vastgehouden. Zo benadrukt de studie hoe deze systemen recentelijk een snellere manier vonden om matrices (een specifiek type wiskundig rooster) te vermenigvuldigen, wat een beroemd algoritme uit 1969 verbeterde, iets wat geen mens in meer dan 50 jaar had kunnen doen.
Een andere populaire methode is als een videogame waarin de AI tegen zichzelf speelt. Het ene deel van de AI probeert een moeilijke wiskundige probleem (een "conjectuur") te creëren, en een ander deel probeert het op te lossen. Naarmate de oplosser beter wordt, moet de probleemmaker slimmer worden, wat een lus creëert waarin ze beiden samen een niveau omhoog gaan. Dit heeft geholpen bij het genereren van duizenden nieuwe, geverifieerde wiskundige stellingen en lemma's (kleine stappen in bewijzen) die nu aan digitale bibliotheken worden toegevoegd. Het artikel is echter heel duidelijk over het feit dat deze AI-systemen nog geen toverstaf zijn. Ze zijn nog steeds erg hongerig naar computerkracht en hebben vaak miljoenen pogingen nodig om één goed antwoord te vinden. Ook zijn ze, hoewel ze geweldig zijn in het vinden van patronen, soms in staat om antwoorden te produceren die technisch correct maar saai of nutteloos zijn voor menselijke wiskundigen.
De studie wijst ook erop dat voor deze ontdekkingen een "scheidsrechter" nodig is om ze te kunnen vertrouwen. In de wereld van de wiskunde kun je niet gewoon zeggen: "Ik denk dat dit waar is." Je moet het bewijzen. De populairste scheidsrechter in deze AI-experimenten is een tool genaamd "Lean", een digitale bewijscontroleur die fungeert als een strikte grammatica-politie voor de wiskunde. Als de AI zegt dat hij een nieuwe stelling heeft gevonden, controleert Lean elke stap om er zeker van te zijn dat het 100% logisch is. De onderzoekers vonden dat de meest succesvolle projecten de projecten waren waarbij de AI en de scheidsrechter nauw samenwerkten in een gesloten lus, waarbij de scheidsrechter onmiddellijke feedback gaf aan de AI zodat deze zijn fouten direct kon herstellen.
Dus, wat is de kern van het verhaal? Het artikel suggereert dat we aan de rand staan van een nieuw tijdperk. AI vervangt de wiskundigen niet, maar het wordt een krachtige "ideeën-zandbak". Het kan miljoenen mogelijkheden uitspugen, patronen herkennen in enorme hoeveelheden data die mensen zouden missen, en zelfs problemen oplossen die al een half eeuw vastzitten. Maar de laatste stap — het omzetten van een door een machine gegenereerd stukje code in een prachtige, begrijpelijke wiskundige inzichten — heeft nog steeds een menselijke hand nodig. De toekomst ziet eruit als een teamsport: de AI doet het zware werk van het zoeken en testen, en de menselijke wiskundige biedt de intuïtie om te beslissen wat daadwerkelijk interessant is. Het is een partnerschap waarbij de machine de snelheid en de schaal brengt, en de mens de ziel.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.