Structured Scaling of AI Discovery Across Diverse Scientific Domains
Het artikel introduceert SIMPLETES, een framework dat door AI gestuurde wetenschappelijke ontdekking structureert door evaluatiesignalen over iteratieve trajecten te organiseren en geschiedenissen selectief te hergebruiken, waardoor een enkel open-source model de staat van de kunst bereikt over 28 diverse wetenschappelijke domeinen en verder verbetering realiseert door middel van outcome-gebaseerde post-training.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
De wetenschap heeft lang vertrouwd op een cyclus van vallen en opstaan. Een onderzoeker stelt een idee voor, test het tegen de natuurwetten of de beperkingen van een probleem, en gebruikt vervolgens het resultaat om de volgende poging te verfijnen. Decennialang heeft kunstmatige intelligentie deel uitgemaakt van deze lus, maar vaak als een gespecialiseerde tool die uitkomsten voorspelt of bekende variabelen optimaliseert. Recentelijk zijn taalmodellen begonnen meer te fungeren als onderzoekers zelf, waarbij ze kandidaat-oplossingen genereren, de code schrijven om ze te testen en hun werk aanpassen op basis van feedback. Het simpelweg vragen aan een computer om meer ideeën uit te proberen, garandeert echter niet betere ontdekkingen. Als een systeem duizenden pogingen genereert zonder een duidelijke structuur, zullen velen duplicaten zijn, of kan het proces vastlopen in het verfijnen van een doodlopend spoor. De centrale uitdaging is niet alleen om het aantal pogingen op te schalen, maar om die opschaling te organiseren zodat elke test voortbouwt op de vorige, waardoor vooruitgang in de loop van de tijd kan cumuleren.
Een onderzoeker heeft een nieuw raamwerk geïntroduceerd genaamd SIMPLETES om dit probleem op te lossen. In plaats van te vertrouwen op één enkel, massaal kunstmatig intelligentiemodel of complexe, op maat gemaakte zoekmachines, richtte hij zich op de manier waarop het zoekproces zelf gestructureerd is. Hij behandelde de ontdekkingslus als een wetenschappelijke gemeenschap: het parallel laten lopen van vele onafhankelijke onderzoekslijnen, elke lijn de beste ideeën laten verfijnen in de loop van de tijd, en zorgvuldig selecteren welke mislukkingen en successen worden gedeeld met de volgende ronde van pogingen. Met behulp van een enkel, open-source taalmodel pakte dit systeem achtentwintig verschillende open eindproblemen aan in velden die zo divers zijn als kwantumfysica, diepe ruimtereizen en zuivere wiskunde. In elk geval vond het systeem oplossingen die beter waren dan de best bekende resultaten van menselijke experts of andere geavanceerde AI-systemen, vaak met aanzienlijk minder rekenkracht.
De onderzoeker toonde aan dat de manier waarop een zoektocht wordt georganiseerd belangrijker is dan de omvang van het model dat deze uitvoert. Hij testte zijn raamwerk op taken variërend van het ontwerpen van brandstofefficiënte trajecten voor ruimtevaartuigen tot het optimaliseren van de code die draait op de snelste computerchips. In de wereld van de ruimtevaart ontwierp het systeem vluchtpaden voor missies naar Jupiter en andere planeten, waarbij routes werden gevonden die de brandstofkosten met wel vierentwintig procent verminderden vergeleken met historische records. In de kwantumcomputing ontdekte het nieuwe manieren om gegevens op chips te arrangeren, waardoor de extra operaties die nodig zijn om informatie te verplaatsen met bijna vijfentwintig procent werden teruggebracht. Het schreef ook nieuwe computercode voor wiskundige problemen die decennialang onopgelost waren gebleven, waaronder een probleem over overlappende verzamelingen dat sinds 1955 openstond. Het systeem vond een oplossing die het best bekende record verbeterde, en dat deed het zonder menselijke tussenkomst of gespecialiseerde training voor die specifieke taken.
Een van de meest significante bevindingen was dat het systeem van zijn eigen zoekproces kon leren om nog beter te worden. De onderzoeker nam de succesvolle paden die het systeem had ontdekt en gebruikte deze om het taalmodel verder te trainen. In plaats van het model te belonen voor het behalen van een goede score bij een enkele poging, leerde hij het de waarde van de uiteindelijke uitkomst van een volledige zoekreis te waarderen. Dit stelde het model in staat om te leren dat een ogenschijnlijk slechte vroege poging een noodzakelijke stap kan zijn naar een doorbraak later. Wanneer het werd getest op nieuwe wiskundige problemen, vond dit getrainde model oplossingen die nog geavanceerder waren dan het oorspronkelijke systeem, waarmee de grenzen van wat voorheen mogelijk werd geacht, werden verlegd.
Het succes van deze aanpak suggereert dat de organisatie van de zoektocht op zichzelf een krachtig instrument is. Door het evaluatieproces te structureren om diverse exploratie en iteratieve verfijning aan te moedigen, toonde de onderzoeker aan dat een enkel, relatief bescheiden open-source model de systemen kan overtreffen die gebouwd zijn met veel grotere, propriëtaire modellen. Het raamwerk vond niet slechts één goed antwoord; het vestigde een algemene methode voor ontdekking die werkt over zeer verschillende wetenschappelijke domeinen. Van het ontwerpen van betere algoritmen voor het analyseren van hersenactiviteit tot het creëren van snellere software voor kunstmatige intelligentie: het systeem bewees dat een gestructureerde, door evaluatie gedreven aanpak de wetenschappelijke vooruitgang kan versnellen. De resultaten wijzen erop dat de toekomst van AI-gestuurde ontdekking minder afhangt van het bouwen van grotere breinen en meer van het ontwerpen van slimmere manieren voor die breinen om het onbekende te verkennen.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.