← Nieuwste papers
💻 computer science

Can Large Language Models Recover Semantic Optimization Opportunities That Compilers Miss?

Dit artikel introduceert SeGaBench, een benchmark die aantoont dat large language models effectief ontbrekende semantische optimalisatiekansen in C/C++-programma's kunnen herstellen om gevalideerde, prestatieverbeterende artefacten te genereren die traditionele compileranalyse aanvullen.

Oorspronkelijke auteurs: Hailong Jiang, Feng Yu, Emran Hossain, Jianfeng Zhu, Mengfei Ren, Qiang Guan, Chunwei Xia

Gepubliceerd 2026-08-05
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Hailong Jiang, Feng Yu, Emran Hossain, Jianfeng Zhu, Mengfei Ren, Qiang Guan, Chunwei Xia

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een meesterkok bent die probeert de werelds snelste soep te maken. Je hebt een zeer strikte, regels volgende sous-chef (de compiler) die precies weet hoe je groenten moet snijden en water moet koken. Maar deze sous-chef is een beetje letterlijk; ze zien alleen de ingrediënten die direct voor hen staan. Ze weten niet dat de wortelen in de pan eigenlijk allemaal even groot zijn, of dat de pan op een fornuis staat dat nooit van temperatuur verandert. Omdat de sous-chef deze verborgen feiten niet kan "zien", snijden ze langzaam en koken ze voorzichtig, puur om veilig te zijn.

Stel je nu voor dat je een super-slimme, nieuwsgierige assistent hebt (een Large Language Model, of LLM) die elk receptenboek heeft gelezen, elke kookshow heeft bekeken en de geschiedenis van de keuken kent. Deze assistent kan door de hele keuken kijken en zeggen: "Hé, ik wed dat die wortelen uniform zijn, en dat fornuis is stabiel!" Als deze assistent deze feiten kan bewijzen, kan de strikte sous-chef plotseling overschakelen naar super-snelheidsmodus, waarbij ze met ongelooflijke efficiëntie snijden en koken. De grote vraag waar wetenschappers zich al die tijd afvragen is: kunnen deze super-slimme assistenten daadwerkelijk deze verborgen sluiproutes vinden die de strikte sous-chef mist, en kunnen ze deze uitleggen op een manier die de sous-chef begrijpt zonder in de war te raken?

Dit is precies wat de onderzoekers in dit artikel wilden testen. Ze wilden zien of AI kan fungeren als een "semantische brug", door verborgen regels in computercode te vinden die traditionele compilers over het hoofd zien, en deze regels vervolgens om te zetten in daadwerkelijke snelheidswinsten. Ze bouwden een speciale testomgeving genaamd SeGaBench, die als een gigantisch hindernisparcours voor AI dient. Het bevat 120 verschillende computerprogramma's (100 speciaal voor deze test bedacht en 20 afkomstig uit echte, hoogwaardige supercomputingprojecten). In elk programma zit een verborgen "geheime saus"—een feit over de data of hoe de code werkt—dat, indien bekend, de computer veel sneller zou laten draaien. De taak van de AI was om dit geheim te vinden, een briefje te schrijven om het uit te leggen, en de code aan te passen om er gebruik van te maken, en dat alles zonder dat de oplossing werd verteld of er hints werden gegeven tijdens de test.

De resultaten waren een mix van "wow" en "niet zo snel". Het beste AI-model dat ze testten, GPT-5.6 Sol, was een ongelooflijke detective. Het identificeerde de verborgen geheimen in 95,0% van de gevallen en schreef correcte, werkende code-wijzigingen in 94,8% van de pogingen. Nog indrukwekkender was dat wanneer de AI de code goed kreeg, het de programma's minstens 1,05 keer sneller maakte (een snelheidswinst van 5%) in 83,3% van de gevallen. Als je de AI vijf keer op hetzelfde probleem laat proberen, vindt het voor 93,3% van alle gevallen een werkende oplossing.

De paper vond echter ook dat deze superkracht niet door alle AI-modellen gelijk wordt gedeeld. Terwijl het topmodel een ster was, hadden anderen aanzienlijk meer moeite; sommigen slaagden slechts in ongeveer 5% van de gevallen. Dit suggereert dat het vermogen om deze optimalisatiegeheimen te vinden nog geen standaardkenmerk is van alle AI; het hangt sterk af van welk specifiek model je gebruikt. Bovendien was de AI beter in het oplossen van de verzonnen problemen dan de echte problemen uit daadwerkelijke supercomputingprojecten. Bij de echte gevallen zag zelfs de beste AI het succespercentage dalen, en de behaalde snelheidswinsten waren kleiner.

De onderzoekers concluderen dat AI inderdaad een krachtige partner voor compilers kan zijn, optredend als een "speculatieve semantische voorsteller". De AI kan naar de rommelige, complexe context van een programma kijken en zeggen: "Ik denk dat we dit sneller kunnen doen als we aannemen dat X." Maar dit is geen toverstaf die alles automatisch oplost. De paper benadrukt dat deze AI-suggesties zorgvuldig moeten worden gecontroleerd door validators en gemeten moeten worden op werkelijke prestaties voordat ze worden vertrouwd. De AI is een briljante ideeën-generator, maar de strikte compiler en menselijke technici moeten nog steeds verifiëren dat de ideeën daadwerkelijk werken en niets kapotmaken. Kortom, de toekomst van snelle code kan eruitzien als een team: de AI vindt de verborgen sluiproutes, en de compiler bouwt de snelweg.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →