← Nieuwste papers
💬 NLP

KAPSO: A Knowledge-grounded framework for Autonomous Program Synthesis and Optimization

KAPSO is een modulair, kennisgestuurd framework dat autonome programma-synthese en -optimalisatie verbetert door een git-native experimentatiemotor, een gestructureerd kennissysteem en een cognitieve geheugenlaag te integreren om code-artefacten iteratief te verbeteren en falen over lange tijdlijnen bij programmeeragenten te overwinnen.

Oorspronkelijke auteurs: Alireza Nadafian, Alireza Mohammadshahi, Majid Yazdani

Gepubliceerd 2026-02-03
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Alireza Nadafian, Alireza Mohammadshahi, Majid Yazdani

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een complexe machine probeert te bouwen, zoals een high-performance raceauto, maar je hebt geen enkel blauwdruk. In plaats daarvan heb je een doel: "Maak de snelste auto mogelijk."

In het verleden, als je een slimme computerassistent (een AI-coderingsagent) zou vragen om dit te bouwen, zou deze proberen de hele auto in één keer te schrijven. Als de motor niet startte, raakte de AI in de war, vergat wat hij eerder had geprobeer en of bleef steeds dezelfde fout maken. Het was als een bouwer die steeds vergeet welke gereedschappen hij gisteren heeft gebruikt.

KAPSO is een nieuw framework dat de manier waarop we software bouwen verandert. In plaats van de AI te vragen om "de code te schrijven en klaar te zijn," behandelt KAPSO coderen als een langetermijn wetenschappelijk experiment. Het schrijft niet alleen; het leert hoe het beter kan schrijven door duizenden kleine tests uit te voeren, perfecte verslagen bij te houden en te onthouden wat werkte.

Hier is hoe KAPSO werkt, onderverdeeld in drie eenvoudige delen:

1. Het "Git-Native" Labnotitieboek (De Experimentatie-engine)

Stel je een wetenschapper voor die nooit een enkel experiment weggooit. Elke keer als hij een nieuw idee probeert, krabbelt hij niet alleen wat op een servetje; hij opent een gloednieuw, geïsoleerd notitieboek (een "branch").

  • Wat KAPSO doet: Elke keer als de AI probeert de code te repareren of te verbeteren, maakt KAPSO een aparte, veilige "branch" aan in een versiebeheersysteem (zoals Git).
  • Waarom het ertoe doet: Als het experiment mislukt, raakt de AI niet de kluts kwijt. Hij kan terugkijken naar dat specifieke notitieboek, precies zien wat er misging en een ander pad proberen zonder het oorspronkelijke werk te breken. Het houdt een perfecte geschiedenis bij van elke poging, zoals een detective die een dossier bijhoudt voor elke aanwijzing.

2. De "Super-Librarian" (Het Kennissysteem)

Stel je voor dat je die raceauto bouwt, maar je hebt toegang tot een bibliotheek met elk automanual, elk technisch handboek en elk blogbericht ooit geschreven over motoren.

  • Wat KAPSO doet: Het raadt niet zomaar wat. Het heeft een "Knowledge System" dat door duizenden echte code-repositories, wetenschappelijke papers en interne handleidingen bladert. Het organiseert deze enorme hoeveelheid informatie in een gestructureerde kaart (een "Knowledge Graph").
  • Waarom het ertoe doet: Wanneer de AI vastloopt, hallucineert hij niet zomaar een oplossing. Hij vraat aan de Librarian: "Heeft iemand eerder een ophangingssysteem zoals dit gebouwd? Wat werkte er?" Het haalt specifieke, bewezen ideeën op en plakt deze in het huidige project, zodat het expert-waardig engineeringgebruik hanteert in plaats van willekeurige gokken.

3. De "Memory Coach" (Het Cognitieve Geheugen)

Stel je een coach voor die je oefenrondes bekijkt. Als je drie keer over dezelfde steen struikelt, zegt de coach niet alleen "probeer het opnieuw." De coach zegt: "Hey, weet je nog afgelopen dinsdag? Je struikelde over die steen omdat je op je horloge keek. Volgende keer moet je naar de baan kijken."

  • Wat KAPSO doet: Het heeft een "Cognitive Memory" die "lessen geleerd" opslaat van elk mislukt of succesvol experiment. Het onthoudt specifieke foutpatronen (zoals "deze code crasht wanneer de data leeg is") en succesvolle trucjes.
  • Waarom het ertoe doet: Dit voorkomt dat de AI twee keer dezelfde fout maakt. Als het mislukt, roept het direct de "les" op uit een eerdere poging en past het de strategie aan. Het verandert een lange, frustrerende lus van fouten in een snelle, slimme leercurve.

Hoe het allemaal samenwerkt

KAPSO draait in een lus die "Evolve" wordt genoemd:

  1. Ideate: De AI kijkt naar het doel en vraagt de Librarian om ideeën.
  2. Build: Het schrijft code in een veilige, geïsoleerde "branch."
  3. Test: Het voert de code uit tegen een strikte "Evaluator" (een rechter die controleert of de auto wel snel genoeg is).
  4. Learn: Als het mislukt, grijpt de Coach in, beoordeelt de logs en vertelt de AI wat hij de volgende keer moet repareren.
  5. Repeat: Het blijft dit doen totdat de code perfect is.

De Resultaten: Heeft het gewerkt?

De paper testte KAPSO (die ze in de resultaten "Leeroo" noemen) tegen andere top AI-coderingsagenten in twee zeer uitdagende arena's:

  • MLE-Bench (Machine Learning Competities): Denk aan een wedstrijd om het beste AI-model te bouwen voor het voorspellen van zaken. KAPSO versloeg alle andere open-source agenten, vooral in de moeilijkste uitdagingen. Terwijl anderen worstelden met complexe problemen, bleef KAPSO verbeteren en bereikte het veel hogere scores.
  • ALE-Bench (Heuristische Optimalisatie): Denk aan een wiskundige puzzelwedstrijd waarbij je de best mogelijke oplossing moet vinden onder een strikte tijdslimiet. KAPSO behaalde een hogere score dan de vorige beste agent (ALE-Agent) terwijl het feitelijk minder geld uitgaf aan rekenkracht.

De Kernboodschap

KAPSO is niet alleen een tool die code schrijft; het is een systeem dat de volledige levenscyclus van het bouwen van software beheert. Door een perfect registratiesysteem, een enorme bibliotheek aan menselijke kennis en een geheugen dat leert van fouten te combineren, verandert het het chaotische proces van coderen in een betrouwbare, stapsgewijze optimalisatielus. Het bewijst dat voor moeilijke problemen het geheim niet alleen is om sneller code te schrijven — het is weten hoe je van elke enkele poging moet leren.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →