← Nieuwste papers
🤖 AI

CodeCircuit: Toward Inferring LLM-Generated Code Correctness via Attribution Graphs

Dit onderzoek stelt CodeCircuit voor, een methode die de interne computationele structuren en neurale dynamiek van een LLM gebruikt om de correctheid van gegenereerde code te verifiëren zonder afhankelijk te zijn van externe tests of extra beoordelingsmodellen.

Oorspronkelijke auteurs: Yicheng He, Zheng Zhao, Zhou Kaiyu, Bryan Dai, Jie Fu, Yonghui Yang

Gepubliceerd 2026-02-10
📖 3 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Yicheng He, Zheng Zhao, Zhou Kaiyu, Bryan Dai, Jie Fu, Yonghui Yang

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een chef-kok bent die een ingewikkeld nieuw recept volgt. Je kunt op twee manieren controleren of het gerecht gaat lukken:

  1. De traditionele manier (Black-Box): Je wacht tot het gerecht klaar is, proeft het, en zegt: "Hm, te zout" of "Dit is perfect." Dit is wat we nu doen met AI: we laten de computer code schrijven en we proberen het daarna uit te voeren om te zien of het werkt. Maar als het misgaat, weten we niet waarom het misging, en soms ontdek je de fout pas als het bord al op tafel staat.
  2. De CodeCircuit-manier (White-Box): In plaats van te wachten op het eindresultaat, kijk je naar de chef terwijl hij kookt. Je kijkt naar de manier waarop hij de pan vasthoudt, hoe hij de kruiden strooit en of hij met zelfvertrouwen de thermometer afleest. Als je ziet dat hij met een trillende hand zout pakt, weet je voordat het gerecht klaar is: "Dit gaat mis."

Wat is dit onderzoek precies?

Wetenschappers hebben een methode ontwikkeld genaamd CodeCircuit. In plaats van alleen te kijken naar de code die een AI (zoals ChatGPT) uitschrijft, kijken ze "onder de motorkap" naar de hersenen van de AI terwijl hij aan het werk is.

Hoe werkt het? (De "Gedachtenkaart")

De onderzoekers maken een soort "gedachtenkaart" (ze noemen dit een Attribution Graph) van de AI. Zie het als een wegenkaart van de logica in het hoofd van de computer.

  • Correcte code: Als de AI een goed programma schrijft, ziet de kaart eruit als een goed georganiseerde snelweg: de informatie stroomt via duidelijke, logische routes van punt A naar punt B. Alles is verbonden en de "verkeersstroom" is stabiel.
  • Foutieve code: Als de AI een fout maakt, ziet de kaart eruit als een chaos van doodlopende weggetjes, kapotte bruggen of een verkeersopstopping op een onlogische plek. De "logische stroom" stort in.

Waarom is dit een doorbraak?

  1. Het voorspelt de toekomst: De AI kan een fout maken die pas veel later in het programma problemen geeft. CodeCircuit ziet de "twijfel" in de hersenen van de AI al voordat de fout überhaupt is opgeschreven.
  2. Het werkt voor elke taal: Of de AI nu programmeert in Python, Java of C++, de "stresssignalen" in de hersenen zien er overal hetzelfde uit. Het is alsof je aan de hartslag van een mens kunt zien of hij liegt, of hij nu Nederlands of Chinees spreekt.
  3. Het kan de fout "repareren": Dit is het meest magische deel. De onderzoekers ontdekten dat ze niet alleen fouten kunnen zien, maar ze ook kunnen verbeteren. Als ze zien dat een specifieke "foute gedachte" in het brein van de AI de boel verpest, kunnen ze die gedachte tijdelijk onderdrukken. Het is alsof je de hand van de kok even corrigeert net voordat hij te veel zout in de pan gooit.

Kortom:

CodeCircuit verandert AI-controle van een "proeven achteraf" naar een "medische scan tijdens de operatie". We kijken niet meer alleen naar wat de AI doet, maar we begrijpen hoe de AI denkt. Dit maakt software die door computers wordt gemaakt veel betrouwbaarder en veiliger.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →