← Nieuwste papers
💬 NLP

code_transformed: The Influence of Large Language Models on Code

Dit artikel presenteert een baanbrekende grootschalige empirische studie die meer dan 20.000 GitHub-repositories analyseert om aan te tonen dat Large Language Models de werkelijke programmeerstijlen meetbaar transformeren, wat wordt bewezen door trends zoals een toegenomen naleving van snake_case naamgevingsconventies en verschuivingen in codecomplexiteit en onderhoudbaarheid.

Oorspronkelijke auteurs: Yuliang Xu, Siming Huang, Mingmeng Geng, Yao Wan, Xuanhua Shi, Dongping Chen

Gepubliceerd 2026-02-09
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Yuliang Xu, Siming Huang, Mingmeng Geng, Yao Wan, Xuanhua Shi, Dongping Chen

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je de wereld van computerprogrammeren voor als een gigantische, bruisende bibliotheek waar miljoenen mensen elke dag boeken (code) schrijven. Decennialang hadden deze boeken hun eigen unieke handschriften: sommige auteurs gebruikten korte, cryptische bijnamen voor hun personages, terwijl anderen lange, beschrijvende paragrafen gebruikten.

Dit artikel is als een detectiveverhaal dat de vraag stelt: "Heeft de komst van een superintelligente AI-bibliothecaris (Large Language Models, of LLM's) de manier waarop mensen deze boeken schrijven veranderd?"

De onderzoekers vroegen niet alleen aan mensen of ze AI gebruiken; ze gingen de bibliotheek in, bekeken meer dan 20.000 echte code-repositories (de "boeken") en vergeleken deze met code die door mensen is geschreven voordat AI populair werd en code die vandaag de dag door AI wordt gegenereerd.

Hier zijn hun bevindingen, onderverdeeld in eenvoudige concepten:

1. De verandering in het "Handschrift" (Naamgevingspatronen)

Beschouw variabelen (zoals ml of max_length) als de namen die auteurs aan hun personages geven.

  • De Oude Manier: Mensen gebruikten vaak korte, snelle namen zoals ml (kort voor "max length") of mlt. Het was efficiënt, maar soms moeilijk te lezen.
  • De AI-Manier: AI-modellen houden van heel beschrijvend zijn. Ze geven de voorkeur aan namen zoals max_length en current_length. Ze houden ook van een specifieke stijl genaamd "snake_case" (het gebruik van underscores zoals snake_case in plaats van camelCase).
  • De Ontdekking: De onderzoekers ontdekten dat menselijke code in recente jaren meer is gaan lijken op het handschrift van de AI. Het gebruik van lange, beschrijvende namen met underscores is aanzienlijk toegenomen. Het is alsof mensen onbewust beginnen te schrijven zoals de AI-bibliothecaris die ze gebruiken.

2. De "Complexiteit" van het Verhaal (Codekwaliteit)

De onderzoekers keken ook naar hoe "twisty" (verwendig) de verhalen waren. In programmeren is een "twist" een beslissingspunt (zoals een if-statement: "Als het regent, neem een paraplu mee").

  • De Bevinding: Wanneer AI code herschrijft, worden de verhalen vaak iets minder "twisty" (lagere complexiteit) en makkelijker te onderhouden.
  • Het Addertje onder het gras: Dit was geen magische oplossing. In sommige talen (zoals Python) maakte de AI de verhalen zelfs complexer dan een mens zou hebben gedaan. Maar in andere talen (zoals C/C++) maakte de AI ze juist schoner.
  • De Trend: Interessant genoeg is de code in de echte wereld (GitHub) sinds 2023 ook schoner en gemakkelijker te onderhouden gaan lijken, wat de stijl van de AI weerspiegelt.

3. Het "Kopieer-Plak"-effect (Gelijkenis)

Het team testte twee scenario's:

  1. Directe Generatie: De AI vragen: "Schrijf vanaf nul een verhaal over X."
  2. Referentiegestuurd: De AI een menselijk verhaal laten lezen en zeggen: "Lees dit, en herschrijf het dan om het beter te maken."

Het Resultaat: Wanneer de AI een menselijk verhaal kreeg om te herschrijven, behield het de "stem" en stijl van de mens zeer nauwgezet. Maar wanneer de AI werd gevraagd om vanaf nul te schrijven, klonk het verhaal van de AI heel anders dan hoe mensen gewoonlijk schrijven. Dit suggereert dat AI geweldig is in het polijsten van menselijk werk, maar dat de natuurlijke "eigen" stijl van de AI heel verschillend is van de onze.

4. Het "Denkproces" (Redeneren)

Ten slotte wierpen de onderzoekers een blik in het "brein" van de AI om te zien hoe het problemen oploste. Ze controleerden of de AI daadwerkelijk de juiste logische stappen (algoritmen) gebruikte om het puzzelstukje op te lossen.

  • De Bevinding: De AI raadt vaak de verkeerde logische stappen. Het probeert vaak een "brute force"-methode (elke mogeijke deur proberen) wanneer een "slimme sleutel" (een specifiek algoritme) nodig is.
  • Het Verschil in Taal: De AI leek meer als een logische puzzeloplosser te denken bij het schrijven van C/C++, maar meer als een praktische programmeur bij het schrijven van Python.
  • De Moeilijkheidsfactor: De AI leek pas echt "wakker te worden" en haar beste redeneervaardigheden te gebruiken wanneer de problemen erg moeilijk waren. Voor eenvoudige problemen gokte de AI vaak gewoon.

Het Grote Plaatje

Het artikel concludeert dat we getuige zijn van een culturele verschuiving in programmeren. Het is niet alleen dat AI code schrijft; het is dat AI de manier waarop mensen code schrijven subtiel vormgeeft. Net zoals een nieuwe modetrend de manier waarop iedereen zich kleedt kan veranderen, duwt de aanwezigheid van AI menselijke ontwikkelaars naar een meer beschrijvende, gestandaardiseerde en "AI-vriendelijke" stijl.

De onderzoekers waarschuwen dat hoewel dit de code gemakkelijker leesbaar kan maken, het ook betekent dat de unieke "menselijke vingerafdruk" in programmeren begint te versmelten met de stijl van de machine, en dat we ons bewust moeten zijn van deze transformatie.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →