← Derniers articles
💬 NLP

code_transformed: The Influence of Large Language Models on Code

Cet article présente une étude empirique pionnière à grande échelle analysant plus de 20 000 dépôts GitHub pour démontrer que les grands modèles de langage transforment de manière mesurable les styles de programmation réels, comme en témoignent des tendances telles qu'une adhésion accrue aux conventions de nommage snake_case et des changements dans la complexité et la maintenabilité du code.

Auteurs originaux : Yuliang Xu, Siming Huang, Mingmeng Geng, Yao Wan, Xuanhua Shi, Dongping Chen

Publié 2026-02-09
📖 5 min de lecture🧠 Analyse approfondie

Auteurs originaux : Yuliang Xu, Siming Huang, Mingmeng Geng, Yao Wan, Xuanhua Shi, Dongping Chen

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez le monde de la programmation informatique comme une immense bibliothèque bouillonnante où des millions de personnes écrivent des livres (du code) chaque jour. Pendant des décennies, ces livres avaient leurs propres styles d'écriture uniques : certains auteurs utilisaient des surnoms courts et cryptiques pour leurs personnages, tandis que d'autres écrivaient de longs paragraphes descriptifs.

Ce document est comme une histoire de détective qui pose la question suivante : « L'arrivée d'un bibliothécaire surdoué (les modèles de langage de grande taille, ou LLM) a-t-elle commencé à changer la façon dont les humains écrivent ces livres ? »

Les chercheurs ne se sont pas contentés de demander aux gens s'ils utilisent l'IA ; ils sont allés dans la bibliothèque, ont examiné plus de 20 000 dépôts de code du monde réel (les « livres ») et les ont comparés au code écrit par des humains avant que l'IA ne soit populaire et au code généré par l'IA aujourd'hui.

Voici ce qu'ils ont découvert, décomposé en concepts simples :

1. Le changement d'« écriture » (Modèles de nommage)

Considérez les noms de variables (comme ml ou max_length) comme les noms que les auteurs donnent à leurs personnages.

  • L'ancienne méthode : Les humains utilisaient souvent des noms courts et rapides comme ml (pour « max length ») ou mlt. C'était efficace mais parfois difficile à lire.
  • La méthode de l'IA : Les modèles d'IA adorent être très descriptifs. Ils préfèrent des noms comme max_length et current_length. Ils adorent aussi un style spécifique appelé « snake_case » (utilisant des tirets bas comme snake_case au lieu de camelCase).
  • La découverte : Les chercheurs ont constaté que, ces dernières années, le code écrit par les humains a commencé à ressembler davantage à l'écriture de l'IA. L'utilisation de noms longs et descriptifs avec des tirets bas a augmenté de manière significative. C'est comme si les humains commençaient inconsciemment à écrire comme le bibliothécaire IA dont ils empruntent les services.

2. La « complexité » de l'histoire (Qualité du code)

Les chercheurs ont également examiné si les histoires étaient « tortueuses ». En codage, un « rebondissement » est un point de décision (comme une instruction if : « S'il pleut, prenez un parapluie »).

  • La découverte : Lorsque l'IA réécrit du code, les histoires deviennent souvent légèrement moins tortueuses (complexité plus faible) et plus faciles à maintenir.
  • Le bémol : Ce n'était pas une solution miracle. Dans certains langages (comme Python), l'IA a en fait rendu les histoires plus complexes qu'un humain ne l'aurait fait. Mais dans d'autres (comme C/C++), l'IA les a rendues plus propres.
  • La tendance : Curieusement, le code dans la bibliothèque du monde réel (GitHub) a également commencé à paraître plus propre et plus facile à maintenir depuis 2023, reflétant le style de l'IA.

3. L'effet « Copier-Coller » (Similitude)

L'équipe a testé deux scénarios :

  1. Génération directe : Demander à l'IA : « Écris une histoire sur X de toutes pièces. »
  2. Réécriture guidée par référence : Montrer à l'IA l'histoire d'un humain et dire : « Lis ceci, puis réécris-le pour qu'il soit meilleur. »

Le résultat : Lorsque l'IA recevait l'histoire d'un humain pour la réécrire, elle conservait très étroitement la « voix » et le style de l'humain. Mais lorsqu'on lui demandait d'écrire de toutes pièces, l'histoire de l'IA sonnait très différemment de la façon dont les humains écrivent habituellement. Cela suggère que l'IA est excellente pour polir le travail humain, mais que son style « natif » naturel est très distinct du nôtre.

4. Le « processus de réflexion » (Raisonnement)

Enfin, les chercheurs ont jeté un coup d'œil à l'intérieur du « cerveau » de l'IA pour voir comment elle résolvait les problèmes. Ils ont vérifié si l'IA utilisait réellement les bonnes étapes logiques (algorithmes) pour résoudre l'énigme.

  • La découverte : L'IA se trompe souvent sur les étapes logiques. Elle essaie d'utiliser une méthode de « force brute » (essayer toutes les portes possibles) là où une « clé intelligente » (un algorithme spécifique) serait nécessaire.
  • La différence de langage : L'IA semblait plus penser comme un résolveur de casse-tête logique en écrivant en C/C++, mais plus comme un codeur pratique en écrivant en Python.
  • Le facteur de difficulté : L'IA ne semblait « s'éveiller » et utiliser ses meilleures capacités de raisonnement que lorsque les problèmes étaient très difficiles. Pour les problèmes faciles, elle se contentait souvent de deviner.

Le tableau d'ensemble

Le document conclut que nous sommes témoins d'un changement culturel dans le codage. Il ne s'agit pas seulement du fait que l'IA écrit du code ; il s'agit du fait que l'IA façonne subtilement la façon dont les humains écrivent le code. Tout comme une nouvelle mode peut changer la façon dont tout le monde s'habille, la présence de l'IA pousse les développeurs humains vers un style plus descriptif, standardisé et « compatible avec l'IA ».

Les chercheurs avertissent que, bien que cela puisse rendre le code plus facile à lire, cela signifie aussi que l'« empreinte humaine » unique dans la programmation commence à se fondre dans le style de la machine, et que nous devons être conscients de cette transformation.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →