← Derniers articles
💬 NLP

Memorization Dynamics of Fill-in-the-Middle Pretraining

Ce papier examine la dynamique de mémorisation du préentraînement Fill-in-the-Middle (FIM) par rapport aux objectifs standard de gauche à droite, révélant que, bien que le FIM excelle à récupérer des segments courts ou partiels, il reste fortement dépendant du contexte préfixe pour le rappel mot à mot et présente une croissance linéaire de la mémorisation avec la répétition des données.

Auteurs originaux : Tobias von Arx, Tanguy Dieudonné

Publié 2026-05-25
📖 5 min de lecture🧠 Analyse approfondie

Auteurs originaux : Tobias von Arx, Tanguy Dieudonné

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez que vous enseigniez à un élève comment mémoriser un long livre d'histoires. Vous souhaitez évaluer dans quelle mesure il peut réciter des parties spécifiques de l'histoire mot pour mot. Habituellement, vous lui enseignez en lisant l'histoire du début à la fin, un mot après l'autre. Cela s'appelle l'entraînement de gauche à droite (LTR).

Mais il existe une autre méthode pour lui enseigner, souvent utilisée pour la programmation ou pour remplir des trous. Vous lui donnez le début d'un paragraphe et la fin d'un paragraphe, et vous lui demandez de deviner ce qui se trouve au milieu. Cela s'appelle l'entraînement Remplir le Milieu (FIM).

Cet article pose une question simple : Est-ce qu'enseigner à un élève de « remplir le milieu » le fait mémoriser le livre différemment de lui apprendre à lire directement ?

Les chercheurs ont mis en place une expérience contrôlée. Ils ont pris deux modèles d'IA identiques (comme des jumeaux) et leur ont appris exactement les mêmes extraits de livre. L'un des jumeaux a appris la méthode de « lecture directe » (LTR), et l'autre a appris la méthode de « remplissage de trous » (FIM). Ils ont répété ces extraits de livre spécifiques entre 1 et 128 fois pour observer comment la répétition affecte la mémoire.

Voici ce qu'ils ont découvert, expliqué avec quelques analogies du quotidien :

1. La « Queue Lourde » vs le « Grimpeur Régulier »

Lorsque les chercheurs ont demandé aux modèles de réciter un bloc de texte en commençant uniquement par le début (le préfixe) :

  • Le Jumeau LTR (Lecteur Direct) : Ce jumeau est comme une personne qui mémorise un discours parfaitement si elle l'entend suffisamment de fois. Une fois qu'elle franchit un certain seuil de répétition, elle peut réciter de longues phrases exactes avec une très grande confiance. Elle possède une « queue lourde » de mémoire : elle excelle dans les récitations longues et parfaites.
  • Le Jumeau FIM (Remplisseur de Trous) : Ce jumeau est un peu différent. Il est moins susceptible de réciter une phrase entière longue parfaitement. Au lieu de cela, il est meilleur pour se souvenir de bribes plus courtes ou de correspondances partielles. Sa mémoire croît de manière plus régulière et linéaire à mesure qu'il entend le texte plus souvent, mais il atteint rarement ce pic de « récitation longue parfaite » aussi facilement que le lecteur direct.

Analogie : Imaginez essayer de vous souvenir d'une chanson.

  • L'élève LTR est excellent pour chanter tout le refrain parfaitement une fois qu'il l'a entendu suffisamment, mais si vous lui demandez de commencer par le milieu, il pourrait rester bloqué.
  • L'élève FIM est bon pour fredonner quelques mesures ou reconnaître une mélodie si vous lui donnez un indice du début ou de la fin, mais il pourrait ne pas maîtriser l'ensemble du refrain de 30 secondes aussi parfaitement que l'élève LTR.

2. L'« Ancre » du Préfixe

Les chercheurs ont ensuite testé le modèle FIM dans son environnement naturel : en lui donnant à la fois le début (préfixe) et la fin (suffixe) d'une phrase et en lui demandant de remplir le milieu.

Ils ont découvert quelque chose de surprenant : La fin de la phrase (suffixe) n'aide pas beaucoup.

  • Même si le modèle FIM voit la fin de la phrase, il repose presque entièrement sur le début de la phrase (préfixe) pour se souvenir de la partie du milieu.
  • Si vous remplacez le vrai début de la phrase par une phrase aléatoire et sans rapport, le modèle oublie le milieu presque instantanément.
  • Si vous remplacez la fin de la phrase par une fin aléatoire, le modèle se souvient encore très bien du milieu, tant que le début est correct.

Analogie : Pensez au modèle FIM comme à un détective essayant de résoudre un crime.

  • Le Préfixe est la photo de la scène du crime.
  • Le Suffixe est un témoignage sur ce qui s'est passé après le crime.
  • L'étude a révélé que le détective (le modèle) résout l'affaire (se souvient du texte) presque entièrement en se basant sur la photo de la scène du crime. Le témoignage (suffixe) est utile, mais si vous retirez la photo, le détective est perdu, même si le témoin continue de parler.

3. Pourquoi cette différence ?

Pourquoi l'élève « Remplisseur de Milieu » se comporte-t-il ainsi ?

  • Entraînement LTR : Chaque fois que l'élève entend l'histoire, c'est la même vue : Début \rightarrow Milieu \rightarrow Fin. Cela renforce un chemin spécifique, rendant la mémoire de la chaîne entière très forte.
  • Entraînement FIM : Chaque fois que l'élève entend l'histoire, la partie « milieu » est découpée différemment. Parfois le milieu correspond aux 10 premiers mots, parfois aux 10 suivants. Cela étale la mémoire. L'élève apprend à reconnaître des morceaux de l'histoire sous de nombreux angles différents, mais il ne se verrouille pas aussi étroitement sur une seule chaîne longue et parfaite.

La Conclusion

L'article conclut que la façon dont vous entraînez un modèle change comment il mémorise.

  • Si vous voulez un modèle capable de réciter de longs passages exacts de texte, l'entraînement de gauche à droite est plus fort.
  • Si vous utilisez l'entraînement Remplir le Milieu, le modèle devient meilleur pour se souvenir de courts morceaux ou de correspondances partielles, mais il reste fortement dépendant du début du texte pour déclencher cette mémoire.

Les chercheurs ont également noté que si vous ne testez qu'une seule façon spécifique de demander au modèle (comme ne tester que des phrases longues ou ne tester que des bribes courtes), vous pourriez manquer ces différences importantes. C'est comme juger de la capacité de nage d'un poisson uniquement par la façon dont il saute hors de l'eau ; vous devez le tester de différentes manières pour comprendre sa véritable nature.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →