← Derniers articles
💬 NLP

compar:IA: The French Government's LLM arena to collect French-language human prompts and preference data

L'article présente compar:IA, une plateforme open-source du gouvernement français qui collecte des données de préférences humaines à grande échelle en langue française via des comparaisons par paires en aveugle afin de remédier à la rareté des jeux de données non anglophones pour l'entraînement et l'évaluation des modèles de langage de grande taille.

Auteurs originaux : Lucie Termignon, Simonas Zilinskas, Hadrien Pélissier, Aurélien Barrot, Nicolas Chesnais, Elie Gavoty

Publié 2026-02-09
📖 5 min de lecture🧠 Analyse approfondie

Auteurs originaux : Lucie Termignon, Simonas Zilinskas, Hadrien Pélissier, Aurélien Barrot, Nicolas Chesnais, Elie Gavoty

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez le monde de l'Intelligence Artificielle (IA) comme une immense bibliothèque où les livres sont presque entièrement écrits en anglais. Si vous essayez de lire un livre en français, en espagnol ou dans une autre langue, l'histoire peut sembler maladroite, les personnages peuvent agir bizarrement ou les conseils peuvent ne pas avoir de sens culturellement. Cela arrive parce que les « étudiants » de l'IA ont passé la majeure partie de leur temps à étudier des livres en anglais et ont rarement pratiqué avec d'autres langues.

Pour corriger cela, le gouvernement français a construit un terrain de jeu spécial appelé compar:IA. Considérez cela comme un gigantesque concours de test de dégustation à l'aveugle public, mais au lieu de tester de la crème glacée, on goûte des réponses à des questions.

Voici comment cela fonctionne, décomposé en parties simples :

1. Le test de dégustation à l'aveugle (Comment ça marche)

Imaginez que vous entrez dans une pièce et que vous voyez deux chefs mystères (modèles d'IA) en train de préparer une réponse à votre question. Vous ne savez pas encore qui ils sont.

  • Étape 1 : Vous posez une question (comme « Comment faire un croissant ? » ou « Raconte-moi une blague »).
  • Étape 2 : Les deux chefs rédigent une réponse. Vous les lisez côte à côte.
  • Étape 3 : Vous choisissez celle que vous préférez.
  • Étape 4 : Ce n'est qu'après votre vote que les chefs révèlent leurs noms.

Cette méthode « aveugle » est cruciale. Elle vous empêche de choisir un chef simplement parce que vous reconnaissez son nom ou sa marque. Cela garantit que le vote est basé purement sur la qualité de la réponse.

2. Pourquoi construire cela ? (Le problème)

La plupart des données d'entraînement de l'IA sont comme un régime composé uniquement de nourriture anglaise. À cause de cela, l'IA a du mal avec la culture, l'argot et les règles de sécurité français. Pour apprendre à une IA à être bonne en français, il faut que des milliers de Français disent : « J'ai aimé cette réponse, mais j'ai détesté celle-là ».

Avant compar:IA, ces données étaient soit cachées à l'intérieur de grandes entreprises technologiques, soit elles n'existaient tout simplement pas pour les francophones. compar:IA est une cuisine publique où n'importe qui peut aider à préparer ces données, puis la recette (les données) est partagée librement avec tout le monde.

3. La récolte (Ce qu'ils ont collecté)

Depuis son ouverture fin 2024, ce terrain de jeu numérique a été très actif. Début 2026, ils ont rassemblé :

  • Plus de 600 000 questions posées par de vraies personnes.
  • Plus de 250 000 votes décidant quelle réponse d'IA était la meilleure.
  • 89 % des données sont en français, ce qui est un événement majeur dans un monde dominé par les données anglaises.

Ils n'ont pas seulement collecté les votes ; ils ont également demandé aux utilisateurs de réagir à des parties spécifiques des réponses, créant ainsi une carte riche de ce qui importe réellement aux locuteurs français.

4. Qui l'utilise et pourquoi ?

  • Pour le grand public : C'est un moyen gratuit de discuter avec de nombreux modèles d'IA différents (certains célèbres, d'autres nouveaux et open-source) pour voir comment ils réfléchissent. Cela montre également l'énergie (électricité) utilisée par l'IA pour répondre, les encourageant à réfléchir à l'environnement.
  • Pour les scientifiques et les entreprises : Ils peuvent télécharger le « livre de recettes » (les données) pour entraîner leurs propres modèles d'IA à mieux parler français.
  • Pour les écoles : Les enseignants utilisent la plateforme pour montrer aux élèves comment fonctionne l'IA, transformant la plateforme en un outil pédagogique où les élèves débattent de la réponse de l'IA la plus juste ou la plus précise.

5. Les règles du jeu (Confidentialité et Sécurité)

Les créateurs ont été très prudents concernant la vie privée.

  • Pas d'inscription : Vous n'avez pas besoin de donner votre nom ou votre e-mail pour jouer. Cela réduit la barrière à l'entrée, mais signifie qu'ils doivent être extrêmement vigilants par la suite.
  • Le filtre : Avant que toute donnée ne soit partagée avec le public, un ordinateur intelligent scanne chaque conversation. S'il repère le nom d'une personne réelle, une adresse ou des informations privées, il jette toute la conversation à la poubelle. Il vaut mieux perdre quelques points de données que de laisser fuiter accidentellement les secrets de quelqu'un.
  • Open Source : Les données sont publiées sous une licence du gouvernement français, ce qui signifie que n'importe qui peut les utiliser pour la recherche ou la création de nouveaux outils, tant qu'il respecte les règles.

6. Le tableau des scores

La plateforme tient également un classement (une liste de positionnement). C'est comme un tableau des scores de sport qui montre quels modèles d'IA les Français préfèrent le plus. Cependant, les auteurs précisent que ce n'est pas un test parfait d'« intelligence ». Cela montre simplement ce que les gens ont aimé dans un cadre informel. C'est plus un concours de popularité qu'un examen final.

7. L'avenir

L'équipe française voit cela comme un prototype. Ils travaillent déjà à l'extension du « test de dégustation » à d'autres langues (en commenant par le danois) afin que d'autres pays puissent construire leurs propres jardins de données publics.

En résumé : compar:IA est un service public qui utilise le crowdsourcing pour recueillir les préférences linguistiques françaises afin d'apprendre à l'IA à parler, penser et se comporter comme un humain francophone, tout en gardant le processus ouvert, privé et gratuit pour tous.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →