← Derniers articles
📄 social_science

Can AI replace Teachers? Comparing AI and Human Teachers’ ratings and feedback on students’ essays

Cette étude conclut que, bien que les outils d'IA et les enseignants humains fournissent des évaluations globales comparables pour les rédactions d'anglais langue seconde (ALS), ils diffèrent de manière significative en termes de cohérence de notation et de focalisation du feedback, menant à la conclusion que l'IA devrait servir d'outil de soutien complémentaire plutôt que de remplacement pour les éducateurs humains.

Auteurs originaux : Herford Rei B. Guibangguibang, Kian C. Hesula

Publié 2026-06-25
📖 4 min de lecture☕ Lecture pause café

Auteurs originaux : Herford Rei B. Guibangguibang, Kian C. Hesula

Article original sous licence CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez une salle de classe où deux « juges » différents notent la même pile de dissertations d'étudiants. L'un est une équipe d'enseignants humains expérimentés, et l'autre est un panel de trois robots IA (ChatGPT, Bing et CiCi). Les chercheurs voulaient voir : Ces juges sont-ils d'accord sur les notes ? Donnent-ils le même genre de conseils ? Et les robots peuvent-ils prendre la place des enseignants ?

Voici ce que l'étude a révélé, expliqué simplement :

1. La fiche de notation : Des chiffres similaires, une logique différente

Considérez le processus de notation comme deux personnes jugeant un concours de cuisine.

  • Le résultat : Les juges humains et les juges IA ont tous deux donné des notes moyennes sensiblement les mêmes (les deux se sont situés dans la catégorie « Passable »).
  • Le bémol : Même si les chiffres finaux semblaient similaires, les juges n'étaient pas réellement d'accord sur quelle dissertation était la meilleure. Si vous les aligniez côte à côte, leurs notes ne correspondaient pas bien. C'est comme deux personnes notant un film ; elles peuvent toutes deux lui donner un « 7 sur 10 », mais l'une peut avoir adoré le jeu d'acteur tandis que l'autre a détesté l'intrigue.
  • Le verdict : L'IA était cohérente avec elle-même (les trois IA étaient très d'accord entre elles), et les humains étaient cohérents entre eux. Mais les humains et les IA parlaient des « langages de notation » différents.

2. Le feedback : Le « Coach Strict » vs le « Mentor Poli »

C'est ici que les deux groupes ont agi de manière très différente. Imaginez le feedback comme un coach parlant à un athlète.

Les enseignants humains (Les Coachs Stricts) :

  • L'accent : Ils étaient focalisés de manière chirurgicale sur les règles. Ils relevaient les fautes de grammaire, les erreurs d'orthographe et les problèmes de mise en page (comme les marges ou l'indentation).
  • Le style : Leur feedback était direct et parfois brusque. Ils disaient des choses comme : « Mauvais temps de verbe » ou « Vous avez besoin d'une thèse ».
  • L'écart : Parfois, si une dissertation était juste « correcte », les enseignants humains ne donnaient aucun feedback. Ils étaient peut-être fatigués ou se concentraient uniquement sur les erreurs les plus importantes.

Les outils d'IA (Les Mentors Polis) :

  • L'accent : Ils regardaient la vue d'ensemble. Ils parlaient de la clarté des idées, de la fluidité du récit et du contenu global, en plus de la grammaire.
  • Le style : Ils étaient beaucoup plus équilibrés. Ils utilisaient la méthode du « sandwich » : ils commençaient par des éloges (« Excellentes idées ! »), ajoutaient la critique (« Mais la grammaire doit être travaillée ») et terminaient par des encouragements. Ils ne donnaient jamais de note de zéro feedback ; chaque texte recevait un commentaire.
  • La différence : L'IA était comme un robot qui se souvenait toujours d'être gentil et de couvrir tous les aspects, tandis que l'enseignant humain était comme un expert occupé qui corrigeait les erreurs critiques mais pouvait omettre les politesses.

3. La grande question : L'IA peut-elle remplacer les enseignants ?

L'étude conclut par une réponse claire : Non, mais elles font de superbes assistantes.

  • Pourquoi pas remplacer ? L'IA ne peut pas encore comprendre « l'âme » d'une dissertation ni le contexte spécifique de la vie d'un étudiant. Le faible accord sur les notes signifie que l'IA est encore trop imprévisible pour être le juge final par elle-même. Elle a besoin d'un humain pour vérifier son travail.
  • Pourquoi les utiliser ? L'IA est excellente pour effectuer le « gros du travail ». Elle peut noter rapidement, donner un feedback cohérent sur la structure et toujours être polie. Cela aide les enseignants à gagner du temps.

La conclusion finale

Considérez l'IA non pas comme un remplacement de l'enseignant, mais comme un assistant d'enseignement surpuissant.

Si un enseignant doit corriger 100 dissertations, l'IA peut agir comme un premier filtre, mettant en évidence les problèmes de grammaire et suggérant des améliorations sur l'organisation. Cependant, l'enseignant humain doit rester le « Juge Principal » pour s'assurer que le feedback fait sens, pour comprendre la situation unique de l'étudiant et pour apporter la connexion humaine qu'un robot ne peut pas fournir.

En bref : L'IA est un excellent outil pour aider les enseignants, mais elle ne devrait pas être autorisée à les remplacer. La touche humaine reste la partie la plus importante de l'équation.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →