← Derniers articles
💻 computer science

Reliable News or Propagandist News? A Neurosymbolic Model Using Genre, Topic, and Persuasion Techniques to Improve Robustness in Classification

Ce papier propose une approche neurosymbolique combinant des embeddings textuels non contextuels à des caractéristiques symboliques (genre, sujet et techniques de persuasion) pour améliorer la robustesse et la généralisation des modèles de détection de la propagande par rapport aux méthodes purement basées sur le texte.

Auteurs originaux : Géraud Faye, Benjamin Icard, Morgane Casanova, Guillaume Gadek, Guillaume Gravier, Wassila Ouerdane, Céline Hudelot, Sylvain Gatepaille, Paul Égré

Publié 2026-04-03
📖 4 min de lecture☕ Lecture pause café

Auteurs originaux : Géraud Faye, Benjamin Icard, Morgane Casanova, Guillaume Gadek, Guillaume Gravier, Wassila Ouerdane, Céline Hudelot, Sylvain Gatepaille, Paul Égré

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

🕵️‍♂️ Le Problème : Repérer le faux sans se faire avoir

Imaginez que vous naviguez sur Internet. Vous voyez un article qui a l'air très sérieux, avec des photos, des titres percutants et un ton journalistique. C'est une fausse nouvelle (ou "propagande"). Le piège ? Elle se déguise parfaitement en vraie information pour vous manipuler.

Les ordinateurs actuels (les modèles d'intelligence artificielle comme ceux qui font des résumés) sont très forts pour repérer le mensonge, mais ils ont un défaut majeur : ils apprennent par cœur.
C'est comme un étudiant qui révise pour un examen en apprenant les réponses par cœur sans comprendre la logique. Si l'examinateur change une seule question, l'étudiant est perdu. De la même façon, si l'IA a appris à repérer la propagande sur un site web précis, elle risque de se tromper dès qu'elle tombe sur un nouveau site ou un nouveau sujet.

🧠 La Solution : Le "Cerveau Hybride"

Les chercheurs de ce papier (de chez Airbus et des universités françaises) ont eu une idée géniale : au lieu de donner à l'IA seulement le texte à lire, on lui donne aussi une fiche technique sur l'article.

Ils ont créé un modèle qu'ils appellent "Neurosymbolique". C'est un mot compliqué pour dire : "On mélange deux types de cerveau".

  1. Le Cerveau Intuitif (Neural) : C'est la partie qui lit le texte, comme nous. Elle sent le style, les mots utilisés, le ton. C'est rapide mais parfois naïf.
  2. Le Cerveau Logique (Symbolique) : C'est la partie qui pose des questions factuelles, comme un détective :
    • Quel est le genre de l'article ? (Est-ce un fait brut, une opinion, ou une satire ?)
    • De quoi parle-t-il ? (Politique, guerre, sport ?)
    • Quelles techniques de persuasion utilise-t-il ? (Est-ce qu'il répète les mêmes choses ? Utilise-t-il des mots chargés d'émotion ? Fait-il appel à nos préjugés ?)

🍳 L'Analogie du Chef Cuisinier

Pour bien comprendre, imaginons que vous devez repérer un faux plat (un plat empoisonné) dans une cuisine.

  • La méthode ancienne (Texte seul) : Le chef goûte juste la soupe. Si le goût est bon, il dit "C'est bon". Mais un empoisonneur peut mettre du poison dans un bon goût. Le chef se fait avoir.
  • La nouvelle méthode (Hybride) : Le chef goûte la soupe (le texte), MAIS il regarde aussi :
    • Qui a cuisiné ? (La source)
    • Est-ce que le plat est censé être un dessert ou un plat principal ? (Le genre)
    • Est-ce qu'il y a trop de sel ou d'épices pour masquer un goût étrange ? (Les techniques de persuasion)

En combinant le goût (le texte) et l'observation logique (les faits), le chef devient beaucoup plus difficile à tromper, même si le cuisinier change de recette.

🧪 L'Expérience : Mettre l'IA à l'épreuve

Les chercheurs ont pris deux tas d'articles :

  1. Des vrais articles de journaux sérieux (Mainstream).
  2. Des articles de propagande (souvent liés à la guerre en Ukraine).

Ils ont entraîné leur "Cerveau Hybride" et l'ont mis face à des situations difficiles, comme si on changeait les règles du jeu :

  • Nouveaux auteurs : L'IA n'a jamais vu ces journaux avant.
  • Nouvelles opinions : L'IA doit repérer la propagande même si elle vient de la droite ou de la gauche politique.
  • Nouvelle crédibilité : L'IA doit douter des sources peu fiables.

🏆 Les Résultats : Pourquoi c'est une victoire ?

Les résultats montrent que le Cerveau Hybride est beaucoup plus robuste que le "Cerveau Intuitif" seul.

  • Quand les données sont "faciles" (tout est mélangé au hasard), les deux fonctionnent bien.
  • Mais dès qu'on change le contexte (nouvelle source, nouveau sujet), le modèle qui ne lit que le texte s'effondre. Il ne comprend plus rien.
  • Le modèle hybride, lui, continue de bien travailler. Pourquoi ? Parce que même s'il ne connaît pas le nouveau journal, il sait que "Tiens, cet article utilise 5 techniques de manipulation émotionnelle et vient d'une source inconnue, donc c'est suspect".

💡 En résumé

Ce papier nous dit : Pour ne pas se faire avoir par la propagande, il ne suffit pas de lire entre les lignes, il faut aussi regarder les étiquettes.

En ajoutant des indices logiques (qui écrit ? comment écrit-il ?) à la lecture automatique, on crée une intelligence artificielle plus sage, plus prudente et capable de détecter le mensonge même quand il se déguise en nouveau costume. C'est une étape cruciale pour protéger notre information à l'ère des réseaux sociaux.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →