← Derniers articles
💬 NLP

VIVID: A Culturally Grounded Benchmark Exposing the Figurative Language Gap in Vietnamese NLP

L'article présente VIVID, le premier banc d'essai ancré culturellement pour le langage figuré vietnamien, qui révèle que les modèles de pointe actuels, y compris ceux spécialisés pour le vietnamien, éprouvent des difficultés significatives avec les nuances des expressions idiomatiques et des proverbes en raison d'une surinterprétation littérale et d'un manque de compétence culturelle.

Auteurs originaux : Tu Tran Do, Nhat Ngoc Nguyen, Khanh-Tung Tran, Hoang D. Nguyen, Tu Minh Phuong, Long Hoang Dang

Publié 2026-08-05
📖 4 min de lecture☕ Lecture pause café

Auteurs originaux : Tu Tran Do, Nhat Ngoc Nguyen, Khanh-Tung Tran, Hoang D. Nguyen, Tu Minh Phuong, Long Hoang Dang

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez que vous essayiez d'apprendre à un robot à comprendre l'humour, le sarcasme et les expressions anciennes des humains. Il ne s'agit pas seulement de savoir ce que les mots signifient ; il s'agit de comprendre la culture qui se cache derrière eux. Dans le monde de l'informatique, ce domaine s'appelle le Traitement du Langage Naturel (NLP). Voyez le NLP comme le pont entre le langage humain et le code informatique. Pendant longtemps, des scientifiques ont construit des ponts pour les langues populaires et importantes comme l'anglais, mais de nombreuses langues plus petites ou riches culturellement sont restées de l'autre côté de la rivière. Un défi clé dans ce domaine est le « langage figuré » — des phrases où les mots ne signifient pas ce qu'ils disent littéralement. Par exemple, si quelqu'un dit : « Il pleut des chats et des chiens », un ordinateur qui ne connaît que les définitions littérales pourrait commencer à chercher des animaux qui tombent du ciel ! Pour résoudre cela, les chercheurs ont besoin de tests spéciaux, ou « benchmarks », pour voir si leurs modèles d'IA peuvent réellement saisir la blague ou la leçon derrière les mots, plutôt que de simplement deviner en se basant sur des schémas.

Voici VIVID, un nouvel outil coloré créé par des chercheurs pour tester la capacité de l'IA à comprendre les idiotismes et les proverbes vietnamiens. Considérez VIVID comme une immense « soirée quiz » culturellement spécifique, conçue spécialement pour les expressions vietnamiennes. Les chercheurs ont rassemblé 1 636 de ces phrases complexes — certaines sont des proverbes courts et rythmés remplis de leçons de vie, tandis que d'autres sont des idiotismes figés qui ne peuvent être compris mot à mot. Ils ne les ont pas simplement jetés en vrac ; ils les ont organisés comme une exposition de musée, en étiquetant chacun avec des « niveaux de difficulté » (comme l'utilisation de mots anciens, la référence à l'agriculture ou le recours au sarcasme) et des « thèmes » (comme l'amour, la critique ou le travail).

L'équipe a ensuite invité huit des modèles d'IA les plus intelligents au monde à passer ce test. Cela comprenait à la fois des modèles construits spécifiquement pour le vietnamien et de massifs modèles polyvalents parlant de nombreuses langues. Ils ont demandé aux IA d'expliquer les expressions et de deviner à quelle catégorie elles appartenaient. Les résultats ont été un véritable signal d'alarme. En moyenne, même les modèles d'IA les plus avancés, y compris le célèbre GPT-4o, ont énormément peiné. En moyenne, ils ont obtenu moins de la moitié des bonnes réponses. L'étude a révélé que les IA commettaient souvent des erreurs stupides, comme prendre une métaphore trop au pied de la lettre (pensant qu'une phrase sur la peau d'un buffle concernait réellement la personnalité d'une personne) ou manquer totalement le ton sarcastique. Étonnamment, donner quelques exemples à l'IA pour qu'elle apprenne (une technique appelée « few-shot prompting ») n'a pas toujours aidé ; en fait, pour le meilleur modèle, cela a parfois aggravé les choses en confondant l'IA avec le mauvais style de réponse.

L'article suggère que bien que ces modèles d'IA s'améliorent dans le langage général, ils manquent encore de « compétence culturelle ». Ils sont comme des touristes qui savent lire une carte mais ne comprennent pas les coutumes locales. Les chercheurs concluent que les modèles actuels n'ont pas la compréhension profonde et nuancée nécessaire pour véritablement saisir le cœur du langage figuré vietnamien. VIVID est désormais disponible en tant qu'outil public, agissant comme un miroir pour montrer aux développeurs exactement là où leur IA échoue, afin qu'ils puissent construire des systèmes qui ne se contentent pas de parler la langue, mais qui comprennent véritablement la culture qui la sous-tend.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →