← Nieuwste papers
💬 NLP

When Meaning Isn't Literal: Exploring Idiomatic Meaning Across Languages and Modalities

Dit paper introduceert Mediom, een meertalig en multimodaal corpus van idiomatische uitdrukkingen, en HIDE, een raamwerk voor het verbeteren van idiomatisch redeneren in AI-systemen, om de huidige beperkingen in het begrijpen van culturele en metaforische betekenissen aan te pakken.

Oorspronkelijke auteurs: Sarmistha Das, Shreyas Guha, Suvrayan Bandyopadhyay, Salisa Phosit, Kitsuchart Pasupa, Sriparna Saha

Gepubliceerd 2026-04-14
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Sarmistha Das, Shreyas Guha, Suvrayan Bandyopadhyay, Salisa Phosit, Kitsuchart Pasupa, Sriparna Saha

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een vreemde taal leert, maar je leraar vertelt je alleen de letterlijke betekenis van woorden. Als iemand in het Nederlands zegt: "Het regent katten en honden", zou een robot die alleen letterlijk denkt, misschien denken dat er echt dieren uit de lucht vallen. Maar wij weten dat het gewoon betekent dat het heel hard regent. Dit is een spreekwoord (of idioom).

Deze wetenschappelijke paper gaat over een groot probleem: moderne kunstmatige intelligentie (AI) is heel slim, maar ze is vaak "letterlijk" ingesteld. Ze begrijpt de diepere, culturele betekenis van spreekwoorden niet goed.

Hier is een uitleg van wat de onderzoekers hebben gedaan, vertaald naar simpele taal met een paar creatieve vergelijkingen:

1. Het Probleem: De "Letterlijke Bril"

Stel je voor dat AI een reiziger is die een nieuwe stad bezoekt. Als hij een bord ziet met een afbeelding van een vos en druiven, denkt hij: "Oh, een vos kijkt naar druiven." Maar hij mist de echte boodschap: "Deze vos is boos omdat hij de druiven niet kan bereiken, dus zegt hij dat ze weliswaar zuur zijn."

De onderzoekers ontdekten dat AI-modellen (zoals de slimme chatbots van vandaag) vaak vastlopen bij dit soort "culturele raadsels". Ze zien de afbeelding of de woorden, maar missen de geest erachter. Ze zijn als een fotograaf die een foto maakt, maar niet begrijpt wat er op de foto gebeurt.

2. De Oplossing: Een Nieuw Boek met Foto's (Mediom)

Om dit op te lossen, hebben de onderzoekers een nieuw, enorm boek gemaakt genaamd Mediom.

  • Wat is het? Een verzameling van 3.533 spreekwoorden uit drie talen: Hindi, Bengaals en Thais.
  • Het unieke: In tegenstelling tot andere boeken die alleen tekst hebben, heeft dit boek foto's bij elk spreekwoord.
  • De vergelijking: Het is alsof ze een woordenboek hebben gemaakt dat niet alleen vertaalt, maar ook een film en een uitleg van een culturele expert toevoegt. Ze hebben zelfs zorgvuldig gecontroleerd of de foto's de juiste betekenis hebben (bijvoorbeeld: geen foto van een echt dier, maar een foto die de gevoelens van het spreekwoord uitbeeldt).

3. De Slimme Truc: De "Hint-Geefmachine" (HIDE)

Zelfs met dit nieuwe boek maken de AI-modellen nog steeds fouten. Dus bedachten de onderzoekers een slimme truc genaamd HIDE.

  • Hoe werkt het? Stel je voor dat je een leerling bent die een proefwerk maakt. Als hij een fout maakt, krijgt hij niet alleen een rode streep, maar ook een hint van de leraar: "Kijk eens niet naar de letters, maar naar het gevoel van de zin."
  • De cyclus:
    1. De AI probeert een spreekwoord te verklaren.
    2. Als hij het fout heeft, kijkt het systeem naar eerdere fouten die het heeft gemaakt (een soort "foutenboek").
    3. Het pakt een slimme hint uit dat boek en zegt tegen de AI: "Probeer het nog eens, maar vergeet de letterlijke betekenis en denk na over de metafoor."
    4. De AI krijgt een tweede kans en maakt de fout nu minder vaak.

Dit noemen ze "Error-Feedback Learning": van je fouten leren door slimme hints te krijgen.

4. Wat hebben ze ontdekt?

De onderzoekers hebben gekeken of hun methode werkte:

  • Tekst vs. Beeld: AI-modellen die alleen tekst lezen, waren al redelijk goed in het begrijpen van spreekwoorden. Maar modellen die ook naar plaatjes kijken (multimodaal), hadden het vaak lastiger. Ze zagen de afbeelding, maar snapten de diepere betekenis niet.
  • De Hint werkt: Toen ze de "HIDE"-truc (de hints) gebruikten, werden de AI-modellen veel beter. Ze leerden sneller en gaven nauwkeurigere uitleggen. Het was alsof je de AI een bril gaf die hem leerde om niet alleen te kijken, maar ook te denken.

Samenvatting in één zin

De onderzoekers hebben een nieuw, beeldrijk woordenboek gemaakt voor spreekwoorden in drie Aziatische talen en een slimme "leraar" bedacht die AI-modellen helpt om niet alleen naar de woorden te kijken, maar ook de culturele diepgang en humor erachter te begrijpen.

Dit is een belangrijke stap om AI menselijker en slimmer te maken, zodat ze niet alleen woorden kan vertalen, maar ook de ziel van een taal kan begrijpen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →