← Nieuwste papers
💬 NLP

Measuring cross-language intelligibility between Romance languages with computational tools

Dit onderzoek introduceert een nieuwe computationele metriek die op basis van lexicale en semantische gelijkenis de wederzijdse verstaanbaarheid tussen de belangrijkste Romaanse talen meet, waarbij de resultaten sterk overeenkomen met menselijke experimenten.

Oorspronkelijke auteurs: Liviu P Dinu, Ana Sabina Uban, Bogdan Iordache, Anca Dinu, Simona Georgescu

Gepubliceerd 2026-02-10
📖 3 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Liviu P Dinu, Ana Sabina Uban, Bogdan Iordache, Anca Dinu, Simona Georgescu

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je op een groot Europees feestje bent. Je spreekt Nederlands, maar je ziet daar ook mensen die Spaans, Frans, Italiaans, Portugees en Roemeens spreken. Je begrijpt ze niet allemaal, maar je merkt dat je met de Spanjaard wel een beetje kunt 'knikken' en begrijpen wat hij zegt, terwijl de Franse gast voor jou klinkt als een onbegrijpelijk liedje.

Waarom is dat zo? Kunnen we dat met een computer berekenen? Dat is precies wat deze wetenschappers hebben onderzocht.

De "Taal-Spiegel" Methode

De onderzoekers wilden niet alleen weten of mensen elkaar begrijpen, maar ook waarom. Ze hebben een slimme computerformule gemaakt, de DLI-index, die eigenlijk werkt als een soort digitale bril. Deze bril kijkt naar drie dingen:

  1. De Look (Het uiterlijk): Hoeveel lijken de woorden op elkaar als je ze opschrijft? (Bijv. luna in het Spaans en luna in het Italiaans).
  2. De Klank (De muziek): Hoeveel lijken de woorden op elkaar als je ze hoort? Dit is cruciaal! Een woord kan er op papier hetzelfde uitzien, maar als de klank totaal anders is, herken je het niet als je het hoort.
  3. De Betekenis (De ziel): Dit is de lastigste. Soms lijken twee woorden sprekend op elkaar, maar betekenen ze iets heel anders. Dat noemen we 'valse vrienden'. Denk aan het woord 'eventueel' in het Nederlands (misschien) versus 'eventually' in het Engels (uiteindelijk). De computer kijkt of de betekenis ook echt matcht.

De Resultaten: Een ongelijk speelveld

De onderzoekers ontdekten dat begrijpelijkheid een eenrichtingsweg is. Het is geen tweerichtingsverkeer.

  • De "Grote Broers" en "Kleine Broers": Spaans, Italiaans en Portugees liggen dicht bij elkaar. Het is alsof ze dezelfde familie-erfenis delen. Ze begrijpen elkaar redelijk goed.
  • De Roemeense Mystery: Roemeens is de 'vreemde eend in de bijt'. De onderzoekers zagen dat Roemenen andere talen vaak wel begrijpen, maar dat de rest van Europa de Roemenen minder goed verstaat. Het is alsof de Roemenen een heel goed geheugen hebben voor de familiegeschiedenis, maar de rest van de familie een zwaar accent heeft dat niemand kan volgen.
  • Schrijven vs. Praten: De computer ontdekte dat we elkaar veel beter begrijpen als we de tekst lezen dan wanneer we het horen. Schrijven is als een oude, stabiele foto van een familie; praten is als een snelle, wazige video. Op de foto zie je de gelijkenissen veel duidelijker.

Waarom is dit belangrijk?

Dit onderzoek is niet alleen leuk voor taalliefhebbers. Het helpt ons begrijpen hoe het menselijk brein taal verwerkt. Bovendien laat het zien dat we niet alleen naar woorden moeten kijken, maar ook naar de geschiedenis en de klank.

Kortom: De onderzoekers hebben een digitale meetlat gebouwd waarmee we kunnen zien hoe dicht verschillende talen bij elkaar staan, van hun uiterlijk en hun klank tot hun diepste betekenis. Zo weten we precies hoe groot de 'taal-kloof' tussen ons is!

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →