← Nieuwste papers
💬 NLP

ReFRAME or Remain: Unsupervised Lexical Semantic Change Detection with Frame Semantics

Dit artikel introduceert ReFRAME, een ongesuperviseerde methode voor het detecteren van lexicale semantische verandering gebaseerd op frame-semantiek, die een zeer interpreteerbaar alternatief biedt voor neurale embedding-modellen terwijl deze competitieve of superieure prestaties laat zien.

Oorspronkelijke auteurs: Bach Phan-Tat, Kris Heylen, Dirk Geeraerts, Stefano De Pascale, Dirk Speelman

Gepubliceerd 2026-08-25
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Bach Phan-Tat, Kris Heylen, Dirk Geeraerts, Stefano De Pascale, Dirk Speelman

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Woorden zijn geen statische objecten; het zijn levende wezens die groeien, verschuiven en zich aanpassen naarmate de mensen die ze gebruiken veranderen. In de studie van taal staat dit proces bekend als semantische verandering. Decennialang hebben wetenschappers geprobeerd deze verschuivingen te volgen met behulp van computers, waarbij ze vaak vertrouwen op enorme tekstdatabases om te zien hoe het gezelschap dat een woord houdt, in de loop der tijd verandert. Het heersende idee is dat als een woord naast verschillende soorten woorden verschijnt in verschillende tijdperken, de betekenis ervan waarschijnlijk is geëvolueerd. Moderne computerprogramma's zijn erg goed in het opsporen van deze patronen, maar ze werken vaak als een 'black box': ze kunnen je vertellen dat er een verandering heeft plaatsgevonden, maar ze kunnen niet gemakkelijk uitleggen waarom of de specifieke redenen daarachter tonen. Het resultaat is een correct antwoord dat opaak aanvoelt, waardoor onderzoekers zonder een helder venster blijven naar de werkelijke mechanismen van hoe betekenis transformeert.

Een team van taalkundigen en computerwetenschappers van KU Leuven en andere instellingen besloot een ander pad te bewandelen. In plaats van een computer te vragen de betekenis van een woord te raden op basis van statistische patronen, vroegen ze het om te kijken naar de specifieke situaties, of "frames", waarin het woord wordt gebruikt. Deze benadering put uit een theorie genaamd Frame Semantics, die suggereert dat we woorden niet in isolatie begrijpen, maar door de mentale scènes die ze oproepen. Wanneer je het woord "kopen" hoort, roept je geest automatisch een scène op met een koper, een verkoper, goederen en geld. Wanneer je "verkopen" hoort, is de scène hetzelfde, maar verschuift het perspectief naar de verkoper. De onderzoekers hypothetiseerden dat als de betekenis van een woord in de loop van de tijd verandert, de soorten scènes waarin het woord deelneemt, ook moeten veranderen. In plaats van te vertrouwen op verborgen wiskundige patronen, wilden ze deze expliciete, gestructureerde scènes gebruiken als een transparant signaal om te detecteren wanneer een woord getransformeerd is.

Om deze idee te testen, richtte het team zich op de Engelse taal, waarbij gebruik werd gemaakt van een grote collectie teksten die verdeeld was in twee afzonderlijke perioden: de midden-19e eeuw en de late 20e eeuw. Ze selecteerden een lijst van woorden waarvan bekend is dat de betekenis is veranderd en gebruikten een computerprogramma om elke zin met die woorden te analyseren. Het programma telde niet alleen hoe vaak woorden samen voorkamen; het identificeerde de specifieke conceptuele frames waar elke zin toe behoorde. Het bepaalde bijvoorbeeld of een zin over het woord "plane" ging over een vliegtuig dat opstijgt of een plat oppervlak in de meetkunde. Door de frequentie van deze verschillende frames tussen de twee tijdperken te vergelijken, konden de onderzoekers meten hoeveel het gebruik van het woord was verschoven. Ze berekenden een score op basis van hoe verschillend de distributie van deze scènes was van het ene tijdperk naar het andere.

De resultaten waren verrassend sterk. De methode, die volledig steunde op deze expliciete frames, presteerde beter dan veel van de meest geavanceerde computermodellen die gebruikmaken van complexe, verborgen wiskundige representaties. Sterker nog, hun systeem behoorde tot de topprestaties in een belangrijke internationale wedstrijd die ontworpen was om precies dit soort taken te testen. Belangrijker nog, omdat de methode gebouwd was op duidelijke, menselijk begrijpelijke categorieën, konden de onderzoekers in de resultaten kijken en precies zien wat er was veranderd. Ze konden naar een specifiek woord wijzen en zeggen: "Dit woord veranderde omdat het begon te verschijnen in scènes over reizen en handel, terwijl het ophield te verschijnen in scènes over meting." Dit niveau van detail is iets wat de krachtigere, maar opaakere modellen vaak niet kunnen bieden.

Het team onderzocht specifieke voorbeelden om de mechanica van hun succes te begrijpen. Ze keken naar het woord "prop", dat in de 19e eeuw voornamelijk werd gebruikt in contexten gerelateerd aan fysieke ondersteuning of familiale stabiliteit. Tegen de late 20e eeuw was het woord verschoven naar het veelvuldig voorkomen in scènes gerelateerd aan theater en optreden, waar het verwees naar objecten die door acteurs worden gebruikt. De computer detecteerde deze verschuiving door op te merken dat de oude frames waren vervaagd en nieuwe voor in de plaats waren gekomen. Ze keken ook naar het woord "tree" (boom), dat zeer weinig verandering vertoonde in zijn framegebruik, waarmee het correct als een stabiel woord werd geïdentificeerd. De methode onthulde echter ook haar eigen beperkingen. Voor het woord "quilt" (quilt/deken) detecteerde de computer een grote verschuiving omdat het woord in veel nieuwe fysieke contexten verscheen, zoals het vouwen of neerleggen, ook al was de kernbetekenis van het object zelf niet echt veranderd. Dit toonde aan dat hoewel de methode uitstekend is in het opsporen van veranderingen in gebruik, het soms een verandering in context kan aanzien voor een verandering in betekenis.

Ondanks deze kleine beperkingen, demonstreert de studie dat expliciete taalkundige kennis een krachtig instrument kan zijn voor het begrijpen van hoe taal evolueert. De onderzoekers hadden niet het doel om het snelste of meest complexe systeem te bouwen, maar eerder om er een te creëren dat helder en interpreteerbaar is. Ze ontdekten dat door zich te richten op de gestructureerde scènes die woorden oproepen, ze niet alleen de semantische verandering met hoge nauwkeurigheid konden detecteren, maar ook de aard van die verandering in gewone termen konden uitleggen. Deze benadering biedt een manier om de kloof te overbruggen tussen de rauwe kracht van moderne kunstmatige intelligentie en het genuanceerde begrip van menselijke taal, en bewijst dat het kijken naar de specifieke details van hoe een woord wordt gebruikt soms meer onthullend is dan het vertrouwen op een verborgen wiskundige gok.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →