← Nieuwste papers
💬 NLP

Lacuna Inc. at SemEval-2026 Task 4: Structurally Gated State-Space Models for Disentangling Narrative Similarity

Dit artikel introduceert het Invariant-Variant Disentangled State-Space Model (IVD-SSM), dat een hybride State-Space backbone combineert met een nieuwe Structurally Gated Alignment head om abstracte narratieve structuren effectief te ontkoppelen van oppervlakkige lexicale details voor verbeterde evaluatie van verhaalgelijkenis bij SemEval-2026 Taak 4.

Oorspronkelijke auteurs: Aleksey Kudelya, Rafif Alshawi, Alexander Shirnin

Gepubliceerd 2026-07-07
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Aleksey Kudelya, Rafif Alshawi, Alexander Shirnin

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Het Grote Probleem: "Dezelfde Woorden, Anders Verhaal"

Stel je voor dat je probeert te bepalen of twee verhalen eigenlijk hetzelfde plot hebben, maar dan verteld met andere personages.

  • Verhaal A: Een gepeste kind gebruikt een "zombievirus" om wraak te nemen en populair te worden.
  • Verhaal B: Een wetenschapper laat per ongeluk een "zombievirus" los in een laboratorium, en iedereen rent rond en schreeuwt.

Een standaard computerprogramma zou naar deze verhalen kijken en zeggen: "Ze zijn voor 90% hetzelfde!" omdat ze beide het woord "zombie" bevatten. Maar een mens weet dat dit totaal verschillende verhalen zijn. De één gaat over wraak en sociale status; de ander over een survival horror-ramp.

De uitdaging waar de auteurs voor stonden (SemEval-2026 Task 4) was het bouwen van een computer die het "zombie"-trefwoord negeert en in plaats daarvan kijkt naar de oorzaak-gevolgketen: Wie deed wat, en waarom?

De Oplossing: De "Skelet vs. Huid"-aanpak

Het team van de HSE Universiteit bouwde een systeem genaamd IVD-SSM. Zie dit systeem als een detective die een verhaal in twee lagen verdeelt:

  1. Het Skelet (Invariant): De kernstructuur. De opeenvolging van gebeurtenissen (bijv. "Buitenstaander" → "Ondernemt drastische actie" → "Status verandert"). Dit verandert nooit, zelfs niet als de namen veranderen.
  2. De Huid (Variant): De oppervlakkige details. Namen, specifieke objecten, omgevingen en genre-tropen (zoals "zombies", "ruimteschepen" of "kastelen").

Hun doel was om de computer volledig te laten focussen op het Skelet en de Huid te laten negeren.

Hoe het werkt: Het "Grote Plaatje" en de "Microscoop"

Het systeem gebruikt een speciaal type AI-engine (gebaseerd op een model genaamd Jamba) dat erg goed is in het lezen van lange teksten zonder moe te worden of het begin te vergeten. Maar de echte magie gebeurt in een nieuw onderdeel dat zij hebben uitgevonden: de Structurally Gated Alignment (SGA) Head.

Stel je voor dat de SGA-head twee paren ogen heeft die samenwerken:

  1. Het "Macro"-oog (De groothoeklens):

    • Dit oog kijkt naar het verhaal van een afstandje. Het slaat details over en ziet alleen de grote mijlpalen: Begin, Conflict, Climax, Resolutie.
    • Het maakt een ruwe kaart van de vorm van het verhaal. Het geeft niet om of de held "John" of "Jane" heet, of dat het wapen een "geweer" of een "laser" is. Het ziet alleen de vorm van het plot.
  2. Het "Micro"-oog (De microscoop):

    • Dit oog zoomt in op elk afzonderlijk woord. Het merkt op dat beide verhalen over "zombies" spreken.
    • Het Gevaar: Als de computer alleen dit oog zou gebruiken, zou hij in de val worden gelokt door het woord "zombie" en denken dat de verhalen hetzelfde zijn.
  3. De "Poortwachter" (Het Gating-mechanisme):

    • Dit is het belangrijkste onderdeel. Het Macro-oog fungek als een uitsmijter of poortwachter.
    • Het kijkt eerst naar de ruwe kaart. Als het Macro-oog zegt: "Hé, de vorm van deze twee verhalen is totaal verschillend," dan slaat het de poort dicht voor het Micro-oog.
    • Zelfs als het Micro-oog schreeuwt: "Maar ze hebben allebei zombies!", zegt de Poortwachter: "Het kan me niet schelen. De plotstructuur komt niet overeen, dus negeer het woord 'zombie'."
    • De Poortwachter laat de details van het Micro-oog alleen door als de grote structuren van de verhalen daadwerkelijk overeenkomen.

Wat ze ontdekten

Het team heeft dit systeem getest tegen andere standaard AI-modellen en zelfs tegen een zeer slimme, vooraf getrainde AI (GPT-4o-mini).

  • Standaard Modellen: Werden in de val gelokt door de "zombie"-woorden en zagen het verschil in de plots niet.
  • Hun Systeem (IVD-SSM): Slaagde erin om de afleidende woorden te negeren en herkende correct dat de "wraak"-verhalen en de "survival"-verhalen verschillend waren, terwijl het het verhaal koos dat daadwerkelijk dezelfde "buitenstaander neemt actie"-structuur deelde.
  • Het Resultaat: Hun systeem presteerde beter dan willekeurig gokken en beter dan eenvoudige woordmatching, wat bewijst dat je een computer kunt leren om voorbij de oppervlakkige details te kijken om de ware verhaalstructuur te vinden.

De Keerzijde (Beperkingen)

De auteurs zijn eerlijk over de punten waar hun systeem nog niet perfect is:

  • De poort is geen muur: De poort is "zacht". Als het verkeerde verhaal te veel overeenkomende specifieke woorden heeft (zoals een zeer specifieke naam of een zeldzaam object), kan een klein beetje van die "ruis" nog steeds door de poort lekken en het systeem in verwarring brengen.
  • Geheugenproblemen: Hoewel de hoofdengine efficiënt is, is de laatste stap van het vergelijken van elk woord met elk ander woord (om de details te controleren) nog steeds zwaar voor het computergeheugen. Het werkt prima voor korte samenvattingen, maar kan moeite hebben met volledige romans.
  • Trainingsdata: Ze moesten het systeem voornamelijk trainen op verhalen die door andere computers zijn gegenereerd, omdat er niet genoeg door mensen geschreven voorbeelden waren. Dit betekent dat het systeem erg goed is in het herkennen van standaard verhaalpatronen, maar in de war kan raken door zeer vreemde, experimentele of niet-lineaire menselijke verhalen.

Samenvattend

Het artikel presenteert een nieuwe manier om computers te leren verhalen te begrijpen. In plaats van alleen te tellen hoeveel woorden twee verhalen delen, hebben ze een systeem gebouwd dat eerst controleert of de structuur van het plot (het skelet) overeenkomt. Alleen als de skeletten overeenkomen, laten ze de details toe om de uiteindelijke beslissing te beïnvloeden. Dit voorkomt dat de computer wordt misleid door oppervlakkige overeenkomsten zoals gedeelde trefwoorden.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →