← Nieuwste papers
💻 computer science

World Models in Words: Auditing Physical State-Transition Commitments in Vision-Language Models

Dit artikel introduceert \wmw, een evaluatiekader en de \tracebank-dataset die Vision-Language-modellen auditeren door hen te verplichten getypeerde fysische staatsovergangstraces te genereren, waardoor verborgen redeneringsfouten worden blootgelegd en verbeteringen in fysieke consistentie mogelijk worden gemaakt die traditionele benchmarks die alleen antwoorden evalueren, over het hoofd zien.

Oorspronkelijke auteurs: Emmanuelle Bourigault

Gepubliceerd 2026-05-29
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Emmanuelle Bourigault

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een student inhuurt om een natuurkundig probleem op te lossen. Op de oude manier van toetsen keek je alleen naar het eindantwoord dat ze op papier schreven. Als ze het juiste getal hadden, kregen ze een A. Als ze het fout hadden, kregen ze een F.

Het probleem is dat een student het juiste antwoord door pure geluk, door gissen, of door een volledig verkeerde logica die toevallig op het juiste getal uitkwam, kan krijgen. Je zou niet weten hoe ze er kwamen, alleen wat ze kregen.

Dit artikel introduceert een nieuwe manier om AI-modellen (specifiek Vision-Language Models) te testen, genaamd World Models in Words (WMW). In plaats van alleen het eindantwoord te controleren, dwingen de onderzoekers de AI om stap voor stap haar werk te tonen, als een gedetailleerd dagboek van haar gedachten.

De nieuwe "Toon je werk"-toets

De onderzoekers vragen de AI om een Trace te produceren, wat een verhaal in vier delen is:

  1. Het startscène (s0s_0): Wat ziet de AI op dit moment? (bijv. "Een bal zit op een helling.")
  2. De actie (Δs\Delta s): Welke regel speelt er? (bijv. "Zwaartekracht trekt de bal naar beneden.")
  3. Het resultaat (s1s_1): Wat gebeurt er daarna? (bijv. "De bal rolt de helling af.")
  4. Het antwoord (aa): De uiteindelijke conclusie.

De AI moet dit verhaal in een zeer specifiek, gestructureerd formaat schrijven (zoals een JSON-codeblok) zodat een computer het kan controleren.

De "Hybride Verificator" (De strenge leraar)

Zodra de AI haar verhaal schrijft, leest een speciaal computerprogramma, een Hybride Verificator, het. Dit is niet zomaar een eenvoudige spellingscontrole. Het fungeert als een strenge natuurkundeleraar die controleert:

  • Heb je de juiste objecten gezien? (Is dat een bal of een doos?)
  • Is de natuurkunde realistisch? (Trekt zwaartekracht omhoog of omlaag?)
  • Is het verhaal logisch? (Als de bal naar beneden rolt, eindigt hij dan onderaan?)
  • Komt het antwoord overeen met het verhaal? (Als het verhaal zegt dat de bal naar links rolt, maar het antwoord zegt "Rechts", dan liegt de AI.)

Als de AI het juiste antwoord geeft maar een nepverhaal vertelt (bijv. "De bal rolt naar links door magie"), vangt de Verificator dit op. Het artikel noemt dit een "Verborgen Inconsistentie".

De grote ontdekking: "De gelukkige gissers"

De onderzoekers testten 7 verschillende AI-modellen. Ze vonden iets verrassends:

  • Veel modellen gaven het juiste eindantwoord.
  • Maar, voor ongeveer 18% tot 42% van die "juiste" antwoorden, was het verhaal dat de AI vertelde om daar te komen, fysiek onmogelijk.

Het is als een student die het juiste antwoord raadt op een wiskundetoets, maar een oplossing opschrijft waarbij door nul wordt gedeeld. De oude toets zou hen een A hebben gegeven; deze nieuwe toets onthult dat ze de wiskunde eigenlijk niet begrijpen.

De "Wereldbank" van natuurkundige verhalen

Om deze toets mogelijk te maken, creëerden de auteurs een enorme bibliotheek genaamd WMW-TRACEBANK.

  • Het bevat 200 zorgvuldig samengestelde natuurkundige scenario's (zoals hellingen, veren en botsingen).
  • Het heeft 3.200 paren van "Goede Verhalen" versus "Slechte Verhalen". In een "Slecht Verhaal" veranderden ze slechts één klein ding (zoals het omdraaien van een krachtrichting) om te zien of de AI de fout kon opsporen.
  • Deze bibliotheek helpt AI om te stoppen met gissen en te beginnen met het vertellen van de waarheid over hoe de fysieke wereld werkt.

De AI repareren

Het artikel testte ook manieren om deze "leugenaars" te repareren.

  1. Herrangschikken: Ze lieten de AI 8 verschillende verhalen genereren en kozen degene die de controle van de Verificator doorstond. Dit verbeterde de kwaliteit van de verhalen zonder de eindantwoorden te veranderen.
  2. Voorkeurstraining: Ze leerden de AI "Goede Verhalen" te verkiezen boven "Slechte Verhalen" met behulp van de 3.200 paren. Dit verminderde het aantal verborgen leugens met 41%.

De kernboodschap

Het belangrijkste punt van dit artikel is niet het bouwen van een betere natuurkunderekenmachine. Het is het bouwen van een waarheidsdetector.

Voordat we AI vertrouwen om ons te helpen bij taken in de echte wereld (zoals plannen voor robots of studenten onderwijzen), moeten we weten of hun interne verhaal van de wereld overeenkomt met de realiteit. Dit artikel geeft ons een hulpmiddel om dat verhaal te auditeren, zodat we zeker weten dat wanneer een AI zegt "De bal rolt naar beneden", hij daadwerkelijk begrijpt waarom en hoe, in plaats van alleen het juiste woord te raden.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →