← Nieuwste papers
🤖 AI

CORE: Conflict-Oriented Reasoning for General Multimodal Manipulation Detection

Het artikel stelt CORE voor, een op conflict georiënteerd redeneerframework dat gebruikmaakt van een nieuw geconstrueerde Conflict Attribution Corpus om het vermogen van multimodale grote taalmodellen om generaliseerbaar nepnieuws te detecteren te verbeteren door intrinsieke semantische of fysieke inconsistenties te identificeren, waardoor een superieure prestatie wordt behaald in few-shot en zero-shot scenario's vergeleken met bestaande state-of-the-art methoden.

Oorspronkelijke auteurs: Jinjie Shen, Yaxiong Wang, Yujiao Wu, Lechao Cheng, Tianrui Hui, Nan Pu, Zhihui Li, Zhun Zhong

Gepubliceerd 2026-06-03
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Jinjie Shen, Yaxiong Wang, Yujiao Wu, Lechao Cheng, Tianrui Hui, Nan Pu, Zhihui Li, Zhun Zhong

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat het internet een enorme, bruisende marktplaats is waar mensen verhalen, foto's en nieuws verhandelen. Onlangs is er een nieuw soort koopman gearriveerd: Generatieve AI. Deze kooplieden zijn zo vaardig in het schilderen van plaatjes en het schrijven van verhalen dat ze "nepnieuws" kunnen creëren dat er volkomen echt uitziet en klinkt. Het is alsoals een meestervervalser die een portret kan schilderen van een president die een voetbaltrofee wint, ook al is dat nooit gebeurd.

Het probleem is dat de oude beveiligingsbewakers (huidige detectietools) getraind zijn om specifieke vervalsingen te herkennen. Als ze weten hoe ze een "scheve glimlach" moeten herkennen, kunnen ze die misschien betrappen. Maar als de vervalser de truc verandert naar "vreemde belichting", raken de oude bewakers in de war. Ze moeten telkens opnieuw vanaf nul worden getraind wanneer de vervalser van stijl verandert, wat te veel tijd en data kost.

Ontmoet CORE: De "Conflictdetective"

De auteurs van dit paper, Jinjie Shen en zijn team, realiseerden zich dat al het nepnieuws één ding gemeen heeft: het klopt niet. Het bevat een interne tegenstrijdigheid.

Denk aan een detective die een mysterie oplost.

  • De Oude Manier: De detective memoriseert het gezicht van elke bekende crimineel. Als er een nieuwe crimineel verschijnt met een ander gezicht, faalt de detective.
  • De CORE-Manier: De detective leert de logica van een misdaad. Hij vraagt: "Spreekt dit verhaal in strijd met wat ik weet over de wereld?"

CORE (Conflict-Oriented REasoning) leert een slimme computerbrein (een Multimodal Large Language Model) om die logica-gebaseerde detective te zijn. In plaats van specifieke vervalsingen te memoriseren, leert het conflicten te herkennen.

Hoe CORE werkt: De Drie-Stappen Trainingskamp

Om dit computerbrein te leren, hebben de onderzoekers een speciaal trainingsprogramma gebouwd met drie onderdelen:

1. De "Conflictbibliotheek" (De Conflict Attribution Corpus)
Eerst hadden ze een tekstboek nodig. Ze creëerden een enorme bibliotheek van 14.000 nepnieuwsberichten. Maar ze labelden ze niet alleen als "Nep". Ze braken ze af als een forensisch expert:

  • De Conflictfactor: Wat is de tegenstrijdigheid? (bijv. "De tekst zegt 'President', maar de afbeelding toont een voetbalbeker.")
  • De Conflictbron: Waar kwam de leugen vandaan? (bijv. "De tekst liegt," of "De afbeelding liegt," of "Dit spreekt echte feiten in de wereld tegen.")
  • Analogie: Het is alsof je een student een toets geeft waarbij hij niet alleen "Fout" aantikt, maar ook precies opschrijft waarom het antwoord fout is en welk deel van de vraag de fout veroorzaakte.

2. De "Brugbouwer" (Modality Bridging Pre-Training)
Computers hebben vaak moeite met het verbinden van wat ze "zien" (afbeeldingen) met wat ze "lezen" (tekst). Soms ziet een computer een foto van een voetbalveld, maar begrijpt hij de tekst "President" niet echt.

  • CORE bouwt een brug tussen deze twee werelden. Het traint de computer om naar een foto te kijken en direct de tekstuele beschrijving te begrijpen, en vice versa, zodat ze dezelfde taal spreken.

3. De "Logica-gym" (Conflict Perception Training)
Nu gaat de computer naar de sportschool. Met behulp van de "Conflictbibliotheek" oefent het het herkennen van tegenstrijdigheden.

  • De computer leert om "conflicterende ideeën" in zijn geest ver uit elkaar te duwen. Als het "President" en "Voetbalbeker" samen ziet, leert het te schreeuwen: "Wacht! Deze twee dingen horen niet bij elkaar!"
  • Het leert te zeggen: "Dit is nep omdat de tekst beweert dat X, maar de afbeelding laat Y zien, en mijn kennis zegt dat X en Y niet tegelijkertijd kunnen gebeuren."

Waarom dit een Game-Changer is

Het paper laat zien dat deze nieuwe aanpak ongelooflijk snel en flexibel is.

  • De "Few-Shot" Superkracht: Stel je voor dat je een bewaker wilt leren om een nieuw type nepnieuws te herkennen (bijv. deepfakes van een specifieke nieuwe beroemdheid).

    • Oude Methoden: Hebben duizenden voorbeelden van die specifieke beroerdheid nodig om te leren.
    • CORE: Heeft slechts een handvol voorbeelden nodig (soms zelfs maar 100, of zelfs nul!). Omdat het al de logica van conflict begrijpt, kan het die logica direct toepassen op de nieuwe beroemdheid. Het is alsof je iemand leert schaken door de regels uit te leggen, in plaats van dat je hem elke mogelijke wedstrijd laat memoriseren.
  • Het "Zero-Shot" Wonder: In sommige tests kon CORE zelfs nieuwe soorten nepnieuws opsporen die het nooit eerder had gezien, simpelweg door het nieuws te lezen en te vragen: "Klopt dit wel?"

De Kern van het Verhaal

Het paper beweert dat door te focussen op de intrinsieke conflict (de logische tegenstrijdigheid) in plaats van op de specifieke visuele truc (de vervalsingstechniek), CORE een detector creëert die robuust, algemeen en niet afhankelijk is van een enorme bibliotheek aan data om nieuwe trucs te leren. Het verandert de computer in een kritische denker die vraagt: "Houdt dit verhaal stand?" in plaats van alleen maar: "Heb ik deze afbeelding eerder gezien?"

De onderzoekers hebben hun "Conflictbibliotheek" en hun code beschikbaar gesteld aan het publiek, in de hoop dat anderen deze "logica-gebaseerde detective" kunnen gebruiken om het internet eerlijk te houden.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →