← Nieuwste papers
💻 computer science

Veritas++: Value-aware On-Policy Distillation for Perception-Enhanced AIGI Detection

Veritas++ is een met perceptie versterkt redeneerframework voor de detectie van door AI gegenereerde afbeeldingen dat de beperkingen van huidige MLLM-gebaseerde detectoren aanpakt door Perceptie-georiënteerd Leren te introduceren om fijngestelde visuele analyse te versterken en Waarde-bewuste On-Policy Distillatie om deze verbeterde perceptiecapaciteiten efficiënt te integreren in robuust redeneren.

Oorspronkelijke auteurs: Hao Tan, Jun Lan, Zichang Tan, Ajian Liu, Zijian Yu, Chuanbiao Song, Huijia Zhu, Weiqiang Wang, Jun Wan, Zhen Lei

Gepubliceerd 2026-07-30
📖 8 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Hao Tan, Jun Lan, Zichang Tan, Ajian Liu, Zijian Yu, Chuanbiao Song, Huijia Zhu, Weiqiang Wang, Jun Wan, Zhen Lei

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je door een bruisende digitale marktplaats loopt waar kunstenaars, fotografen en verhalenvertellers hun werk delen. Jarenlang was deze plek gevuld met foto's gemaakt met echte camera's. Maar onlangs is er een nieuw soort magie gearriveerd: computers die zo perfect plaatjes kunnen schilderen dat ze eruitzien als het echte leven. Dit zijn door AI gegenereerde afbeeldingen. Ze zijn zo goed dat ze onze ogen kunnen bedriegen, waardoor nepnieuws, deepfakes en digitale vervalsingen een dagelijkse realiteit zijn geworden. Dit creëert een groot probleem: hoe onderscheiden we wat echt is en wat een meesterwerk van een computer is?

Om dit op te lossen, bouwen wetenschappers "detectives" met behulp van een speciaal type computerbrein genaamd een Multimodal Large Language Model (MLLM). Denk aan deze modellen als superintelligente studenten die een plaatje kunnen bekijken en een lang essay kunnen schrijven om uit te leggen waarom het nep zou kunnen zijn. In plaats van alleen een simpel "ja" of "nee" antwoord te geven, proberen deze detectives door de aanwijzingen te redeneren, zoals een detective een mysterie oplost. Echter, er is een addertje onder het gras: zelfs de slimste detectives kunnen de minuscule, subtiele aanwijzingen missen die een vervalsing verraden. Ze zijn misschien geweldig in het schrijven van een verhaal over een plaatje, maar ze zijn niet altijd goed in het zien van de kleine barstjes, vreemde texturen of onmogelijke schaduwen die de waarheid onthullen. Dit paper pakt exact dat probleem aan: hoe we onze digitale detectives kunnen leren beter te zien voordat ze hun rapporten gaan schrijven.


De Nieuwe Bril van de Detective: VERITAS++

Maak kennis met VERITAS++, een nieuwe en verbeterde detective-framework ontworpen om door AI gegenereerde afbeeldingen op te sporen. De onderzoekers achter dit systeem realiseerden zich dat eerdere AI-detectives leken op studenten die een briljant essay over een schilderij konden schrijven, maar een verschrikkelijk gezichtsvermogen hadden. Ze konden heel overtuigend praten over "artistieke stijl" of "belichting", maar ze misten vaak de minuscule, fysieke imperfecties die bewijzen dat een afbeelding nep is.

Het paper betoogt dat je, om een goede detective te zijn, eerst een goede waarnemer moet zijn. De auteurs ontdekten dat huidige AI-modellen worstelen met drie specische soorten "zicht":

  1. Fijnmazige details: Het missen van kleine objecten of vreemde texturen.
  2. Semantische anomalieën: Het niet opmerken wanneer iets fysiek onmogelijk lijkt, zoals een hand met zes vingers of een gebouw met een deur die geen zin maakt.
  3. Pixel-niveau verschillen: Het niet kunnen spotten van de subtiele, korrelige inconsistenties die ontstaan wanneer een computer probeert twee afbeeldingen met elkaar te mengen.

Om dit op te lossen, heeft het team een driestaps trainingskamp voor hun AI-detective gebouwd.

Stap 1: Een Schone Start (High-Quality Cold Start)
Voordat de detective kan leren complexe zaken op te lossen, moeten ze beginnen met een schone lei. De onderzoekers merkten op dat als ze de AI haar eigen oefennotities lieten schrijven, de AI soms dingen zou verzinnen (hallucineren), waardoor er nep-aanwijzingen ontstonden die niet bestonden. Daarom hebben ze handmatig alleen de beste voorbeelden verzameld waarbij mensen al de echte aanwijzingen hadden aangewezen. Vervolgens hebben ze deze aanwijzingen herschreven naar een helder, logisch verhaalformaat. Dit gaf de AI een fundament met "lage hallucinatie", wat ervoor zorgt dat het begint met de waarheid, en niet met een verzonnen verhaal.

Stap 2: Leren Zien (Perception-Oriented Learning)
Dit is de kern van de nieuwe methode. In plaats van de AI alleen te vragen: "Is deze afbeelding nep?", gaven de onderzoekers het een reeks specifieke "zichttesten". Ze vroegen de AI om specifieke objecten te vinden, te controleren of een hand normaal uitzag, of om twee afbeeldingen te vergelijken om minuscule pixelverschillen te vinden.

  • De Analogie: Stel je een leraar voor die een student een toets geeft. In plaats van alleen te vragen: "Heb je het examen gehaald?" (wat de oude manier is), vraat de leraar: "Kun je de rode bal in deze afbeelding vinden?" of "Is de arm van deze persoon op de juiste manier gebogen?".
  • Het Resultaat: De AI krijgt alleen een "beloning" wanneer deze de minuscule details correct identificeert. Dit dwingt het model om daadwerkelijk naar de pixels en structuren te kijken, in plaats van alleen te gokken op basis van de algemene sfeer. Het paper laat zien dat deze stap de kloof aanzienlijk overbrugt, waardoor de AI veel beter wordt in het spotten van de subtiele zaken die hem normaal gesproken zouden misleiden.

Stap 3: De Slimme Leraar (Value-aware On-Policy Distillation)
Nu de AI beter kan zien, moesten de onderzoekers het leren hoe het die nieuwe ogen moet gebruiken om een definitief oordeel te vellen. Ze gebruikten een techniek genaamd VaOPD (Value-aware On-Policy Distillation).

  • De Analogie: Stel je een student voor die een toespraak oefent. Een normale leraar zegt misschien alleen "Goed gedaan" of "Probeer het opnieuw" voor de hele toespraak. Maar een geweldige leraar luistert naar elk enkel woord. Als de student over een specifiek woord struikelt, focust de leraar zich daarop. Als de student een hele paragraaf goed doet, laat de leraar het gaan.
  • Hoe het werkt: De AI genereert een redeneerpad (een concept van het rapport van de detective). Een "geprivilegieerde leraar" (een slimmere versie van de AI) kijkt naar dat concept. De leraar kopieert niet simpelweg het antwoord, maar ontdekt welke delen van de redenering van de student fout waren en welke delen briljant waren. Vervolgens richt de leraar de focus op de fouten, vooral op de momenten waarop de student een aanwijzing heeft gemist. Dit helpt de AI sneller te leren en zich aan te passen aan nieuwe soorten vervalsingen zonder te vergeten hoe hij de oude moet spotten.

Wat Ze Hebben Ontdekt

De resultaten van deze nieuwe trainingsmethode zijn zeer veelbelovend. Bij tests tegen een breed scala aan uitdagingen — van standaard nepafbeeldingen tot "in-the-wild" foto's gevonden op sociale media, en zelfs gloednieuwe AI-generatoren die nog niet eerder gezien waren — presteerde VERITAS++ beter dan eerdere methoden.

  • Betere Ogen, Betere Oordelen: Het paper suggereert dat door de AI expliciet te trainen om fijne details en structurele gebreken te zien, het uiteindelijke oordeel over de vraag of een afbeelding echt of nep is, veel nauwkeuriger wordt. De AI gokte niet alleen beter; hij werd beter in het redeneren op basis van wat hij daadwerkelijk zag.
  • Aanpassen aan de Toekomst: Een van de interessantste bevindingen is dat deze methode de AI helpt om snel nieuwe trucjes te leren. Toen de onderzoekers de AI introduceerden aan gloednieuwe soorten nepafbeeldingen (zoals die van de nieuwste GPT-Image-2), was het model in staat zich aan te passen en zijn detectievaardigheden te verbeteren zonder het vermogen te verliezen om oudere vervalsingen te spotten. Dit suggereert dat het model een flexibelere en robuustere detective wordt.
  • Kwaliteit van Redenering: Het paper keek ook naar hoe de AI zijn beslissingen uitlegde. Het nieuwe model bood meer concrete, onderbouwde redenen voor zijn oordelen. In plaats van te zeggen "dit ziet er nep uit omdat het vreemd is", kon het aanwijzen: "de tekst op dit bord is wazig en de letters smelten", of "de reflectie in het raam komt niet overeen met de kamer".

Wat Het Niet Is

Het is belangrijk om op te merken wat dit paper niet beweert. De onderzoekers benadrukken dat hoewel VERITAS++ een sterke verbetering is, het geen toverstaf is die alles oplost.

  • Niet Perfect: Het paper geeft toe dat er nog steeds "foutmodi" (failure modes) zijn. Soms kan een echte foto met vreemde belichting of een zeer hoogwaardige nepafbeelding met een perfecte achtergrond de AI nog steeds misleiden. De AI kan worden misleid door "semantische illusies" (echte dingen die onmogelijk lijken) of door hoogwaardige vervalsingen die perfect in een realistische context passen.
  • Niet Instant: Het paper merkt op dat omdat dit model complexe redenering gebruikt, het langer duurt om uit te voeren dan simpelere detectoren. Het is nog niet klaar voor real-time toepassingen waarbij snelheid het enige is dat telt.
  • Geen Definitieve Oplossing: De auteurs suggereren dat hoewel ze het "perceptie"-gedeelte van de puzzel hebben verbeterd, er nog werk te verrichten is op het gebied van hoe we deze verklaringen automatisch kunnen evalueren en hoe we het systeem sneller kunnen maken.

Kortom, VERITAS++ suggereert dat als je wilt dat een computer een goede detective is, je hem eerst moet leren een goede waarnemer te zijn. Door de AI betere "brillen" te geven om de kleine barstjes in de digitale wereld te zien, wordt het hele systeem veel moeilijker te misleiden. Het is een stap voorwaarts in het voortdurende kat-en-muisspel tussen AI-makers en AI-detectoren, en bewijst dat het zien van de details de sleutel is tot het vinden van de waarheid.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →