← Nieuwste papers
🤖 machine learning

Vendi Novelty Scores for Out-of-Distribution Detection

Dit artikel introduceert de Vendi Novelty Score (VNS), een lineaire, niet-parametrische out-of-distribution-detectormethode die diversiteitsmetrieken benut om state-of-the-art-prestaties te behalen op diverse benchmarks, terwijl deze effectief blijft zelfs met minimale trainingsdata.

Oorspronkelijke auteurs: Amey P. Pasarkar, Adji Bousso Dieng

Gepubliceerd 2026-05-22
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Amey P. Pasarkar, Adji Bousso Dieng

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een zeer slimme, hoogopgeleide beveiligingsagent hebt bij de ingang van een museum. Deze agent heeft jarenlang duizenden schilderijen uit de Renaissance bestudeerd. Ze kan je direct vertellen of een nieuw schilderij een echte Rembrandt is of een vervalsing. Maar wat gebeurt er als iemand met een foto van een broodrooster, een cartoonkat of een moderne abstracte sculptuur naar voren komt?

De agent zou nog steeds kunnen zeggen: "Ik ben 99% zeker dat dit een schilderij is!" omdat ze zo zeker is van haar opleiding, zelfs al heeft ze het volledig bij het verkeerde eind. In de wereld van Kunstmatige Intelligentie heet dit een Out-of-Distribution (OOD)-probleem. De AI ziet iets dat ze nog nooit heeft gezien, maar ze weet niet dat ze in de war is.

Dit artikel introduceert een nieuw hulpmiddel genaamd Vendi Novelty Score (VNS) om AI-systemen te helpen beseffen wanneer ze naar iets totaal vreemds kijken. Hier is hoe het werkt, uitgelegd via eenvoudige analogieën.

De Oude Manier: Gissen naar Zekerheid

De meeste huidige methoden proberen deze "vreemdelingen" te detecteren door de AI te vragen: "Hoe zeker ben je?"

  • De Tekortkoming: Als de AI is getraind op katten en honden, en je laat haar een broodrooster zien, kan ze zich nog steeds zeer zeker voelen omdat de broodrooster enkele visuele kenmerken (zoals randen of kleuren) deelt met een katoor. Het is alsof een agent die zo gewend is aan rode jassen, een rode brandkraan voor een persoon aanziet.

De Nieuwe Manier: Meten van "Menigtediversiteit"

De auteurs van dit artikel besloten te stoppen met vragen "Hoe zeker ben je?" en te beginnen met vragen: "Hoeveel verandert deze nieuwe persoon de menigte?"

Ze gebruiken een concept genaamd Vendi Score, wat in feite een verfijnde manier is om diversiteit te meten.

De Analogie: De Gastenlijst van het Feest

Stel je voor dat de AI een geheugen heeft van alle mensen die ze heeft ontmoet (de trainingsdata).

  • De In-Distribution (ID)-Menigte: Dit zijn de mensen die de AI goed kent. Ze zijn gegroepeerd in "cliques" (zoals een groep van allemaal roodharigen, een groep van allemaal lange mensen, enz.).
  • De Testsample: Een nieuwe persoon komt binnen.

Hoe VNS werkt:

  1. De Lokale Check (De Clique): De AI kijkt naar de specifieke clique waar de nieuwe persoon misschien toe zou kunnen behoren (bijv. "Is deze persoon roodharig?"). Ze vraagt: "Als we deze nieuwe persoon toevoegen aan de roodharigengroep, wordt de groep dan diverser of repetitiever?"

    • Als de nieuwe persoon een roodharige is met een unieke kapsel, wordt de groep diverser.
    • Als de nieuwe persoon een roodharige is die er precies uitziet als iedereen anders, verandert de groep niet veel.
    • De Twist: Als de nieuwe persoon eigenlijk een broodrooster is (of een cartoonkat), creëert het toevoegen aan de "roodharigengroep" een vreemde, schokkende mix. De "diversiteitsscore" schiet omhoog omdat de broodrooster helemaal niet in het patroon past.
  2. De Globale Check (Het Hele Feest): De AI kijkt ook naar het hele feest. "Als we deze broodrooster toevoegen aan de hele kamer, voelt de kamer dan chaotisch?"

    • VNS berekent hoeveel het nieuwe sample de algehele harmonie van de data verstoort.
  3. De Eindscore: De AI combineert deze twee checks. Als het nieuwe sample de lokale groep vreemd maakt en het hele feest chaotisch, gaat de Vendi Novelty Score omhoog. Een hoge score betekent: "Hé, dit hoort hier niet thuis! We moeten voorzichtig zijn."

Waarom Dit Een Groot Ding Is

Het artikel beweert dat deze methode een gamechanger is om drie hoofdredenen:

1. Het is Snel en Lichtgewicht
Het berekenen van diversiteit vereist meestal zware wiskunde die lang duurt (zoals het controleren van elke enkele persoon in een stadion tegen elke andere persoon).

  • De Truc van het Artikel: Ze vonden een shortcut. In plaats van naar de hele menigte te kijken, kijken ze alleen naar de "belangrijkste" persoon in de groep (het wiskundige equivalent van de "hoofdleider" van de clique).
  • Het Resultaat: Het is ongelooflijk snel. Het artikel toont aan dat het bijna net zo snel werkt als de eenvoudigste methoden, waardoor het praktisch is voor gebruik in real-time (zoals in zelfrijdende auto's).

2. Het Heeft Geen Volledig Geheugen Nodig
Meestal moet je, om te controleren of iets nieuw is, elk enkele voorbeeld dat je ooit hebt gezien onthouden. Dat neemt veel computergeheugen in beslag.

  • De Claim van het Artikel: VNS werkt verbluffend goed zelfs als je er slechts 1% van de trainingsdata laat zien. Het is alsof een beveiligingsagent een vreemdeling kan opsporen zelfs als ze zich maar 1% van de mensen die ze hebben ontmoet herinnert, omdat ze de structuur van de menigte begrijpt, niet alleen de gezichten.

3. Het Werkt Overal
De auteurs hebben dit getest op veel verschillende soorten AI-"hersenen" (architecturen) en veel verschillende soorten "musea" (datasets zoals CIFAR-10, CIFAR-100 en ImageNet).

  • Het Resultaat: VNS sloeg consequent de beste bestaande methoden of kwam er gelijk mee. Het was bijzonder goed in het opsporen van "Near-OOD"-items: dingen die er bijna uitzien als wat de AI kent, maar niet helemaal kloppen (zoals een foto van een hond die een beetje op een wolf lijkt).

Samenvatting

De Vendi Novelty Score is een nieuwe manier om een AI te vertellen wanneer ze buiten haar diepte is. In plaats van alleen te vragen "Weet je het zeker?", vraagt het: "Past dit nieuwe ding in het patroon van de groep?"

Door te meten hoeveel een nieuw sample de diversiteit van het geheugen van de AI verstoort, kan het vreemdelingen (zoals broodroosters in een kattemuseum) met hoge nauwkeurigheid opsporen, met zeer weinig geheugen en zeer snel. Dit helpt AI-systemen veilig te houden door te weten wanneer ze moeten zeggen: "Ik weet niet wat dit is, laat een mens dit afhandelen."

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →