← Neueste Arbeiten
🤖 machine learning

Vendi Novelty Scores for Out-of-Distribution Detection

Dieser Beitrag stellt den Vendi Novelty Score (VNS) vor, einen nicht-parametrischen Out-of-Distribution-Detektor mit linearer Laufzeit, der Diversitätsmetriken nutzt, um über verschiedene Benchmarks hinweg State-of-the-Art-Leistung zu erzielen und dabei auch mit minimalen Trainingsdaten effektiv bleibt.

Ursprüngliche Autoren: Amey P. Pasarkar, Adji Bousso Dieng

Veröffentlicht 2026-05-22
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Amey P. Pasarkar, Adji Bousso Dieng

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, Sie hätten einen sehr klugen, hochqualifizierten Sicherheitsbeamten am Eingang eines Museums. Dieser Beamte hat Jahre damit verbracht, Tausende von Gemälden aus der Renaissance zu studieren. Er kann Ihnen sofort sagen, ob ein neues Gemälde ein echtes Rembrandt oder eine Fälschung ist. Doch was passiert, wenn jemand mit einem Bild eines Toasters, einer Cartoon-Katze oder einer modernen abstrakten Skulptur auf ihn zukommt?

Der Wache könnte trotzdem sagen: „Ich bin zu 99 % sicher, dass dies ein Gemälde ist!", weil er so sehr auf seine Ausbildung vertraut, obwohl er völlig falsch liegt. In der Welt der Künstlichen Intelligenz nennt man dies ein Out-of-Distribution (OOD)-Problem. Die KI sieht etwas, das sie noch nie gesehen hat, weiß aber nicht, dass sie verwirrt ist.

Diese Arbeit stellt ein neues Werkzeug vor, das Vendi Novelty Score (VNS) genannt wird, um KI-Systeme dabei zu unterstützen, zu erkennen, wenn sie etwas völlig Fremdes betrachten. Hier ist die Funktionsweise, erklärt durch einfache Analogien.

Der alte Weg: Vertrauenswürdigkeit raten

Die meisten aktuellen Methoden versuchen, diese „Fremden" zu erkennen, indem sie die KI fragen: „Wie sicher sind Sie?"

  • Der Fehler: Wenn die KI auf Katzen und Hunde trainiert wurde und Sie ihr einen Toaster zeigen, könnte sie sich trotzdem sehr sicher fühlen, weil der Toaster einige visuelle Merkmale (wie Kanten oder Farben) mit einem Katzenohr teilt. Es ist wie ein Wache, der so sehr an rote Mäntel gewöhnt ist, dass er einen roten Feuerhydranten für eine Person hält.

Der neue Weg: „Vielfalt der Menge" messen

Die Autoren dieser Arbeit haben beschlossen, nicht mehr zu fragen: „Wie sicher sind Sie?", sondern stattdessen: „Wie stark verändert dieser neue Mensch die Menge?"

Sie verwenden ein Konzept namens Vendi Score, das im Grunde eine ausgefeilte Methode zur Messung von Vielfalt ist.

Die Analogie: Die Gästeliste einer Party

Stellen Sie sich vor, die KI hat eine Erinnerung an alle Menschen, die sie getroffen hat (die Trainingsdaten).

  • Die In-Distribution (ID)-Menge: Das sind die Menschen, die die KI gut kennt. Sie sind in „Cliquen" gruppiert (wie eine Gruppe aller Rothaarigen, eine Gruppe aller großen Menschen usw.).
  • Die Testprobe: Eine neue Person betritt den Raum.

Wie VNS funktioniert:

  1. Der lokale Check (Die Clique): Die KI betrachtet die spezifische Clique, der die neue Person vielleicht angehören könnte (z. B. „Ist diese Person rothaarig?"). Sie fragt: „Wenn wir diese neue Person zur Gruppe der Rothaarigen hinzufügen, wird die Gruppe vielfältiger oder repetitiver?"

    • Wenn die neue Person rothaarig ist und eine einzigartige Frisur hat, wird die Gruppe vielfältiger.
    • Wenn die neue Person rothaarig ist und genau wie alle anderen aussieht, ändert sich die Gruppe kaum.
    • Der Twist: Wenn die neue Person tatsächlich ein Toaster (oder eine Cartoon-Katze) ist, erzeugt das Hinzufügen zur „rothaarigen" Gruppe eine seltsame, störende Mischung. Der „Vielfaltscore" schießt in die Höhe, weil der Toaster überhaupt nicht in das Muster passt.
  2. Der globale Check (Die ganze Party): Die KI betrachtet auch die gesamte Party. „Wenn wir diesen Toaster zum ganzen Raum hinzufügen, wirkt der Raum dann chaotisch?"

    • VNS berechnet, wie stark die neue Probe die allgemeine Harmonie der Daten stört.
  3. Der Endscore: Die KI kombiniert diese beiden Checks. Wenn die neue Probe die lokale Gruppe seltsam und die globale Party chaotisch macht, steigt der Vendi Novelty Score. Ein hoher Score bedeutet: „Hey, das gehört hier nicht hin! Wir sollten vorsichtig sein."

Warum dies eine große Sache ist

Die Arbeit behauptet, dass diese Methode aus drei Hauptgründen ein Wendepunkt ist:

1. Es ist schnell und leichtgewichtig
Die Berechnung von Vielfalt erfordert normalerweise schwere Mathematik, die viel Zeit in Anspruch nimmt (wie das Abgleichen jedes einzelnen Menschen in einem Stadion mit jedem anderen).

  • Der Trick der Arbeit: Sie haben einen Abkürzungsweg gefunden. Anstatt die gesamte Menge zu betrachten, schauen sie nur auf die „wichtigste" Person in der Gruppe (das mathematische Äquivalent des „Hauptanführers" der Clique).
  • Das Ergebnis: Es ist unglaublich schnell. Die Arbeit zeigt, dass es fast genauso schnell läuft wie die einfachsten Methoden, was es für den Echtzeiteinsatz praktikabel macht (wie bei autonomen Fahrzeugen).

2. Es benötigt kein vollständiges Gedächtnis
Normalerweise müssen Sie, um zu prüfen, ob etwas neu ist, jedes einzelne Beispiel merken, das Sie je gesehen haben. Das beansprucht viel Computerspeicher.

  • Die Behauptung der Arbeit: VNS funktioniert erstaunlich gut, selbst wenn Sie ihr nur 1 % der Trainingsdaten zeigen. Es ist wie ein Sicherheitsbeamter, der einen Fremden erkennen kann, auch wenn er sich nur an 1 % der Menschen erinnert, die er getroffen hat, weil er die Struktur der Menge versteht und nicht nur die Gesichter.

3. Es funktioniert überall
Die Autoren haben dies an vielen verschiedenen Arten von KI-„Gehirnen" (Architekturen) und vielen verschiedenen Arten von „Museen" (Datensätzen wie CIFAR-10, CIFAR-100 und ImageNet) getestet.

  • Das Ergebnis: VNS hat die besten bestehenden Methoden konsequent geschlagen oder gleichgezogen. Es war besonders gut darin, „Near-OOD"-Objekte zu erkennen – Dinge, die fast so aussehen wie das, was die KI kennt, aber nicht ganz richtig sind (wie ein Bild eines Hundes, das ein bisschen wie ein Wolf aussieht).

Zusammenfassung

Der Vendi Novelty Score ist eine neue Möglichkeit, einer KI mitzuteilen, wenn sie überfordert ist. Anstatt nur zu fragen: „Sind Sie sicher?", fragt er: „Passt dieses neue Ding in das Muster der Gruppe?"

Indem gemessen wird, wie stark eine neue Probe die Vielfalt des Gedächtnisses der KI stört, kann sie Fremde (wie Toaster in einem Katzenmuseum) mit hoher Genauigkeit erkennen, dabei sehr wenig Speicherplatz verbrauchen und sehr schnell arbeiten. Dies hilft, KI-Systeme sicher zu halten, indem sie wissen, wann sie sagen müssen: „Ich weiß nicht, was das ist, lassen Sie einen Menschen damit umgehen."

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →