← Neueste Arbeiten
💻 computer science

NeSyCat Torch: A Differentiable Tensor Implementation of Categorical Semantics for Neurosymbolic Learning

NeSyCat Torch vereinheitlicht diverse neurosymbolische Semantiken unter einem einzigen monadischen Framework, indem es ein differenzierbares Tensor-basiertes Training über ein latentes Log-Tensor-Monad implementiert, wodurch es im Vergleich zu bestehenden Systemen eine überlegene Geschwindigkeit und Genauigkeit bei der MNIST-Addition erreicht, während es gleichzeitig eine einheitliche Struktur beibehält, die an verschiedene Prädikatenlogik-Ansätze anpassbar ist.

Ursprüngliche Autoren: Daniel Romero Schellhorn, Till Mossakowski, Björn Gehrke

Veröffentlicht 2026-06-19
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Daniel Romero Schellhorn, Till Mossakowski, Björn Gehrke

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Das große Problem: Zu viele Sprachen

Stellen Sie sich vor, Sie haben ein Team von Experten, die versuchen, einem Roboter beizubringen, wie man denkt.

  • Der klassische Experte spricht in strenger „Ja/Nein“-Logik.
  • Der Fuzzy-Experte spricht in „Vielleicht“ oder „So lala“.
  • Der probabilistische Experte spricht in Prozentsätzen und Wahrscheinlichkeiten.
  • Der neuronale Experte (die KI) lernt, indem er Bilder betrachtet und Muster errät.

Das Problem ist, dass diese Experten alle verschiedene Sprachen sprechen. Sie haben unterschiedliche Regeln dafür, was als „wahr“ gilt. Wenn der klassische Experte eine Regel schreibt, kann der probabilistische Experte sie nicht verstehen, und der neuronale Experte kann nicht von ihr lernen. Dies nennt man Fragmentierung.

Die Lösung: Ein universeller Übersetzer (NeSyCat)

Die Autoren haben zuvor einen „universellen Übersetzer“ namens NeSyCat entwickelt. Betrachten Sie dies als einen Master-Bauplan, der die Sprache all dieser Experten in ein einziges, einheitliches Regelwerk übersetzen kann. Er verwendet ein mathematisches Werkzeug namens Monade (die man sich als „Container“ oder „Wrapper“ vorstellen kann), um die Logik zu halten.

Doch bis jetzt hatte dieser Übersetzer ein fehlendes Teil: Er konnte zwar die Regeln beschreiben, aber er konnte dem neuronalen Experten (der KI) nicht wirklich beibringen, wie man sie lernt. Es war, als hätte man einen Bauplan für ein Auto, aber keinen Motor.

Hier kommt NeSyCat Torch: Der Motor

NeSyCat Torch ist der fehlende Motor. Er nimmt diesen universellen Bauplan und steckt ihn direkt in moderne KI-Werkzeuge (wie PyTorch und JAX). Er ermöglicht es der KI, aus den Regeln zu lernen, anstatt nur zu raten.

So funktioniert es, unterteilt in drei einfache Ebenen:

1. Der „träge“ Buchhalter (Das Trainings-Monad)

Wenn eine KI lernt, macht sie viel Mathematik. Wenn man versucht, jede einzelne Möglichkeit auf einmal zu berechnen, werden die Zahlen unübersichtlich und der Computer stürzt ab (oder braucht ewig).

  • Die Analogie: Stellen Sie sich einen Koch vor, der eine Suppe probiert. Wenn er jedes einzelne Salzkorn einzeln probieren müsste, würde er niemals fertig werden. Stattdessen probiert er den ganzen Topf auf einmal.
  • Der Trick des Papers: Die Autoren verwenden einen „faulen“ (lazy) Ansatz. Sie berechnen nicht sofort die Wahrscheinlichkeit für jedes einzelne Ergebnis. Sie warten bis ganz am Ende, um die Mathematik zu betreiben. Sie verwenden einen speziellen „Log-Tensor“-Container, der die Zahlen stabil und leicht handhabbar hält – so als würde man ein Rezept in einem Notizbuch aufbewahren, das nur dann aktualisiert wird, wenn man tatsächlich kocht.

2. Das „Batch“-Förderband (Das Batch-Monad)

Normalerweise lernt eine KI, indem sie sich ein Bild ansieht, eine Vermutung anstellt und dann zum nächsten Bild übergeht. Das ist langsam.

  • Die Analogie: Stellen Sie sich eine Fabrikstraße vor. Anstatt jedes Auto einzeln zu inspizieren, legt man 32 Autos auf ein Förderband und inspiziert sie alle gleichzeitig.
  • Der Trick des Papers: Sie verwenden ein „Batch-Monad“, um eine ganze Gruppe von Daten (einen Mini-Batch) zusammenzufassen. Die KI verarbeitet die ganze Gruppe auf einmal, was das Training unglaublich schnell macht.

3. Die „Zwei-Wege“-Brücke

Das System muss mit dem neuronalen Netzwerk (das verschwommene Bilder sieht) und den Logikregeln (die klare Antworten benötigen) kommunizieren.

  • Die Analogie: Denken Sie an einen Übersetzer, der sowohl „verschwommene Bilder“ als auch „klare Logik“ spricht.
  • Der Trick des Papers: Sie haben eine Brücke gebaut. Wenn die KI ein verschwommenes Bild einer „7“ sieht, rät sie nicht einfach „7“. Sie erstellt eine „Wolke von Möglichkeiten“ (eine Wahrscheinlichkeitsverteilung). Das System nutzt dann Mathematik, um diese Wolken zu kombinieren (wie das Mischen von Farben), um zu sehen, ob das Endergebnis mit der Regel übereinstimmt (z. B. „Ist dieses Bild plus jenes Bild gleich 15?“).

Der Test: Hinzufügen von handgeschriebenen Ziffern

Um zu beweisen, dass es funktioniert, testeten die Autoren das System an einer klassischen Aufgabe: MNIST-Addition.

  • Die Aufgabe: Zeigen Sie der KI zwei handgeschriebene Zahlen (wie eine 3 und eine 4), aber verstecken Sie die Zahlen selbst. Die KI sieht nur die Summe (7).
  • Das Ziel: Die KI muss lernen, die einzelnen Ziffern zu erkennen, indem sie nur weiß, was sie addieren.
  • Das Ergebnis: Die KI lernte, die Ziffern mit einer Genauigkeit von etwa 97 % zu erkennen.

Warum es eine große Sache ist (Die Ergebnisse)

Die Autoren verglichen NeSyCat Torch mit anderen berühmten KI-Logiksystemen (wie LTN und DeepProbLog).

  • Geschwindigkeit: Es war viel schneller. Während andere Systeme bei schwierigeren Problemen Zeitüberschreitungen hatten oder stecken blieben, lief NeSyCat Torch reibungslos weiter.
  • Genauigkeit: Es war genauer als LTN und DeepProbLog und fast so genau wie das sehr beste System (DeepStochLog).
  • Flexibilität: Das Beste daran ist, dass man, da es auf diesem „universellen Übersetzer“ (dem Monad) basiert, den „Container“ austauschen kann, um die Art und Weise zu ändern, wie die KI denkt. Man kann von „Wahrscheinlichkeiten“ zu „Fuzzy-Logik“ wechseln, indem man nur eine Einstellung im Code ändert, ohne das gesamte Programm neu zu schreiben.

Zusammenfassung

NeSyCat Torch ist ein neuer Weg, KI zu bauen, die strikte Logik mit flexiblem Lernen kombiniert. Es nutzt einen cleveren „faulen“ Mathematik-Trick, um sich nicht in Berechnungen zu verzetteln, und einen „Batching“-Trick, um Daten schnell zu verarbeiten. Es hat bewiesen, dass man einer KI beibringen kann, handgeschriebene Zahlen zu erkennen, indem man ihr lediglich die Regeln der Addition gibt – und das schneller und genauer als bisherige Methoden.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →