← Neueste Arbeiten
🤖 machine learning

KANLib -- An Modular, Extensible and Fast Kolmogorov-Arnold Network Implementation

Dieses Paper führt KANLib ein, ein modulares, erweiterbares und recheneffizientes, auf PyTorch basierendes Framework, das bestehende Implementierungen von Kolmogorov-Arnold-Netzwerken vereinheitlicht, um eine flexible Forschung und eine hochperformante Evaluierung von KAN-Architekturen zu erleichtern.

Ursprüngliche Autoren: Julian Hoever, Gregor Schiele

Veröffentlicht 2026-06-17
📖 4 Min. Lesezeit☕ Kaffeepausen-Lektüre

Ursprüngliche Autoren: Julian Hoever, Gregor Schiele

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, Sie versuchen einem Computer beizubringen, die Welt zu verstehen. Lange Zeit haben wir ein Standardwerkzeug namens Multilayer Perceptron (MLP) verwendet. Denken Sie an ein MLP wie an eine Fabrik-Montagebandstraße, bei der jeder Arbeiter (Neuron) eine Reihe von Eingaben erhält, diese mit einem festen Rezept (einem linearen Gewicht) mischt und das Ergebnis dann durch einen einzigen, unveränderlichen Filter (eine Aktivierungsfunktion wie ReLU) leitet. Es funktioniert gut, aber es ist starr. Man kann nicht einfach sehen, wie die Fabrik zu einer Entscheidung gelangt ist, da das „Rezept“ nur eine Zahl ist und der Filter für jeden gleich ist.

Hier kommen Kolmogorov-Arnold-Netzwerke (KANs) ins Spiel. Das Paper stellt eine neue Art vor, diese Fabriken zu bauen. Anstatt einen festen Filter zu verwenden, geben KANs jeder einzelnen Verbindung zwischen den Arbeitern ihr eigenes, anpassbares, formveränderndes Werkzeug. Stellen Sie sich vor, anstatt eines statischen Filters hat jede Leitung in der Fabrik einen flexiblen Schlauch, der sich genau so dehnen, biegen und krümmen kann, wie er es braucht, um die Aufgabe zu erfüllen. Dies macht das Netzwerk wesentlich transparenter (man kann die Form des Schlauchs sehen) und potenziell leistungsfähiger darin, komplexe Muster zu finden.

Es gibt jedoch einen Haken. Das Bauen dieser flexiblen Schläuche ist rechenintensiv und mühsam. Verschiedene Forschungsteams haben ihre eigenen Versionen von KANs entwickelt (wie PyKAN, EfficientKAN und FastKAN), aber sie sprechen unterschiedliche Sprachen, benutzen unterschiedliche Werkzeuge und können oft nicht miteinander kommunizieren. Das eine ist vielleicht schnell, aber arm an Funktionen; ein anderes ist vielleicht funktionsreich, aber langsam.

Die Lösung: KANLib

Die Autoren dieses Papers haben KANLib entwickelt, das sie als „universellen Adapter“ oder „Schweizer Taschenmesser“ für Kän beschreiben.

Hier ist, was KANLib tut, unter Verwendung einfacher Analogien:

  1. Es vereinheitlicht das Chaos: Genau wie eine Universal-Steckdose es ermöglicht, Geräte aus verschiedenen Ländern einzustecken, nimmt KANLib die besten Ideen aus den drei wichtigsten bestehenden KAN-Frameworks und kombiniert sie zu einem konsistenten System. Sie können zwischen verschiedenen Arten von „Schläuchen“ (mathematischen Funktionen namens B-Splines und Gaußschen Radialbasis-Funktionen) wechseln, ohne Ihren gesamten Code neu schreiben zu müssen.
  2. Es ist modular und flexibel: Betrachten Sie KANLib wie ein Lego-Set. Sie können verschiedene Schichten zusammenstecken, bestimmte Funktionen ein- oder ausschalten (wie das Entfernen eines „Residual-Zweigs“ oder eines „Gewichts“) und die Architektur leicht experimentell verändern. Es ermöglicht Forschern, „Was-wäre-wenn“-Szenarien zu testen, ohne in technischen Details stecken zu bleiben.
  3. Es ist schnell und intelligent: Die Autoren haben die Dinge nicht nur kombiniert; sie haben sie optimiert.
    • Raster-Reskalierung (Grid Rescaling): Stellen Sie sich vor, Sie zeichnen eine Karte. Wenn Sie mit einem niedrig auflösenden Raster beginnen, könnten Sie kleine Details übersehen. KANLib kann automatisch „hineinzoomen“ (das Raster verfeinern) in Bereichen, in denen die Daten dicht gedrängt sind, was die Karte genauer macht, ohne von vorne beginnen zu müssen.
    • Raster-Erweiterung (Grid Extension): Es kann auch mehr Rasterpunkte hinzufügen, während es lernt, wodurch das Netzwerk im Laufe der Zeit immer feinere Details erfassen kann.

Was sie getestet haben

Um zu sehen, ob KANLib tatsächlich funktioniert, ließen die Autoren ein Rennen auf einem Standarddatensatz namens California Housing (Vorhersage von Hauspreisen basierend auf Dingen wie Einkommen und Zimmeranzahl) laufen.

  • Das Rennen: Sie verglichen KANLib mit dem ursprünglichen PyKAN, dem schnelleren EfficientKAN und dem sehr schnellen FastKAN.
  • Die Ergebnisse:
    • Genauigkeit: KANLib war genauso gut wie die besten existierenden Modelle. Tatsächlich war seine B-Spline-Version in ihren Tests am genauesten und sagte Hauspreise mit sehr geringem Fehler voraus.
    • Geschwindigkeit: KANLib war signifikant schneller als das ursprüngliche PyKAN (etwa 30 % schneller), da es die Geschwindigkeits-Tricks von EfficientKAN übernommen hatte.
    • Der Kompromiss: Wenn KANLib die „Gaußsche RBF“-Methode verwendete (die normalerweise die schnellste ist), war es immer noch etwas langsamer als das dedizierte FastKAN-Tool. Die Autoren geben zu, dass dies daran liegt, dass ihre Version darauf ausgelegt ist, flexibel zu sein und fortgeschrittene Funktionen wie das „Hineinzoomen“ in das Raster zu unterstützen, was ein kleines bisschen zusätzliche Arbeit bedeutet.

Das Fazit

Das Paper kommt zu dem Schluss, dass KANLib ein robustes, zuverlässiges Fundament für die zukünftige Forschung ist. Es beweist, dass man sich nicht zwischen Geschwindigkeit und Funktionen entscheiden muss. Man kann ein Framework haben, das:

  • Modular ist: Leicht anzupassen und erweiterbar.
  • Schnell ist: Wettbewerbsfähig mit den schnellsten existierenden Tools.
  • Genau ist: In der Lage, die Leistung etablierter Modelle zu erreichen oder zu übertreffen.

Im Wesentlichen beseitigt KANLib die Reibungsverluste in der KAN-Forschung und ermöglicht es Wissenschaftlern, sich auf die Entdeckung neuer, besserer Netzwerkarchitekturen zu konzentrieren, anstatt mit inkompatiblem Code zu kämpfen. Die Autoren erwähnen auch, dass sich die zukünftige Arbeit darauf konzentrieren wird, die „Gaußsche“ Version noch schneller zu machen und diese Netzwerke potenziell auf zeitbasierte Daten wie Herzschläge (EKG) oder Gehirnwellen (EEG) anzuwenden.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →