← Neueste Arbeiten
🤖 machine learning

Skill Neologisms: Towards Skill-based Continual Learning

Dieser Artikel schlägt „Fertigkeitsneologismen" vor, optimierte Soft-Tokens, die in das Vokabular eines LLM integriert werden, als skalierbare Lösung für kontinuierliches Lernen, die es dem Modell ermöglicht, neue Fertigkeiten zu erwerben und zu kombinieren, ohne Gewichtsaktualisierungen oder katastrophales Vergessen.

Ursprüngliche Autoren: Antonin Berthon, Nicolas Astorga, Mihaela van der Schaar

Veröffentlicht 2026-05-07
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Antonin Berthon, Nicolas Astorga, Mihaela van der Schaar

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, Sie haben eine brillante, gut informierte Bibliothekarin (das Large Language Model), die viele Dinge beherrscht: Bücher sortieren, Zahlen berechnen, Gedichte schreiben und Sprachen übersetzen. Doch was, wenn Sie dieser Bibliothekarin einen brandneuen Trick beibringen möchten, wie etwa „Bücher nach Farbe sortieren", ohne dass sie vergisst, wie man nach Autor sortiert oder Zahlen berechnet?

Dies ist das Problem, das die Arbeit angeht. Normalerweise beinhaltet das Beibringen eines neuen Tricks das erneute Trainieren des gesamten Gehirns der Bibliothekarin, was das Risiko birgt, dass sie alte Fähigkeiten vergisst (ein Problem, das als „katastrophales Vergessen" bekannt ist) oder einfach verwirrt wird.

Die Autoren schlagen eine clevere Lösung vor, die als „Skill Neologisms" (Fertigkeits-Neologismen) bezeichnet wird.

So funktioniert es, aufgeteilt in einfache Konzepte:

1. Das Problem: Die „Alles-oder-Nichts"-Falle

  • Der alte Weg (Fine-tuning): Stellen Sie sich vor, Sie versuchen, der Bibliothekarin eine neue Fähigkeit beizubringen, indem Sie ihre gesamte Enzyklopädie umschreiben. Es funktioniert, aber Sie könnten versehentlich die Seite über „nach Autor sortieren" auslöschen.
  • Der „Prompt"-Weg: Stellen Sie sich vor, Sie flüstern der Bibliothekarin vor Beginn der Arbeit Anweisungen zu („Bitte nach Farbe sortieren"). Dies funktioniert für eine spezifische Aufgabe, aber die Anweisungen sind an diesen spezifischen Job gebunden. Sie können „nach Farbe sortieren" nicht einfach mit „Zahlen berechnen" kombinieren, indem Sie einfach zwei verschiedene Dinge gleichzeitig flüstern.

2. Die Lösung: „Skill Neologisms" (Neue Zauberwörter)

Die Autoren schlagen vor, der Bibliothekarin ein neues Vokabelwort (ein „Neologismus") zu geben, das wie ein magischer Schalter funktioniert.

  • Das Konzept: Anstatt das Gehirn der Bibliothekarin umzuschreiben, fügen Sie ihrem Wörterbuch ein neues, unsichtbares „soft token" (ein spezielles digitales Wort) hinzu.
  • Wie es gelernt wird: Sie zeigen der Bibliothekarin Tausende von Beispielen, bei denen dieses neue Wort zusammen mit der Aufgabe erscheint, die sie lernen soll (z. B. „ColorSort"). Sie trainieren nur dieses neue Wort, um die Aufgabe zu verstehen, und lassen das ursprüngliche Gehirn der Bibliothekarin vollständig eingefroren und unberührt.
  • Das Ergebnis: Wenn Sie das Wort „ColorSort" in einem Prompt verwenden, weiß die Bibliothekarin sofort, wie sie diese spezifische Aufgabe ausführt, ohne etwas anderes neu lernen zu müssen.

3. Die Superkraft: Kombinieren und Zusammenstellen (Komposition)

Die wahre Magie geschieht, wenn Sie diese neuen Wörter kombinieren.

  • Die Analogie: Stellen Sie sich vor, die Bibliothekarin hat eine Reihe von Lego-Steinen. Einige Steine sind alt (Fähigkeiten, die sie bereits kennt). Die Autoren erstellen neue, maßgeschneiderte Lego-Steine (die Neologismen) für neue Fähigkeiten.
  • Die Behauptung: Die Arbeit zeigt, dass Sie, wenn Sie der Bibliothekarin zwei neue Fähigkeiten separat beibringen (z. B. „ColorSort" und „SizeSort"), ihr später einen Prompt mit beiden Wörtern geben können („ColorSort" + „SizeSort"), und die Bibliothekarin herausfinden kann, wie sie beides gleichzeitig ausführt, obwohl sie nie auf diese spezifische Kombination trainiert wurde.
  • Warum dies wichtig ist: Dies bedeutet, dass Sie eine Bibliothek von Fähigkeiten aufbauen können. Sie können heute eine neue Fähigkeit lernen, morgen eine andere und diese später kombinieren, ohne jemals das gesamte System neu trainieren zu müssen.

4. Was sie tatsächlich bewiesen haben

Die Forscher testeten diese Idee in einer kontrollierten, „mathähnlichen" Umgebung (noch nicht mit realen menschlichen Gesprächen). Sie schufen eine digitale Bibliothekarin und brachten ihr neue Wege bei, Zahlen zu manipulieren.

  • Sie stellten fest:
    • Kein Vergessen: Die Bibliothekarin vergaß alte Fähigkeiten nicht, wenn sie neue lernte.
    • Kombinieren funktioniert: Die Bibliothekarin konnte eine neu erlernte Fähigkeit mit einer alten Fähigkeit kombinieren, die sie noch nie kombiniert gesehen hatte.
    • Zero-Shot-Kombinieren: Sie konnten Fähigkeit A und Fähigkeit B separat lehren und sie dann sofort kombinieren, ohne zusätzliches Training.
    • Der „Sweet Spot": Sie fanden heraus, dass die neuen „Zauberwörter" nicht zu lang oder zu komplex sein sollten. Wenn das Wort zu groß ist, gerät die Bibliothekarin in Verwirrung und vergisst, wie sie es mit anderen Fähigkeiten kombiniert. Ein kleines, fokussiertes Wort funktioniert am besten.

5. Der Haken (Einschränkungen)

Die Arbeit ist ehrlich darüber, was dies noch nicht leistet:

  • Es ist noch ein Prototyp: Sie testeten dies an einer kleinen, synthetischen mathematischen Aufgabe, nicht beim Schreiben von Romanen oder beim Diagnostizieren von Krankheiten.
  • Sie benötigen die richtigen Daten: Um eine neue Fähigkeit zu lehren, benötigen Sie einen Datensatz, bei dem jedes einzelne Beispiel diese spezifische Fähigkeit erfordert. Wenn die Daten unordentlich sind, lernt das neue „Zauberwort" nicht richtig.
  • Es ist nicht kostenlos: Obwohl es im Vergleich zum Umschreiben des gesamten Gehirns Speicherplatz spart, erfordert das Trainieren dieser neuen Wörter dennoch erhebliche Rechenleistung.

Zusammenfassung

Denken Sie an Skill Neologisms als das Hinzufügen neuer, spezialisierter „Fernbedienungstasten" zu einem Fernseher. Anstatt den Fernseher neu zu bauen, um einen neuen Kanal hinzuzufügen, fügen Sie einfach eine Taste hinzu, die beim Drücken einen bestimmten Satz von Schaltkreisen aktiviert, die der Fernseher bereits hat. Das Beste daran? Sie können zwei Tasten gleichzeitig drücken, und der Fernseher findet heraus, wie er beide Kanäle gleichzeitig handhabt. Diese Arbeit zeigt, dass dieser „Tasten"-Ansatz für KI funktioniert und ihr ermöglicht, kontinuierlich neue Fähigkeiten zu lernen, ohne die alten zu vergessen.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →