SkillLens: Adaptive Multi-Granularity Skill Reuse for Cost-Efficient LLM Agents
SkillLens ist ein hierarchisches Framework, das die Leistung und Kosteneffizienz von LLM-Agenten optimiert, indem es Fähigkeiten in einen Mehr-Granularitäts-Graphen zur adaptiven Abrufung und selektiven Verfeinerung organisiert und dadurch bestehende flache, auf Fähigkeiten basierende Baselines in Benchmarks wie MuLocbench und ALFWorld übertrifft.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Stellen Sie sich vor, Sie versuchen, ein komplexes Problem zu lösen, wie etwa einen kaputten Toaster zu reparieren oder einen chaotischen Schrank zu organisieren. Sie haben eine riesige Bibliothek alter Bedienungsanleitungen (Fertigkeiten) zur Verfügung, die andere Menschen niedergeschrieben haben.
Der alte Weg (Das Problem):
Aktuelle KI-Agenten behandeln diese Anleitungen meist wie ganze Bücher. Wenn Sie einen Toaster reparieren müssen, greift die KI ein ganzes „Gerätewartung"-Buch heraus und klebt den gesamten Text in ihr Gehirn.
- Das Problem: Das ist unübersichtlich. Das Buch mag zwar hervorragende Ratschläge zur Reparatur eines Toasters enthalten, aber es hat auch 50 Seiten über die Reparatur eines Mixers und eines Toasterofens. Die KI wird durch die irrelevanten Informationen verwirrt, verschwendet Zeit beim Lesen und kann sogar Halluzinationen entwickeln (Dinge erfinden), weil sie versucht, Anweisungen zu befolgen, die nicht passen.
- Die Alternative: Wenn die KI erkennt, dass das Buch größtenteils falsch ist, wirft sie das ganze Buch weg und versucht, alles von Grund auf neu herauszufinden. Das ist langsam und teuer.
Der neue Weg (SkillLens):
Die Arbeit stellt SkillLens vor, eine intelligentere Methode zur Nutzung dieser Bedienungsanleitungen. Anstatt eine Fertigkeit als einen großen, unveränderlichen Block zu behandeln, zerlegt SkillLens jede Fertigkeit in eine Vier-Schichten-Hierarchie, wie eine Matroschka-Puppe oder eine Organisationsstruktur eines Unternehmens:
- Richtlinie (Der Chef): „Wir müssen den Toaster reparieren." (Übergeordnetes Ziel)
- Strategie (Der Manager): „Zuerst den Stecker ziehen, dann das Heizelement prüfen." (Der Plan)
- Verfahren (Der Supervisor): „Verwenden Sie einen Schraubenzieher, um die Rückwand zu entfernen. Wenn sie feststeckt, wackeln Sie vorsichtig daran." (Schritt-für-Schritt-Regeln)
- Primitiv (Der Arbeiter): „Drehen Sie den Schraubenzieher im Uhrzeigersinn." (Die winzige, atomare Aktion)
Wie SkillLens funktioniert:
Wenn die KI eine neue Aufgabe bewältigen muss, greift sie nicht einfach ein ganzes Buch heraus. Sie agiert wie ein intelligenter Bibliothekar mit einer Lupe:
- Den Samen finden: Sie findet ein relevantes Handbuch (z. B. „Gerätewartung").
- Hinein- und Herauszoomen: Anstatt das Ganze zu lesen, betrachtet sie das „Inhaltsverzeichnis" (die Hierarchie).
- Der Verifizierer (Der Richter): Ein spezieller KI-Richter betrachtet jeden Teil des Handbuchs und entscheidet, was damit zu geschehen hat:
- Akzeptieren: „Dieser Teil ist perfekt. Behalten Sie ihn genau so."
- Zerlegen: „Dieser Abschnitt ist zu vage. Öffnen wir die nächste Schicht, um die spezifischen Schritte zu sehen."
- Umformen: „Dieser Teil ist größtenteils richtig, aber die Spannung ist für unser Land falsch. Lassen Sie uns nur diesen Satz anpassen."
- Überspringen: „Dieser Teil handelt von Mixern. Ignorieren Sie ihn vollständig."
Das Ergebnis:
Die KI erstellt ein maßgeschneidertes, kompaktes Anleitungssheet, das nur die perfekten Teile der alten Handbücher enthält, gemischt mit winzigen, lokalen Korrekturen. Sie verschwendet keine Zeit mit dem Lesen von Mixer-Anweisungen und muss nicht das ganze Buch neu schreiben.
Die „Evolution" (Im Laufe der Zeit schlauer werden):
Die Arbeit beschreibt zudem ein System, bei dem die KI aus ihren Fehlern lernt. Wenn die KI eine Aufgabe nicht bewältigt, schreibt sie nicht einfach einen neuen Versuch auf, sondern erstellt einen „Lückenbericht".
- Hat sie versagt, weil sie nicht das richtige Handbuch hatte? (Aktualisieren Sie die Bibliothek des Agenten.)
- Hat sie versagt, weil sie das falsche Handbuch gegriffen oder nicht gewusst hat, wie man es bearbeitet? (Aktualisieren Sie die Regeln des Richters.)
Beweis aus der Praxis:
Die Autoren haben dies an zwei Arten von Aufgaben getestet:
- Fehler in Code finden (MuLocbench): Wie das Finden eines Tippfehlers in einem riesigen Softwareprojekt. SkillLens war viel besser darin, die genaue Datei und Funktion zu identifizieren als andere Methoden, insbesondere wenn die Aufgabe sehr spezifisches, detailliertes Wissen erforderte.
- Virtuelle Hausarbeit (ALFWorld): Wie ein Roboter, der versucht, einen unordentlichen Raum in einem Videospiel zu reinigen. SkillLens verbesserte die Erfolgsrate von 45 % auf über 51 % und zeigte, dass es komplexe, mehrstufige Aufgaben besser bewältigen kann.
Kurz gesagt:
SkillLens verhindert, dass die KI ganze Bedienungsanleitungen blind kopiert oder sie verwirft. Stattdessen agiert sie wie ein Meister-Redakteur, der die guten Teile herausschneidet, die schlechten Teile anpasst und die irrelevanten Teile ignoriert, um einen perfekten, kosteneffizienten Leitfaden für die jeweilige Aufgabe zu erstellen.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.