← Neueste Arbeiten
🤖 AI

SkillForge: Self-Distilling Agents for Project-Specific Issue Resolution

SkillForge ist ein Self-Distillation-Framework, das die Fähigkeit von Large Language Model Agents zur Behebung von Softwareproblemen in spezifischen Repositories proaktiv verbessert, indem es künstliche Probleme synthetisiert und löst, die aus Kernfunktionalitäten abgeleitet sind, um dadurch wiederverwendbares, entitätsbasiertes Projektwissen zu destillieren, ohne dabei auf historische Reparaturdaten oder kostspielige Exploration zur Testzeit angewiesen zu sein.

Ursprüngliche Autoren: Silin Chen, Han Li, Xiaodong Gu, Yuling Shi, Haibing Guan

Veröffentlicht 2026-08-20
📖 7 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Silin Chen, Han Li, Xiaodong Gu, Yuling Shi, Haibing Guan

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

In der weiten, komplexen Landschaft moderner Software bildet der Code das Fundament, auf dem unsere digitale Welt ruht. Wenn in einem komplexen Programm etwas kaputtgeht, erfordert die Behebung oft ein tiefes Verständnis nicht nur des defekten Teils, sondern auch dessen, wie dieser Teil in die gesamte Maschine passt. Jahrzehntelang waren Menschen die primären Mechaniker für diese Arbeit, doch vor kurzem hat die künstliche Intelligenz begonnen, das Werkzeug in die Hand zu nehmen. Große Sprachmodelle, die leistungsstarke Computerprogramme, die auf riesigen Mengen an Text und Code trainiert wurden, haben gezeigt, dass sie in der Lage sind, diese digitalen Repositories zu durchforsten, Fehler zu finden und Korrekturen zu schreiben. Es bleibt jedoch eine bedeutende Hürde bestehen: Diese KI-Agenten haben oft Schwierigkeiten, wenn sie mit einem spezifischen, unbekannten Projekt konfrontiert werden. Ihnen fehlt der lokale Kontext – die ungeschriebenen Regeln, die spezifischen Arten, wie verschiedene Teile des Codes miteinander kommunizieren, und die einzigartige Geschichte, wie genau diese Software gebaut wurde. Ohne dieses Insiderwissen ist die KI wie ein brillanter Mechaniker, der in eine Werkstatt geworfen wird, die er noch nie gesehen hat, und gezwungen ist, jedes Mal zu raten, wie der Motor funktioniert, wenn er auf ein neues Problem stößt.

Forscher der Shanghai Jiao Tong University haben einen neuen Ansatz entwickelt, um dieses Problem zu lösen, eine Methode, die sie SkillForge nennen. Anstatt darauf zu warten, dass die KI durch reale Fehler stolpert und im Laufe der Zeit aus ihren Fehlern lernt, lehrt dieses System die KI proaktiv über das spezifische Projekt, bevor sie jemals versucht, eine echte Korrektur vorzunehmen. Das Team erkannte, dass die KI das Projekt erst einmal üben muss, um es zu verstehen. Also schufen sie ein Trainingsgelände, auf dem die KI ihre eigenen künstlichen Probleme generiert. Indem sie die Kernfunktionen eines Softwareprojekts – jene Teile, die bereits getestet und als funktionierend bekannt sind – nehmen und die KI bitten, diese von Grund auf neu zu schreiben, zwingt das System die KI dazu, Fehler zu machen. Da die KI keinen Zugriff auf den ursprünglichen Code hat, muss sie sich auf ihr allgemeines Wissen verlassen, was unweigerlich zu Fehlern führt, die spezifisch für die Art und Weise sind, wie dieses Projekt tatsächlich aufgebaut ist. Diese Fehler, die die Forscher als synthetische Probleme bezeichnen, werden dann als Lernwerkzeug genutzt. Die KI versucht, diese künstlichen Bugs zu beheben, und offenbart dabei die verborgenen Muster und spezifischen Regeln dieses Softwareprojekts.

Das System nimmt dann die Pfade, die die KI zur Lösung dieser künstlichen Probleme genommen hat, und destilliert sie in einen Satz von „Skills“ (Fähigkeiten). Betrachten Sie diese Skills als einen personalisierten Leitfaden für diese spezifische Software. Die Forscher organisierten dieses Wissen in zwei Typen. Der erste Typ ist eine hochgradig strukturierte Karte, die der KI hilft, die Gesamtstruktur des Projekts zu verstehen, wie zum Beispiel, was verschiedene Teile des Codes tun sollen und wie sie normalerweise interagieren. Der zweite Typ ist ein Satz spezifischer Anweisungen für den Fall, dass die KI tatsächlich den Code bearbeitet, die sie vor häufigen Fallstricken warnt und sie an die einzigartigen Eigenheiten des Projekts erinnert. Wenn die KI später gebeten wird, ein echtes Problem in derselben Software zu lösen, konsultiert sie diesen Leitfaden. Zuerst lädt sie die hochgradige Karte, um sich zu orientieren, und während sie tiefer in den Code eindringt, erhält sie punktgenaue Erinnerungen an die spezifischen Regeln, die sie befolgen muss. Dies geschieht automatisch und stellt sicher, dass die KI genau dann den richtigen Kontext hat, wenn sie ihn benötigt.

Die Forscher testeten diese Methode an einer breiten Palette realer Softwareprojekte und nutzten zwei verschiedene leistungsstarke KI-Modelle, um zu sehen, ob es funktioniert. Sie verglichen ihr System mit anderen Methoden, die versuchen, der KI zu helfen, indem sie aus vergangenen menschlichen Korrekturen lernt oder während der Problemlösung den Code exploriert. Die Ergebnisse waren eindeutig: Der SkillForge-Ansatz übertraf die anderen Methoden konsistent. Bei einem Standardtest für Software-Engineering-Aufgaben verbesserte das System die Erfolgsrate der KI um fast sechs Prozentpunkte im Vergleich zu einem Basismodell, das über kein spezielles Projektwissen verfügt. Diese Verbesserung blieb auch bestehen, als die Forscher das System bei einem anderen, schwierigeren Satz von Herausforderungen testeten. Die Studie zeigte, dass das System durch das Lehren der KI über das spezifische Projekt vor Beginn der eigentlichen Arbeit Probleme genauer und effizienter lösen konnte als Methoden, die versuchten, dies während des Prozesses zu lernen oder auf historische Daten zurückgriffen, die das aktuelle Problem möglicherweise nicht abdeckten.

Einer der aufschlussreichsten Aspekte der Forschung war die Beobachtung, wie sich das Verhalten der KI mit diesem neuen Wissen veränderte. In einem spezifischen Fall, der einen komplexen Formatierungsfehler in einem populären Web-Framework betraf, entschied sich eine KI ohne dieses Training schnell für eine einfache, falsche Lösung, die auf den ersten Blick richtig aussah, aber bei der Prüfung gegen das volle Spektrum der Anforderungen scheiterte. Sie übersah die subtile, projektspezifische Logik, die erforderlich war, um die Daten korrekt zu verarbeiten. Im Gegensatz dazu wählte die mit dem SkillForge-Leitfaden ausgestattete KI einen vorsichtigeren, strukturierteren Ansatz. Sie hielt inne, um die spezifischen Regeln des Projekts zu berücksichtigen, vermied eine häufige Falle, in die die ungeschulte KI tappte, und fand letztendlich eine Lösung, die alle notwendigen Tests bestand. Dies demonstrierte, dass das System der KI nicht nur mehr Informationen gab, sondern grundlegend die Art und Weise änderte, wie sie über den Code nachdachte, indem es ihr half, die Arten von Fehlern zu vermeiden, die durch die Anwendung allgemeiner Regeln auf eine spezifische, einzigartige Umgebung entstehen.

Die Forscher untersuchten auch, ob das aus einem KI-Modell gewonnene Wissen auf ein anderes übertragen werden konnte. Sie fanden heraus, dass die durch ein Modell destillierten Fähigkeiten am effektivsten waren, wenn sie von eben diesem Modell verwendet wurden. Dies deutet darauf hin, dass das Wissen tief mit der Art und Weise verbunden ist, wie eine spezifische KI denkt und Code schreibt, anstatt ein universeller Satz von Fakten über die Software zu sein. Dieser Befund unterstrection, dass der Wert des Systems in seiner Fähigkeit liegt, die spezifische Art und Weise zu erfassen, wie eine bestimmte KI mit einem bestimmten Projekt interagiert. Darüber hinaus zeigte die Studie, dass das System am besten funktioniert, wenn es sich darauf konzentriert, mehrere verbundene Teile des Codes gemeinsam umzuschreiben, anstatt nur einzelne Funktionen isoliert zu betrachten. Dieser Ansatz erfasst die komplexen Interaktionen zwischen den verschiedenen Teilen der Software, in denen sich der kritischste projektspezifische Wissensschatz oft verbirgt.

Letztendlich bietet diese Arbeit einen neuen Weg, um die Lücke zwischen leistungsstarker allgemeiner KI und den spezifischen Anforderungen des realen Software-Engineerings zu schließen. Durch den Wechsel von einem reaktiven Ansatz, bei dem die KI erst aus Fehlern lernt, nachdem sie aufgetreten sind, zu einem proaktiven Ansatz, bei dem sie die Regeln des Spiels lernt, bevor das Spiel beginnt, haben die Forscher einen Weg zu zuverlässigeren und fähigeren KI-Agenten aufgezeigt. Das System benötigt keine massive Historie vergangener menschlicher Korrekturen, um zu funktionieren, noch verlangt es von der KI, während des eigentlichen Reparaturprozesses Zeit und Ressourcen für das blinde Erkunden des Codes zu verschwenden. Stattdessen baut es eine gezielte, effiziente Wissensbasis auf, die es der KI ermöglicht, sofort voll einsatzfähig zu sein. Die Ergebnisse legen nahe, dass die KI, um wirklich ein Partner in der Softwareentwicklung zu werden, die Chance erhalten muss, die spezifische Sprache und die Bräuche des Projekts zu lernen, an dem sie arbeitet, und SkillForge bietet einen praktischen, effektiven Weg, genau das zu tun.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →