← Neueste Arbeiten
💬 NLP

Decoupled Smart Contract Audits: Lightweight LLM Framework via Distillation and Aggregation

Dieses Paper führt ein entkoppeltes, leichtgewichtiges LLM-Framework ein, das Destillation, Rank-Stabilized Low-Rank Adapter und eine benutzerdefinierte Chain-of-Verification-Aggregationsstrategie nutzt, um eine State-of-the-Art-Leistung bei der Sicherheitsprüfung von Smart Contracts mit signifikant weniger Parametern als bestehende Modelle zu erreichen.

Ursprüngliche Autoren: Bagus Rakadyanto Oktavianto Putra, Muhamad Risqi Utama Saputra, Widyawan, Guntur Dharma Putra

Veröffentlicht 2026-06-03
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Bagus Rakadyanto Oktavianto Putra, Muhamad Risqi Utama Saputra, Widyawan, Guntur Dharma Putra

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, Sie besitzen einen sehr komplexen, digitalen Tresor (einen Smart Contract), der das Geld von Menschen aufbewahrt. Sob es einmal gebaut ist, kann man die Schlösser nicht mehr ändern oder später neue Sicherheitsstäbe hinzufügen. Wenn es einen Fehler gibt, können Hacker alles stehlen. Deshalb muss ein Sicherheitsexperte den Tresor prüfen, bevor man ihn öffert.

Traditionell wird diese Prüfung von Menschen durchgeführt, aber es gibt zu viele Tresore, um sie manuell zu prüfen. Vor kurzem haben Menschen versucht, riesige „Super-Intelligenzen“ (Large Language Models oder LLMs) für die Prüfung einzusetzen. Aber diese Giganten sind wie der Versuch, ein Team von 100 PhDs für eine einzige Aufgabe einzustellen: Sie sind unglaublich teuer, benötigen massive Computer, um sie zu betreiben, und werden oft verwirrt, wenn man ihnen zu viele Dinge gleichzeitig abverlangt.

Dieses Paper stellt einen klügeren, leichteren Weg vor. Hier ist die Erklärung, wie sie es gemacht haben, vereinfacht dargestellt:

1. Das „Spezialisierte Team“ vs. der „Alleskönner“

Anstatt ein einziges riesiges, teures KI-Modell die ganze Arbeit auf einmal erleden zu lassen, haben die Autoren die Sicherheitsprüfung in vier kleine, spezialisierte Schritte unterteilt, ähnlich einem Staffellauf:

  1. Der Detektor: Eine winzige, schnelle KI, die den Code nur daraufhin scannt, ob es einen Bug gibt: „Ist hier ein Fehler? Ja oder Nein?“
  2. Der Erklärer: Wenn es einen Bug gibt, erklärt eine etwas größere KI, wie ein Hacker diesen ausnutzen könnte. Es ist wie ein Detektiv, der einen Bericht darüber schreibt, wie das Schloss geknackt wurde.
  3. Der Richter: Eine weitere kleine KI betrachtet diese Erklärung und entscheidet: „Ist das ein kleiner Kratzer (Niedrig), ein gebrochenes Scharnier (Mittel) oder ein totaler Einsturz (Hoch)?“
  4. Der Fixer: Schließlich schlägt eine intelligente KI genau vor, wie man das Loch flicken kann.

Die Analogie: Stellen Sie sich vor, Sie versuchen ein Auto zu reparieren. Ein „Unified“-Ansatz ist wie die Frage an eine Person, gleichzeitig den Motor zu diagnostizieren, die Physik des Ausfalls zu erklären, die Schwere des Schadens zu bewerten und das neue Teil einzuschweißen. Dabei könnte die Person überfordert werden und Fehler machen. Der Ansatz der Autoren ist wie ein spezialisierter Mechaniker, ein Physikprofessor, ein Sicherheitsinspektor und ein Schweißer, die in einer Reihe arbeiten. Jeder erledigt seine eine Aufgabe perfekt.

2. Das „Kleine Gehirn“ mit dem „Großen Lehrer“

Die Autoren verwendeten sehr kleine KI-Modelle (nur 0,6 bis 4 Milliarden „Neuronen“, im Vergleich zu den Giganten, die 30+ Milliarden haben). Normalerweise sind kleine Gehirne nicht intelligent genug für schwierige Aufgaben.

Um dies zu lösen, nutzten sie zwei Tricks:

  • Wissensdestillation (Der Lehrer-Schüler-Ansatz): Sie nahmen eine massive, super-intelligente „Lehrer“-KI (Qwen3-30B) und brachten der kleinen „Schüler“-KI bei, wie man Schritt für Schritt denkt. Der Schüler lernte nicht nur Antworten auswendig, sondern lernte den Denkprozess.
  • Das „Abstimmungssystem“ (Konsens): Wenn die KI eine Entscheidung treffen muss (wie „Ist das ein Bug?“), fragen sie sie nicht nur einmal, sondern fünf verschiedene Wege lang. Wenn vier von fünf sagen „Ja“, dann gilt das „Ja“. Dies verhindert, dass die KI einfach nur rät.

3. Der „Faktenchecker“, um Halluzinationen zu stoppen

KI-Modelle halluzinieren manchmal – sie erfinden Fakten, die echt klingen, aber falsch sind. Um dies zu verhindern, nutzten die Autoren eine Chain-of-Verification-Methode (Kette der Verifizierung).

  • Die Analogie: Stellen Sie sich vor, ein Schüler schreibt einen Aufsatz. Bevor er ihn abgibt, muss er drei Fragen zu seinem eigenen Aufsatz aufschreiben („Habe ich diesen Punkt bewiesen? Ist diese Tatsache wahr?“). Er beantwortet diese Fragen ehrlich. Wenn die Antworten nicht zum Aufsatz passen, korrigiert er den Aufsatz. Dies stellt sicher, dass der endgültige Bericht tatsächlich wahr ist.

4. Die große Entdeckung: Der „Mittelkind-Bias“

Die Forscher fanden etwas Überraschendes heraus, wenn KI die Schwere eines Fehlers bewertet. Wenn die KI entscheiden muss, ob ein Bug „Niedrig“, „Mittel“ oder „Hoch“ ist, bekommt sie Angst, falsch zu liegen.

  • Die Erkenntnis: Wenn die KI unsicher ist, wählt sie fast immer „Mittel“. Es ist wie ein Schüler, der bei einer Testfrage die Antwort nicht weiß und einfach „C“ ankreuzt, weil es als sicherster Mittelweg erscheint.
  • Die Autoren fanden heraus, dass die riesigen Modelle sehr schlecht darin waren, Extremfälle (sehr geringe oder sehr hohe Risiken) zu erkennen, da sie ständig alles in den „Mittel“-Eimer schoben. Ihr kleineres, spezialisiertes Team war viel besser darin, die Extreme zu identenifizieren.

5. Warum das wichtig ist (Die Ergebnisse)

  • Günstiger: Ihr System läuft auf einem Standard-Laptop oder einer bescheidenen Grafikkarte. Die riesigen Modelle, mit denen sie verglichen wurden, benötigen super-teure Computer der Rechenzentrumsklasse, die Tausende von Dollar kosten.
  • Intelligenter: Trotz der viel geringeren Größe war ihr System genauer als die riesigen Modelle. Sie erreichten eine Genauigkeit von 98 % beim Finden von Bugs, während die Giganten mit den komplexen Denkprozessen zu kämpfen hatten.
  • Handlungsorientiert: Sie haben nicht nur Bugs gefunden, sondern auch klare Erklärungen und spezifische Code-Fixes geliefert, was Entwickler tatsächlich benötigen.

Kurz gesagt: Das Paper beweist, dass man keine riesige, teure KI braucht, um seinen digitalen Tresor zu sichern. Indem man ein Team aus kleinen, spezialisierten, gut trainierten KI-Assistenten einsetzt, die sich gegenseitig kontrollieren, kann man bessere Ergebnisse für einen Bruchteil der Kosten erzielen.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →