← Neueste Arbeiten
🤖 machine learning

Power-Softmax: Towards Secure LLM Inference over Encrypted Data

Dieser Beitrag stellt „Power-Softmax" vor, eine neuartige HE-freundliche Variante der Selbstattention, die das Training der ersten milliardenparametrigen polynomialen LLMs ermöglicht, die eine sichere Inferenz über verschlüsselte Daten unterstützen und gleichzeitig Schlussfolgerungs- sowie Kontextlernfähigkeiten aufweisen, die mit denen herkömmlicher Transformer vergleichbar sind.

Ursprüngliche Autoren: Itamar Zimerman, Allon Adir, Ehud Aharoni, Matan Avitan, Moran Baruch, Nir Drucker, Jenny Lerner, Ramy Masalha, Reut Meiri, Omri Soceanu

Veröffentlicht 2026-05-06
📖 4 Min. Lesezeit☕ Kaffeepausen-Lektüre

Ursprüngliche Autoren: Itamar Zimerman, Allon Adir, Ehud Aharoni, Matan Avitan, Moran Baruch, Nir Drucker, Jenny Lerner, Ramy Masalha, Reut Meiri, Omri Soceanu

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, Sie möchten einem superintelligenten Roboter (ein Large Language Model, oder LLM) eine Frage stellen, aber Sie möchten Ihre Frage geheim halten. Sie wollen nicht, dass der Besitzer des Roboters sieht, was Sie gefragt haben, und Sie wollen auch nicht, dass der Roboter Ihr Geheimnis erfährt.

Um dies zu tun, verwenden Sie eine spezielle Art von „magischem Schloss", genannt Homomorphe Verschlüsselung (HE). Dieses Schloss ermöglicht es Ihnen, Ihre Frage in einem verschlüsselten, unlesbaren Format zu senden. Der Roboter kann Mathematik auf die verschlüsselte Frage anwenden und Ihnen eine verschlüsselte Antwort geben, die Sie dann entschlüsseln können. Der Roboter sieht niemals die eigentliche Frage.

Das Problem: Das „Gehirn" des Roboters passt nicht ins Schloss
Das Problem ist, dass diese modernen Roboter mit einer bestimmten Art von Mathematik-Engine gebaut sind, die Transformer genannt wird. Diese Engine verwendet ein sehr verbreitetes Werkzeug namens Softmax, um zu entscheiden, welche Wörter wichtig sind.

Stellen Sie sich Softmax wie einen Koch vor, der eine Suppe probiert und basierend auf einem komplexen, exponentiellen Rezept entscheidet, wie viel Salz hinzuzufügen ist. Es ist großartig zum Kochen, aber das „magische Schloss" (HE) versteht nur einfache, geradlinige Mathematik (Polynome). Es kann mit dem komplexen, exponentiellen Rezept des Kochs nichts anfangen. Wenn Sie versuchen, den Roboter dazu zu zwingen, sein normales Gehirn im verschlossenen Zustand zu nutzen, bricht die Mathematik zusammen, oder der Roboter wird verwirrt und instabil.

Frühere Versuche, dies zu beheben, waren wie der Versuch, einen quadratischen Pflock in ein rundes Loch zu zwängen:

  1. Der „Brute-Force"-Ansatz: Versuchen Sie, das komplexe Rezept mit einem riesigen, unübersichtlichen Polynom zu approximieren. Dies funktioniert, ist aber unglaublich langsam und schwerfällig.
  2. Der „Pre-Training"-Ansatz: Ändern Sie das Gehirn des Roboters, bevor es lernt, indem Sie das komplexe Rezept durch etwas Einfacheres ersetzen. Dies macht den Roboter jedoch oft weniger intelligent oder führt dazu, dass er mit zunehmender Größe Schwierigkeiten bekommt.

Die Lösung: PowerSoftmax
Die Autoren dieses Papiers haben ein neues Werkzeug namens PowerSoftmax erfunden.

Stellen Sie sich vor, anstatt dass der Koch ein komplexes exponentielles Rezept verwendet, nutzt er ein einfaches Potenz-Rezept (wie das Quadrieren von Zahlen).

  • Die Analogie: Wenn Softmax ein Koch ist, der Zutaten mit einer magischen, wachsenden Zahl multipliziert, ist PowerSoftmax ein Koch, der sie einfach mit sich selbst multipliziert (z. B. 2×22 \times 2, 3×33 \times 3).
  • Warum es funktioniert: Dieses „Potenz-Rezept" verhält sich fast exakt wie das ursprüngliche komplexe, passt aber perfekt in das „magische Schloss". Es ist einfach genug für das Schloss, um es zu handhaben, aber intelligent genug, damit der Roboter klar denken kann.

Die Herausforderungen, die sie lösten
Nur das Rezept zu tauschen, reichte nicht aus; sie mussten drei spezifische Probleme beheben, damit es für einen riesigen Roboter funktioniert:

  1. Das „Null"-Problem: Manchmal könnte die Mathematik im neuen Rezept durch Null teilen, was das System zum Absturz bringt.
    • Die Lösung: Sie fügten einen winzigen, sicheren Puffer (wie ein Sicherheitsnetz) hinzu, damit die Mathematik niemals Null erreicht, was die Berechnung stabil und einfach zu approximieren macht.
  2. Das „Überlauf"-Problem: Wenn die Zahlen zu groß oder zu klein werden, explodiert das Gehirn des Roboters (oder friert ein).
    • Die Lösung: Sie schufen eine „Stabile Variante", die die Zahlen vor der Berechnung auf eine sichere, handhabbare Größe skaliert, ähnlich wie ein Koch, der einen Löffel Suppe probiert, bevor er sie in den ganzen Topf gibt.
  3. Das „Langer-Satz"-Problem: Die ursprüngliche Methode wurde mit länger werdenden Sätzen immer langsamer.
    • Die Lösung: Sie erfanden eine „Längen-unabhängige" Methode. Anstatt jedes einzelne Wort in einer langen Geschichte zu zählen, um die Mathematik durchzuführen, betrachteten sie einfach den Durchschnitt der Wörter. Dies bedeutet, dass der Roboter schnell bleibt, egal ob Sie eine kurze Frage stellen oder einen ganzen Roman schreiben.

Die Ergebnisse: Ein riesiger, sicherer Roboter
Mit diesen Tricks baute das Team den ersten sicheren Roboter mit über 1 Milliarde Parametern (ein Maß dafür, wie „groß" und intelligent der Roboter ist).

  • Größe: Er ist mehr als 10-mal größer als jeder vorherige sichere Roboter.
  • Intelligenz: Er kann immer noch Kontext verstehen, Probleme durchdenken und aus Beispielen lernen (eine Fähigkeit namens „In-Context Learning") genauso gut wie die standardmäßigen, unverschlüsselten Roboter.
  • Geschwindigkeit: Da ihre neue Mathematik so effizient ist, läuft sie auf verschlüsselten Daten viel schneller als frühere Methoden.

Zusammenfassung
Das Papier präsentiert einen neuen Weg, KI zu bauen, die Privatsphäre respektiert. Sie ersetzten den komplexen „Aufmerksamkeits"-Mechanismus der KI durch eine einfachere, „potenzbasierte" Version, die in ein Verschlüsselungsschloss passt. Dies ermöglicht es ihnen, massive KI-Modelle mit Milliarden von Parametern zu trainieren, die sicher denken und reasoning können, ohne jemals die Daten des Benutzers oder die Geheimnisse des Modells preiszugeben. Sie haben nicht nur ein kleines Spielzeug gebaut; sie haben ein riesiges, sicheres Gehirn erschaffen, das tatsächlich funktioniert.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →