← Ultimi articoli
🤖 machine learning

Power-Softmax: Towards Secure LLM Inference over Encrypted Data

Questo documento introduce "Power-Softmax", una variante innovativa dell'auto-attenzione compatibile con la computazione omomorfica che abilita l'addestramento dei primi modelli linguistici di grandi dimensioni polinomiali da un miliardo di parametri in grado di eseguire inferenze sicure su dati cifrati, mantenendo al contempo capacità di ragionamento e apprendimento in contesto comparabili a quelle dei trasformatori standard.

Autori originali: Itamar Zimerman, Allon Adir, Ehud Aharoni, Matan Avitan, Moran Baruch, Nir Drucker, Jenny Lerner, Ramy Masalha, Reut Meiri, Omri Soceanu

Pubblicato 2026-05-06
📖 5 min di lettura🧠 Approfondimento

Autori originali: Itamar Zimerman, Allon Adir, Ehud Aharoni, Matan Avitan, Moran Baruch, Nir Drucker, Jenny Lerner, Ramy Masalha, Reut Meiri, Omri Soceanu

Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo

Immagina di voler fare una domanda a un robot super-intelligente (un Modello Linguistico di Grande Dimensione, o LLM), ma desideri mantenere segreta la tua domanda. Non vuoi che il proprietario del robot veda cosa hai chiesto, e non vuoi nemmeno che il robot conosca il tuo segreto.

Per fare ciò, utilizzi un tipo speciale di "lucchetto magico" chiamato Crittografia Omomorfica (HE). Questo lucchetto ti permette di inviare la tua domanda in un formato cifrato e illeggibile. Il robot può eseguire calcoli matematici sulla domanda cifrata e fornirti una risposta cifrata, che tu puoi poi decifrare. Il robot non vede mai la domanda reale.

Il Problema: Il "Cervello" del Robot non si Adatta al Lucchetto
Il problema è che questi robot moderni sono costruiti con un tipo specifico di motore matematico chiamato Transformer. Questo motore utilizza uno strumento molto comune chiamato Softmax per decidere quali parole sono importanti.

Pensa al Softmax come a uno chef che assaggia una zuppa e decide quanto sale aggiungere basandosi su una ricetta complessa ed esponenziale. È ottimo per cucinare, ma il "lucchetto magico" (HE) comprende solo matematica semplice e lineare (polinomi). Non può gestire la ricetta complessa ed esponenziale dello chef. Se provi a costringere il robot a usare il suo normale cervello mentre è bloccato, la matematica si rompe, oppure il robot si confonde e diventa instabile.

I tentativi precedenti di risolvere questo problema erano come cercare di forzare un chiodo quadrato in un buco rotondo:

  1. L'approccio "Brute Force": Cercare di approssimare la ricetta complessa con un polinomio gigantesco e disordinato. Funziona, ma è incredibilmente lento e pesante.
  2. L'approccio "Pre-Training": Cambiare il cervello del robot prima che impari, sostituendo la ricetta complessa con qualcosa di più semplice. Ma questo spesso rende il robot meno intelligente o causa difficoltà man mano che diventa più grande.

La Soluzione: PowerSoftmax
Gli autori di questo articolo hanno inventato un nuovo strumento chiamato PowerSoftmax.

Immagina invece che lo chef, invece di usare una ricetta esponenziale complessa, utilizzi una semplice ricetta a potenza (come elevare i numeri al quadrato).

  • L'Analogia: Se Softmax è uno chef che moltiplica gli ingredienti per un numero magico in crescita, PowerSoftmax è uno chef che li moltiplica semplicemente per se stessi (ad esempio, 2×22 \times 2, 3×33 \times 3).
  • Perché funziona: Questa "ricetta a potenza" si comporta quasi esattamente come quella originale complessa, ma si adatta perfettamente all'interno del "lucchetto magico". È abbastanza semplice per essere gestita dal lucchetto, ma abbastanza intelligente da mantenere il robot che pensa chiaramente.

Le Sfide che Hanno Risolto
Sostituire semplicemente la ricetta non è stato sufficiente; hanno dovuto risolvere tre problemi specifici per farlo funzionare con un robot gigante:

  1. Il Problema dello "Zero": A volte, la matematica nella nuova ricetta poteva dividere per zero, il che faceva crashare il sistema.
    • La Soluzione: Hanno aggiunto un piccolo e sicuro buffer (come una rete di sicurezza) in modo che la matematica non tocchi mai lo zero, rendendo il calcolo stabile e facile da approssimare.
  2. Il Problema dell'"Overflow": Se i numeri diventano troppo grandi o troppo piccoli, il cervello del robot esplode (o si blocca).
    • La Soluzione: Hanno creato una "Variante Stabile" che ridimensiona i numeri a una dimensione sicura e gestibile prima di eseguire i calcoli, simile a come uno chef potrebbe assaggiare un cucchiaino di zuppa prima di aggiungerlo all'intera pentola.
  3. Il Problema della "Frase Lunga": Il metodo originale diventava sempre più lento man mano che la frase si allungava.
    • La Soluzione: Hanno inventato un metodo "Indipendente dalla Lunghezza". Invece di contare ogni singola parola in una lunga storia per eseguire i calcoli, hanno guardato semplicemente la media delle parole. Questo significa che il robot rimane veloce sia che tu faccia una domanda breve sia che tu scriva un intero romanzo.

I Risultati: Un Robot Gigante e Sicuro
Utilizzando questi trucchi, il team ha costruito il primo robot sicuro con oltre 1 miliardo di parametri (una misura di quanto il robot sia "grande" e intelligente).

  • Dimensione: È più di 10 volte più grande di qualsiasi precedente robot sicuro.
  • Intelligenza: Può ancora comprendere il contesto, ragionare attraverso i problemi e imparare dagli esempi (una competenza chiamata "Apprendimento in Contesto") esattamente quanto i robot standard non bloccati.
  • Velocità: Poiché la loro nuova matematica è così efficiente, funziona molto più velocemente su dati cifrati rispetto ai metodi precedenti.

In Sintesi
L'articolo presenta un nuovo modo per costruire l'IA che rispetta la privacy. Hanno sostituito il complesso meccanismo di "attenzione" dell'IA con una versione più semplice, "basata sulla potenza", che si adatta all'interno di un lucchetto di crittografia. Questo permette loro di addestrare modelli di IA massicci, con miliardi di parametri, che possono pensare e ragionare in modo sicuro, senza rivelare mai i dati dell'utente o i segreti del modello. Non hanno creato solo un piccolo giocattolo; hanno costruito un cervello gigante e sicuro che funziona davvero.

Sommerso dagli articoli nel tuo campo?

Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.

Prova Digest →