Encryptability As a Coordinate Choice: Depth-One Homomorphic Federated Learning of Quantum Neural Networks
Questo articolo dimostra che rappresentando i pesi delle reti neurali quantistiche in un sistema di coordinate a quaternione unitario, le operazioni di gruppo non lineari richieste per l'apprendimento federato criptato diventano bilineari, consentendo così un addestramento omomorfico efficiente, non interattivo e di profondità uno di modelli ibridi quantistico-classici con una perdita di accuratezza trascurabile e senza necessità di bootstrapping.
Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo
Nel mondo moderno dell'intelligenza artificiale, le macchine imparano trovando schemi in enormi quantità di dati. Spesso, questi dati sono sensibili, appartenenti a individui che desiderano mantenere la propria privacy, come cartelle cliniche o cronologie finanziarie personali. Per risolvere questo problema, gli scienziati hanno sviluppato un metodo chiamato apprendimento federato (federated learning), in cui i dati rimangono sul dispositivo dell'utente e solo le lezioni apprese da essi vengono inviate a un server centrale per migliorare un modello condiviso. Tuttavia, inviare anche queste lezioni comporta un rischio: un osservatore curioso potrebbe potenzialmente ricostruire i dati originali a partire dagli aggiornamenti. Per prevenire ciò, i ricercatori utilizzano una tecnica chiamata crittografia, che maschera le informazioni in modo che solo il destinatario previsto possa leggerle. La sfida sorge quando il modello di apprendimento coinvolge computer quantistici, che operano secondo le strane regole della fisica quantistica. In questi sistemi, i numeri utilizzati per addestrare il modello non sono semplici valori, ma rappresentano rotazioni in uno spazio complesso e multidimensionale. Per molto tempo, crittografare questi specifici tipi di rotazioni è stato ritenuto proibitivamente costoso, richiedendo una tale potenza di calcolo da rendere il processo impraticabile.
Un team di ricercatori dell'Imperial College London ha scoperto che questa difficoltà non era una legge fondamentale della natura, ma una conseguenza del modo in cui i numeri venivano scritti. Hanno scoperto che cambiando il "linguaggio" matematico utilizzato per descrivere queste rotazioni quantistiche, il processo di crittografia di esse diventa sorprendentemente semplice ed efficiente. Invece di utilizzare un sistema complesso che richiedeva migliaia di passaggi per ogni singolo aggiornamento, i ricercatori hanno dimostrato che l'uso di un sistema di coordinate specifico basato su quaternioni unitari riduce il lavoro a un singolo calcolo diretto. Questa scoperta permette alle reti neurali quantistiche di essere addestrate su molti dispositivi mantenendo i dati completamente nascosti, senza l'oneroso carico computazionale che precedentemente rendeva impossibile il processo.
Il cuore del problema risiedeva nel modo in cui i computer quantistici descrivono le loro operazioni. Le parti addestrabili di queste macchine sono essenzialmente rotazioni, simili al girare una manopola. Nella descrizione standard di queste rotazioni, la matematica coinvolta era così complessa che la crittografia degli aggiornamenti richiedeva una quantità massiccia di elaborazione, spesso necessitando di migliaia di operazioni separate per ogni singolo peso nella rete. Ciò rendeva l'idea di un apprendimento quantistico che preservasse la privacy simile a qualcosa di irraggiungibile. I ricercatori si sono resi conto che la complessità era un artefatto del sistema di coordinate, proprio come descrivere un cerchio usando una griglia frastagliata e a piccoli passi la fa apparire complicata, mentre descriverlo con una curva fluida la rende semplice. Passando a un sistema basato su quaternioni unitari, uno strumento matematico che descrive le rotazioni in quattro dimensioni, la relazione tra i numeri è diventata perfettamente lineare e semplice. In questo nuovo linguaggio, combinare due rotazioni è solo una moltiplicazione di base, un compito che i sistemi di crittografia possono gestire con facilità.
Questo cambio di prospettiva ha trasformato l'intero processo. I ricercatori hanno dimostrato che, con questa nuova scelta di coordinate, il server può combinare gli aggiornamenti crittografati di molti diversi client senza mai doverli decrittografare o eseguire i pesanti calcoli ripetitivi che erano precedentemente richiesti. Il processo è diventato così efficiente da eliminare la necessità di un passaggio specifico e laborioso noto come bootstrapping, che si riteneva precedentemente essenziale per mantenere sicura la crittografia durante i calcoli complessi. Il team ha costruito un protocollo funzionante che permette ai client di addestrare i propri modelli localmente, crittografare i risultati utilizzando questo nuovo metodo e inviarli a un server. Il server può quindi combinare questi aggiornamenti e inviare il risultato indietro, il tutto mentre i dati rimangono mascherati. Hanno testato questo sistema su due diversi backend crittografici per garantire che i risultati non fossero solo un caso fortuito di un particolare software, confermando che il guadagno di efficienza è una proprietà fondamentale della matematica stessa.
Per verificare che questo nuovo metodo non sacrificasse la qualità dell'apprendimento, il team ha condotto esperimenti rigorosi. Hanno addestrato un modello ibrido, che combina un piccolo circuito quantistico con un computer classico, su dataset del mondo reale come i prezzi delle case e la qualità del vino. Hanno confrontato le prestazioni del sistema crittografato direttamente con un sistema identico non crittografato, eseguendo i test più volte con diverse condizioni iniziali per garantire l'equità. I risultati hanno mostrato che la crittografia non ha aggiunto alcun carico misurabile al processo di apprendimento. L'accuratezza del modello è rimasta esattamente la stessa, provando che la protezione della privacy non è avvenuta a scapito delle prestazioni. Inoltre, hanno testato se il rumore introdotto dalla crittografia potesse accidentalmente aiutare il modello a imparare meglio, un fenomeno talvolta osservato in altri contesti. Eseguendo il sistema con diversi livelli di precisione, hanno scoperto che aggiungere più rumore non migliorava i risultati, confermando che la crittografia era semplicemente uno scudo trasparente piuttosto che un aiuto nascosto.
I ricercatori hanno anche affrontato la questione pratica di come questi modelli gestiscono le connessioni tra diverse parti del circuito quantistico, note come entanglers (creatori di entanglement). Hanno dimostrato matematicamente che, anche con queste complesse connessioni, il nuovo metodo di crittografia aggiunge solo una quantità costante e piccola di lavoro, indipendentemente da quanto il circuito diventi profondo o complesso. Ciò significa che l'efficienza del metodo si mantiene anche quando i modelli crescono in dimensioni e sofisticatezza. Per validare i risultati nel mondo reale, hanno eseguito il protocollo su un processore quantistico fisico con 156 qubit. Il sistema ha raggiunto un alto livello di fedeltà, il che significa che le operazioni crittografate funzionavano quasi altrettanto bene di quelle non crittografate, con la minima differenza attribuibile alle imperfezioni naturali dell'hardware piuttosto che alla crittografia stessa.
Lo studio ha anche evidenziato i compromessi coinvolti in questo approccio. Sebbene il nuovo metodo abbia ridotto drasticamente il numero di round di comunicazione necessari tra il server e i client — passando da decine di scambi a uno solo — esso richiede l'invio di quantità maggiori di dati in ogni scambio. I ricercatori hanno calcolato che questo compromesso è vantaggioso per la maggior parte degli scenari reali, in particolare quelli che coinvolgono reti ad area ampia dove la velocità della connessione è il fattore limitante. Hanno osservato che per le connessioni locali molto veloci, i vecchi metodi interattivi potrebbero ancora essere leggermente più efficienti, ma per le reti più ampie e inter-istituzionali dove la privacy è più critica, il nuovo metodo offre un chiaro vantaggio. Il lavoro conclude che la barriera all'apprendimento quantistico crittografato non era una mancanza di potenza, ma una scelta di prospettiva. Riconoscendo che la difficoltà era un problema di coordinate piuttosto che un problema fondamentale, i ricercatori hanno aperto la porta a un futuro in cui le macchine quantistiche possono apprendere in modo collaborativo senza mai compromettere la privacy dei dati che utilizzano.
Sommerso dagli articoli nel tuo campo?
Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.