← Ultimi articoli
🤖 machine learning

Quantum Models with Multi-Stage Training for Compositional Concept Generalization

Questo articolo propone un framework di addestramento multistadio per l'apprendimento automatico quantistico multimodale che separa le rappresentazioni di sostantivi e relazioni utilizzando tensori e circuiti quantistici variazionali, dimostrando un miglioramento significativo della generalizzazione composizionale sul dataset CLEVR con molti meno parametri addestrabili rispetto ai baseline classici.

Autori originali: Mina Abbaszadeh, Matilda Karabina Moore, Mehrnoosh Sadrzadeh, Martha Lewis

Pubblicato 2026-08-18
📖 6 min di lettura🧠 Approfondimento

Autori originali: Mina Abbaszadeh, Matilda Karabina Moore, Mehrnoosh Sadrzadeh, Martha Lewis

Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo

L'intelligenza umana possiede una straordinaria capacità di ricombinare idee semplici e apprese in situazioni completamente nuove. Una persona che comprende cos'è un "auto" e cosa significa "giallo" può riconoscere istantaneamente un'auto gialla che non ha mai visto prima, applicando la propria conoscenza del pericolo a questa nuova combinazione. Questa capacità, nota come generalizzazione composizionale, ci permette di navigare in un mondo in cui incontriamo costantemente nuove disposizioni di parti familiari. Per l'intelligenza artificiale, tuttavia, questa abilità rimane un ostacolo ostinato. Sebbene i sistemi moderni eccellano nel riconoscere schemi che hanno visto durante l'addestramento, spesso inciampano quando viene chiesto loro di applicare quegli stessi schemi a nuove combinazioni, come un oggetto specifico posto in una nuova relazione spaziale. Questo limite suggerisce che gli attuali modelli stiano memorizzando esempi piuttosto che comprendere veramente le regole sottostanti di come le cose si incastrano tra loro.

Ricercatori dell'University College London e dell'Università di Amsterdam hanno esplorato una strada diversa per risolvere questo problema, rivolgendosi alla strana e potente logica della meccanica quantistica. Nel loro lavoro, presentato per la conferenza IEEE Quantum Week, propongono che il modo in cui i computer quantistici elaborano le informazioni possa allinearsi naturalmente con il modo in cui gli esseri umani combinano i concetti. Costruendo un modello che separa l'apprendimento degli oggetti dall'apprendimento delle relazioni tra di essi, hanno creato un sistema in grado di generalizzare verso scenari inediti in modo molto più efficace rispetto ai metodi tradizionali, il tutto utilizzando una frazione della potenza computazionale.

Il team si è concentrato su un compito in cui un computer deve guardare l'immagine di due forme geometriche e scegliere la descrizione corretta della loro relazione tra due opzioni. Per esempio, data l'immagine di un cubo a sinistra di un cono, il sistema deve distinguere la frase corretta "cubo sinistra cono" da un elemento di distrazione come "cubo destra cono". Per insegnare alla macchina, i ricercatori hanno utilizzato un dataset contenente immagini di forme come sfere, cilindri e coni in varie posizioni. La sfida era addestrare il sistema su alcune combinazioni, come un cono a destra di un cubo, e poi testarlo su combinazioni che non aveva mai visto, come un cono a sinistra di un cubo. Questa configurazione costringe il modello a imparare il concetto di "sinistra" e "destra" come regole indipendenti che possono essere applicate a qualsiasi forma, piuttosto che limitarsi a memorizzare immagini specifiche.

Invece di addestrare l'intero sistema in una sola fase, i ricercatori hanno adottato un approccio in due fasi che imita un curriculum. Nella prima fase, il modello ha imparato a riconoscere i singoli oggetti. Gli sono state mostrate immagini di singole forme, come una sfera isolata o un singolo cubo, e gli è stato insegnato a associarle ai loro nomi. Una volta che il modello avesse padroneggiato questi elementi base, i ricercatori hanno "congelato" la sua memoria di come apparissero quelle forme. Nella seconda fase, hanno introdotto il compito relazionale. Il modello veniva ora mostrato immagini con due forme e doveva imparare solo le regole di come esse si relazionano tra loro, utilizzando le definizioni stabili e pre-apprese delle forme che aveva già memorizzato. Questo design ha garantito che il sistema non cercasse di ri-imparare cos'era un "cubo" ogni volta che vedeva una nuova relazione, costringendolo a trattare la relazione come una trasformazione separata applicata a un oggetto fisso.

Per implementare questo, il team ha utilizzato un framework che traduce il linguaggio e il significato in strutture matematiche chiamate tensori, che possono essere mappate direttamente su circuiti quantistici. Hanno testato diversi modi di alimentare i dati delle immagini in questi circuiti quantistici. Un metodo, chiamato codifica di ampiezza (amplitude encoding), cercava di preservare la geometria esatta dei dati originali dell'immagine. Un altro, chiamato codifica angolare (angle encoding), trasformava i dati in un modo che introduceva cambiamenti non lineari, rimodellando efficacemente l'informazione per rendere più chiare le differenze tra le relazioni. Hanno anche sperimentato un metodo "collage", in cui i circuiti quantistici per due forme separate venivano fisicamente combinati per rappresentare una singola immagine relazionale.

I risultati delle loro simulazioni sono stati rivelatori. Quando i ricercatori hanno confrontato il loro modello quantistico multi-stadio con un sistema classico standard, la differenza di efficienza è stata netta. Il baseline classico richiedeva oltre 150 milioni di parametri addestrabili per tentare il compito, eppure falliva nella generalizzazione, ottenendo un punteggio del 50 percento sulle combinazioni inedite — essenzialmente tirando a indovinare. In contrasto, il modello quantistico ha raggiunto una forte generalizzazione utilizzando solo 426 parametri addestrabili. La versione più efficace del loro sistema, che utilizzava il metodo collage combinato con la codifica angolare, ha raggiunto un'accuratezza superiore al 72 percento nei casi di test inediti. Questa prestazione è stata significativamente migliore rispetto a un modello quantistico a stadio singolo che tentava di imparare tutto insieme, provando che separare l'apprendimento degli oggetti da quello delle relazioni era cruciale.

I ricercatori hanno scoperto che il successo del loro modello dipendeva fortemente da come i dati venivano codificati. Il metodo della codifica angolare, che introduceva trasformazioni non lineari, si è rivelato superiore al metodo della codifica di ampiezza. Ciò suggerisce che i dati originali dell'immagine, come elaborati dagli strumenti standard, non separavano chiaramente le relazioni spaziali necessarie per il compito. Il processo di codifica quantistica stesso ha aiutato a ristrutturare l'informazione, rendendo la distinzione tra "sinistra" e "destra" più visibile al modello. Mentre la codifica di ampiezza preservava la forma originale dei dati, manteneva intatte le similitudini confuse tra diverse disposizioni spaziali, rendendole più difficili da distinguere.

Queste scoperte, derivate interamente da simulazioni al computer, suggeriscono che le rappresentazioni quantistiche strutturate offrono una via promettente per insegnare alle macchine la composizionalità. Imponendo una chiara separazione tra ciò che le cose sono e come si relazionano, e utilizzando circuiti quantistici per rimodellare i dati in una forma più separabile, il modello ha raggiunto un livello di generalizzazione che i sistemi classici faticavano a raggiungere con molte più risorse. Il lavoro non pretende di aver risolto il problema dell'intelligenza artificiale, ma dimostra che un approccio specifico e strutturato all'apprendimento — dove le primitive vengono apprese prima e poi combinate — può essere altamente efficace se accoppiato con le proprietà uniche del calcolo quantistico. Gli autori osservano che il lavoro futuro dovrà testare queste idee su hardware quantistico reale ed esplorare se tali metodi possano scalare verso scene più complesse e vocabolari più ricchi, ma i risultati attuali forniscono una prova di concetto convincente per un nuovo modo di pensare all'apprendimento automatico.

Sommerso dagli articoli nel tuo campo?

Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.

Prova Digest →