A transformer-based model reveals sparse, stimulus-dependent orientation readout from macaque V1 population activity
Questo studio dimostra che un modello basato su transformer può ricostruire con precisione l'orientamento dello stimolo dall'attività della popolazione di V1 del macaco, rivelando che la ridondante codifica neurale supporta un meccanismo di lettura flessibile, sparso e dipendente dallo stimolo mediato dall'auto-attenzione.
Articolo originale sotto licenza CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA di un preprint non sottoposto a revisione paritaria. Non è un consiglio medico. Non prendere decisioni sulla salute basandoti su questo contenuto. Leggi il disclaimer completo
La corteccia visiva primaria, un sottile strato di tessuto nella parte posteriore del cervello, funge da prima grande stazione di elaborazione per tutto ciò che vediamo. Quando la luce colpisce l'occhio, i segnali viaggiano verso questa regione, dove milioni di singoli neuroni si attivano in risposta a specifiche caratteristiche del mondo visivo. Una delle proprietà più fondamentali che questi neuroni rilevano è l'orientamento: l'angolo con cui una linea o un bordo è inclinato. Decenni di ricerca hanno dimostrato che questi neuroni non sono uniformi; ognuno ha un angolo preferito, come una piccola bussola che punta in una direzione specifica. Tuttavia, il cervello non si affida a un singolo neurone per dirci quale angolo stiamo guardando. Invece, uno stimolo visivo attiva una vasta, sovrapponente folla di migliaia di neuroni, ciascuno con preferenze leggermente diverse e livelli variabili di attività. Ciò crea un codice complesso e ridondante in cui la stessa informazione è sparsa in una grande popolazione. Il lungo mistero per i neuroscienziati è stato capire come il cervello riesca a setacciare questa enorme, rumorosa folla per estrarre una risposta singola e precisa sul mondo. Se ogni neurone contribuisce un po', come fa il cervello a decidere a quali ascoltare, e li ascolta tutti allo stesso modo?
Per risolvere questo enigma, i ricercatori si sono rivolti a un potente nuovo strumento proveniente dal campo dell'intelligenza artificiale: un modello basato sui transformer. Originariamente progettato per l'elaborazione del linguaggio, questo tipo di programma informatico è unico nel capire quali parti di un input complesso siano più importanti per un compito specifico. Il team, guidato da scienziati della Università di Pechino e dell'Università di Zhejiang, ha applicato questo modello a dati biologici reali. Hanno registrato l'attività di oltre 1.000 neuroni contemporaneamente dalla corteccia visiva di sette macachi svegli. Alle scimmie venivano mostrate immagini semplici di motivi a strisce, noti come stimoli di Gabor, ad varie angolazioni. I ricercatori hanno poi inserito le risposte di calcio collettive di questi neuroni nel loro modello informatico, chiedendogli di ricostruire l'immagine esatta che la scimmia aveva visto. L'obiettivo non era solo vedere se il computer potesse indovinare l'angolo, ma osservare come decidesse a quali neuroni prestare attenzione durante il processo.
I risultati sono stati sorprendenti. Il modello informatico ha ricostruito le immagini a strisce con un'incredibile precisione, catturando l'orientamento delle linee con un errore medio inferiore a un grado. Questo livello di accuratezza ha superato di gran lunga quello che i modelli informatici più semplici potevano raggiungere, dimostrando che l'architettura dei transformer era unicamente adatta a decodificare questo complesso segnale biologico. Ma la vera svolta è arrivata guardando dentro la "mente" del modello. Mentre il computer elaborava i dati, generava una mappa di attenzione, mostrando quanto peso assegnasse a ciascun neurone nel prendere la sua decisione. I ricercatori hanno scoperto che il modello non trattava i 1.000 neuroni come partner uguali. Invece, per un dato angolo, la ricostruzione era dominata da un piccolo, rado gruppo di soli due o tre neuroni. Questi neuroni specifici non erano casuali; erano quelli il cui angolo preferito corrispondeva all'immagine mostrata, ed erano quelli che ricevevano i segnali di "attenzione" più forti dal resto della rete.
Questa scoperta sfida una comune assunzione secondo cui il cervello debba mediare i segnali di migliaia di neuroni per ottenere un'immagine chiara. Lo studio suggerisce che, sebbene il cervello memorizzi le informazioni in modo ridondante attraverso una grande popolazione, le legge in modo altamente selettivo e flessibile. Il modello ha rivelato che questi neuroni chiave erano speciali non solo perché "amavano" l'angolo corretto, ma anche perché erano i più indipendenti dai loro vicini, mostrando meno rumore condiviso o variabilità. Inoltre, il modello ha mostrato che poteva affinare i segnali di questi pochi neuroni chiave, aumentando efficacemente il volume delle informazioni più utili e abbassando il volume del rumore proveniente dal resto della folla. Questo processo ha permesso al sistema di estrarre un orientamento preciso da un mare caotico di attività.
Forse l'evidenza più convincente di questo sistema flessibile è arrivata da un esperimento "cosa succederebbe se". I ricercatori hanno rimosso il piccolo gruppo di neuroni con l'alto peso dal modello e gli hanno chiesto di riprovare. Inve di fallire, il modello si è adattato rapidamente. Ha reclutato un nuovo, diverso insieme di neuroni sostituti che avevano proprietà simili a quelli rimossi. Anche questi nuovi neuroni erano sintonizzati sull'angolo corretto e sono stati in grado di assumere il compito di decodificare l'orientamento con la stessa alta precisione. Ciò dimostra che il cervello non si affida a un insieme fisso e immutabile di neuroni "star". Invece, la capacità di leggere l'informazione visiva è un processo dinamico, in cui una popolazione ridondante di cellule fornisce una rete di sicurezza, permettendo al sistema di passare a diversi sottoinsiemi di neuroni a necessità senza perdere accuratezza.
Lo studio conferma che la corteccia visiva opera su un principio di archiviazione ridondante ma di lettura sparsa e dipendente dallo stimolo. Il cervello conserva la stessa informazione in molti posti, garantendo robustezza, ma quando deve prendere una decisione, concentra le sue risorse su un sottoinsieme molto piccolo e altamente efficace della popolazione. Questo meccanismo permette sia la stabilità di una grande rete, sia la velocità e la precisione di una lettura focalizzata. Utilizzando un modello transformer per decodificare l'attività di veri neuroni, i ricercatori hanno fornito una finestra chiara su come il cervello possa risolvere il problema dell'estrazione di dettagli specifici da un codice massiccio e sovrapposto. Le scoperte suggeriscono che l'efficienza del cervello non deriva dall'avere meno neuroni, ma dall'avere un modo intelligente e flessibile per scegliere quali contano di più in ogni dato momento.
Sommerso dagli articoli nel tuo campo?
Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.