Copy aware deconvolution of Hi-C interactions in extrachromosomal DNA using CADET
Il documento introduce CADET, un metodo computazionale che inferisce direttamente le matrici di interazione Hi-C specifiche per copia per il DNA extracromosomico (ecDNA) utilizzando l'algoritmo di aspettativa-massimizzazione, risolvendo così l'ambiguità causata dai segmenti genomici duplicati senza richiedere la ricostruzione strutturale tridimensionale.
Articolo originale sotto licenza CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA di un preprint non sottoposto a revisione paritaria. Non è un consiglio medico. Non prendere decisioni sulla salute basandoti su questo contenuto. Leggi il disclaimer completo
All'interno del nucleo di una cellula tumorale, il progetto genetico è spesso in uno stato di caos. Mentre le cellule sane mantengono il loro DNA ordinatamente organizzato in lunghi cromosomi lineari, le cellule tumorali spesso frammentano questi filamenti e li riassemblano in loop circolari noti come DNA extracromosomico. Questi loop non sono semplici grovigli casuali; agiscono come potenti motori per la crescita del cancro, portando spesso copie extra di geni che guidano la malattia. Poiché queste molecole circolari possono contenere molteplici copie dello stesso segmento genetico, creano un problema unico per gli scienziati che cercano di mappare l'architettura interna della cellula. Quando i ricercatori utilizzano tecniche ad alto rendimento per vedere come diverse parti del DNA si tocchino e interagiscano, i segnali di queste copie duplicate si fondono in un'unica immagine sfocata. È come guardare una fotografia in cui tre gemelli identici sono stati sovrapposti; si vede il gruppo, ma non si può capire quale gemello stia facendo cosa.
Per capire come funzionano queste cellule tumorali, gli scienziati devono separare questi segnali sovrapposti. Devono sapere quale copia specifica di un gene sta interagendo con quale parte specifica del genoma per guidare la malattia. Un nuovo metodo chiamato CADET, sviluppato dal ricercatore Biswanath Chowdhury, offre un modo per fare esattamente questo. Invece di cercare di costruire un modello tridimensionale della forma del DNA per indovinare dove si trovano le copie, questo approccio lavora direttamente con i dati di contatto. Tratta il problema come lo sbroglio di un nodo di voci sovrapposte. Utilizzando la disposizione nota del DNA circolare e cercando sottili differenze nel modo in cui le copie del DNA interagiscono con i loro vicini immediati, il metodo può separare matematicamente i segnali fusi. Ciò consente ai ricercatori di vedere le interazioni distinte di ogni singola copia, rivelando un quadro più chiaro dell'architettura regolatoria che alimenta il cancro.
I ricercatori hanno testato questo nuovo approccio utilizzando prima simulazioni al computer, creando dataset fittizi in cui conoscevano esattamente la verità su come le copie del DNA interagivano tra loro. Hanno introdotto livelli variabili di duplicazione, rendendo a volte le copie comportarsi in modo identico e altre volte dotandole di comportamenti differenti. In ogni scenario, il metodo ha recuperato con successo le interazioni specifiche delle copie nascoste dai dati sfocati. Si è dimostrato particolarmente efficace quando le copie duplicate avevano ambienti locali differenti, utilizzando quelle sottili differenze per distinguerle. Le simulazioni hanno mostrato che il metodo poteva identificare accuratamente quale copia fosse responsabile di un contatto specifico circa l'80-83 percento delle volte in situazioni complesse, e lo ha fatto senza cambiare il numero totale di contatti osservati nei dati originali. Ciò ha confermato che il metodo non stava inventando nuove informazioni, ma piuttosto ridistribuendo le informazioni esistenti in un formato più utile.
Il team ha poi applicato CADET a dati reali provenienti da tre diverse linee cellulari tumorali, ognuna con la propria disposizione unica di DNA extracromosomico. In un caso, una linea cellulare di cancro al polmone, il DNA era altamente duplicato, con grandi sezioni del genoma ripetute più volte. Il metodo ha sbrogliato con successo queste ripetizioni, rivelando che certe parti del DNA agivano come hub, interagendo ripetutamente con partner diversi. In un altro caso, una linea cellulare di cancro al cervello, il DNA circolare univa segmenti provenienti da due cromosomi diversi. Qui, il metodo ha identificato un'interazione specifica e forte tra un gene che guida il cancro e un elemento regolatorio distante su un cromosoma diverso, un risultato che corrispondeva a studi precedenti, ma che era ora risolto senza la necessità di ricostruire la forma 3D della molecola. In un terzo caso riguardante una linea cellulare di neuroblastoma, il DNA era disposto come una ripetizione in tandem su un cromosoma anziché come un cerchio. Anche se i segnali individuali erano più deboli in questo dataset, il metodo ha comunque trovato schemi di interazione ricorrenti attorno a geni specifici noti per essere coinvolti nella malattia.
Ciò che rende questo approccio distinto è come gestisce l'ambiguità del DNA duplicato. I metodi precedenti spesso cercavano di risolvere questo problema costruendo prima un modello 3D della struttura del DNA, assumendo che la forma della molecola dettasse come i segnali dovessero essere divisi. CADET, tuttavia, salta questo passaggio. Guarda direttamente la mappa di contatto e utilizza il ragionamento statistico per decidere come dividere il segnale in base alla distanza tra i segmenti e al supporto locale che ogni copia riceve. Ciò significa che la mappa di interazioni risultante è indipendente da qualsiasi ipotesi di forma 3D specifica. I ricercatori hanno scoperto che, sebbene il metodo non sempre individuasse l'esatta forza di ogni singola interazione, era molto bravo a identificare famiglie di interazioni che erano arricchite o più forti del previsto. Nella linea cellulare di cancro al cervello, ad esempio, il metodo ha identificato un modulo di interazioni che coinvolgeva un gene chiave del cancro, che corrispondeva alle scoperte di altri studi, ma lo ha inserito in un contesto di schemi di contatto ricorrenti piuttosto che in un singolo evento strutturale.
Lo studio ha anche evidenziato i limiti di ciò che può essere conosciuto da questo tipo di dati. Quando due copie di un segmento di DNA si trovano in ambienti locali identici, il metodo non può distinguerle, proprio come un ascoltatore non può distinguere due voci identiche se stanno dicendo le stesse parole allo stesso volume. In questi casi, il metodo assegna il segnale equamente, riconoscendo che i dati non contengono informazioni sufficienti per fare una distinzione più fine. I ricercatori sono stati attenti a sottolineare che, sebbene potessero identificare interazioni candidate e raggrupparle in moduli funzionali, queste scoperte rappresentano ipotesi che devono essere testate con ulteriori esperimenti. Non hanno sostenuto di aver risolto il problema della regolazione dei geni del cancro, ma piuttosto di aver fornito una nuova, più chiara lente attraverso la quale osservare le complesse e aggrovigliate interazioni all'interno delle cellule tumorali.
Separando i segnali fusi del DNA duplicato, questo lavoro offre un modo più diretto per studiare le reti regolatorie che guidano il cancro. Permette agli scienziati di vedere quali copie specifiche di un gene sono attive e come comunicano con il resto del genoma. Il metodo ha già rivelato schemi di interazione distinti in diversi tipi di cancro, mostrando che queste molecole di DNA circolari si organizzano in modi diversificati. Che il DNA sia disposto in un cerchio o in una lunga ripetizione, la capacità di risolvere questi contatti specifici delle copie apre la porta a una comprensione più profonda di come le cellule tumorali riprogrammano le loro istruzioni genetiche per sopravvivere e crescere. Questa chiarezza potrebbe eventualmente aiutare i ricercatori a identificare nuovi bersagli terapeutici, concentrandosi sulle interazioni specifiche che sono più critiche per la malattia.
Sommerso dagli articoli nel tuo campo?
Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.