A Computational Cancer GWAS Screen Highlights Structural Variation at the 7q22.1 Locus Near STAG3
Cette étude démontre qu'un criblage computationnel intégrant des données de séquençage à lectures courtes et longues révèle un enrichissement significatif de variants structuraux au niveau de locus de gènes spécifiques à la méiose chevauchant des signaux d'études d'association pangénomique (GWAS) sur le cancer, identifiant spécifiquement une nouvelle délétion de 442 pb à proximité du gène *STAG3* comme un candidat conducteur au locus de susceptibilité au cancer colorectal en 7q22.1 qui aurait été manqué par le séquençage à lectures courtes seul.
Article original sous licence CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA d'un preprint qui n'a pas été évalué par des pairs. Ce n'est pas un avis médical. Ne prenez pas de décisions de santé basées sur ce contenu. Lire la clause de non-responsabilité complète
Pour comprendre comment le cancer commence, les scientifiques examinent souvent les instructions écrites dans notre ADN. Ces instructions ne sont pas seulement une liste de lettres individuelles ; elles constituent une bibliothèque complexe où des paragraphes entiers peuvent être manquants, dupliqués ou réorganisés. Pendant des décennies, les chercheurs ont scanné ces bibliothèques à la recherche de minuscules fautes de frappe — des changements d'une seule lettre — pour trouver des indices sur les raisons pour lesquelles certaines personnes développent un cancer tandis que d'autres non. Cependant, cette méthode présente un angle mort. Elle manque souvent les réorganisations plus larges et plus dramatiques du texte génétique, connues sous le nom de variants structurels. Il s'agit de blocs d'ADN, allant de cinquante lettres à des milliers, qui sont supprimés, copiés ou déplacés. Comme ces changements surviennent souvent dans des régions répétitives et désordonnées du génome, les outils standards utilisés pour lire l'ADN ont eu du mal à les voir clairement. Ce fossé est particulièrement important lorsqu'on observe les gènes qui sont actifs pendant la méiose, le processus spécial de division cellulaire qui crée les spermatozoïdes et les ovules. Ces gènes sont vitaux pour la réparation de l'ADN, et lorsqu'ils dysfonctionnent, ils peuvent laisser la porte ouverte au développement du cancer plus tard dans la vie.
Une nouvelle étude de Koushik Chowdhury, de l'Université de la Sarre en Allemagne, a jeté un regard neuf sur ces régions cachées. En combinant deux ensembles puissants de données génétiques — l'un construit à partir du séquençage standard à lectures courtes (short-read) et l'autre à partir d'une technologie avancée à lectures longues (long-read) capable de voir à travers les parties désordonnées du génome — le chercheur a créé une carte détaillée des variants structurels à proximité de trente et un gènes impliqués dans la méiose. Le but était de voir si ces réorganisations génétiques de grande ampleur, qui avaient été largement ignorées dans les études antérieures sur le cancer, correspondent réellement aux points de risque connus du cancer. L'étude a révélé que ces variants structurels ne sont pas un bruit aléatoire ; ils sont nettement plus susceptibles d'être trouvés près des signaux de risque de cancer que ce que l'on pourrait attendre par hasard. Plus notablement, la recherche a identifié une délétion spécifique de 442 lettres sur le chromosome 7 qui se situe juste à côté d'un facteur de risque connu pour le cancer colorectal. Cette délétion est située près d'un gène appelé STAG3, qui agit comme une version de secours d'un gène déjà connu pour favoriser le cancer colorectal lorsqu'il dysfonctionne dans l'organisme. Bien que l'étude ne prouve pas que cette délétion cause le cancer, elle suggère que STAG3 est un candidat solide pour des investigations plus approfondies, offrant une nouvelle piste sur la façon dont les changements génétiques hérités pourraient influencer le risque de cancer.
L'étude a commencé par reconnaître une limitation dans la manière dont la génétique du cancer a été pratiquée pendant des années. Les tests génétiques standards, qui utilisent des puces pour scanner le génome, sont excellents pour trouver des changements d'une seule lettre mais sont très mauvais pour détecter les réorganisations structurelles plus larges. Imaginez essayer de lire un livre où des pages entières ont été arrachées ou collées dans le mauvais ordre ; un scanner standard pourrait ne voir que le texte sur les pages restantes et manquer entièrement les sections manquantes ou mal placées. Cela est particulièrement vrai pour les gènes impliqués dans la méiose, qui sont souvent entourés de séquences d'ADN répétitives qui déroutent les outils de lecture standards. Pour corriger cela, Chowdhury a utilisé deux ensembles de données différents. Le premier provient de gnomAD, une base de données massive d'informations génétiques provenant d'environ 63 000 personnes, générée par un séquençage standard à lectures courtes. Le second provient du Human Pangenome Reference Consortium, qui utilise la technologie de séquençage à lectures longues pour cartographier les génomes de 47 individus avec une précision bien plus grande, capturant les régions complexes que le premier ensemble de données a manquées.
Le chercheur s'est concentré sur trente et un gènes spécifiques. Dix-sept d'entre eux étaient des gènes du cancer bien connus, tandis que les quatorze autres étaient des gènes enrichis en méiose, ce qui signifie que leur fonction principale est de fonctionner lors de la création des spermatozoïdes et des ovules. L'étude posait une question simple : les variants structurels dans ces gènes chevauchent-ils les sites de risque de cancer connus ? Pour y répondre, le chercheur a comparé les cartes génétiques à un catalogue de plus de 6 000 signaux de risque de cancer identifiés dans des études précédentes. Les résultats ont été frappants. Les variants structurels trouvés dans les fenêtres autour de ces trente et un gènes étaient près de huit fois plus susceptibles de chevaucher un signal de risque de cancer que les variants trouvés ailleurs dans le génome. Cela suggère que l'angle mort des recherches précédentes était réel et que ces changements structurels plus importants jouent probablement un rôle dans la susceptibilité au cancer que les scientifiques avaient manqué.
L'une des découvertes les plus significatives est que les données de lecture longue du projet pangenome ont révélé 187 variants structurels que les données de lecture courte standard n'ont pas réussi à détecter. Ces variants « invisibles » n'étaient pas dispersés de manière aléatoire ; ils étaient concentrés dans les régions de gènes enrichies en méiose. Cela confirme que la nature complexe et répétitive de ces gènes spécifiques les rend difficiles à étudier avec les technologies plus anciennes, et que les nouveaux outils de lecture longue sont essentiels pour voir l'image complète. L'étude a identifié 913 associations totales impliquant ces gènes enrichis en méiose, les liant à divers cancers, notamment le cancer du sein, de la prostate et de la peau.
La partie la plus détaillée de l'étude s'est concentrée sur un emplacement spécifique sur le chromosome 7, connu sous le nom de locus 7q22.1, qui est un point chaud (hotspot) connu pour le risque de cancer colorectal. Des études antérieures avaient identifié deux changements d'une seule lettre dans cette zone qui étaient fortement liés à la maladie, mais comme ces changements se situaient dans une région entre les gènes, les scientifiques ne savaient pas quel gène ils affectaient. Les cartes standards pointaient vers un gène voisin appelé TRIM4 simplement parce qu'il était le plus proche, mais il n'y avait aucune preuve que TRIM4 soit réellement impliqué dans la maladie.
L'analyse de Chowdhury a mis au jour une délétion de 442 lettres située juste entre les deux signaux de risque connus. Cette délétion a été trouvée chez environ 0,9 % de la population. Bien que l'étude ne puisse pas prouver de manière définitive que cette délétion est la cause directe du risque, sa position est hautement suspecte. Elle se situe dans le même petit voisinage génétique que les signaux de risque, dans une fenêtre de seulement 8 700 lettres. Le chercheur a ensuite examiné les gènes de cette zone pour voir lequel pourrait être la véritable cible. Deux gènes, GJC3 et AZGP1, se trouvent physèrement entre la délétion et le prochain gène majeur, mais aucun des deux ne présentait de signe de régulation par les signaux de risque dans le tissu colique. Cependant, le gène STAG3, situé environ 289 000 lettres en aval, présentait un signal fort. STAG3 est la version spécifique à la méiose de STAG2, un gène qui est fréquemment muté dans les tumeurs du cancer colorectal. L'étude a montré que STAG3 possède un lien connu avec l'expression génique dans le côlon, suggérant que les signaux de risque et la délétion pourraient réguler STAG3 à distance.
L'article prend soin de ne pas prétendre que cette découverte résout le mystère du cancer colorectal. Le chercheur note que la délétion et les signaux de risque n'ont pas été formellement prouvés comme étant liés sur le même brin d'ADN, et qu'aucune expérience de laboratoire n'a été réalisée pour tester si la délétion modifie réellement le fonctionnement de STAG3. L'étude est un criblage computationnel, une façon de passer au crible de vastes quantités de données pour trouver les pistes les plus prometteuses. Elle suggère que STAG3 est un gène candidat qui mérite d'être étudié davantage, particulièrement parce qu'il s'inscrit dans un récit biologique : un gène qui aide à réparer l'ADN pendant la méiose, lorsqu'il est hérité sous une forme endommagée, pourrait rendre une personne plus susceptible au cancer plus tard dans la vie.
Ce travail met en lumière un changement dans la manière dont les scientifiques abordent la génétique du cancer. En allant au-delà des simples scans lettre par lettre et en adoptant des technologies capables de voir les changements structurels plus larges, les chercheurs découvrent de nouvelles connexions entre notre ADN hérité et la maladie. L'étude démontre que les variants structurels « manquants » ne sont pas seulement du bruit ; ils sont probablement des pièces clés du puzzle, surtout dans les régions complexes du génome que les outils standards ont eu du mal à lire. Pour le locus 7q22.1, les résultats fournissent une direction concrète pour les recherches futures, déplaçant l'attention d'un gène voisin générique vers un candidat spécifique et biologiquement plausible qui pourrait expliquer pourquoi certaines personnes naissent avec un risque plus élevé de développer un cancer colorectal.
Noyé(e) sous les articles dans votre domaine ?
Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.