Thousands of pathogenic variants in ClinVar show signs of incomplete loss-of-function
Deze studie toont aan dat hoewel specifieke metrieken zoals LOFTEE, pext-scores en NMD-analyse kunnen helpen bij het onderscheiden van pathogene van benigne varianten, duizenden bekende pathogene ClinVar-varianten tekenen vertonen van incomplete loss-of-function, wat de aanzienlijke beperkingen onthult van het uitsluitend vertrouwen op geautomatiseerde filterregels om dergelijke varianten uit te sluiten.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van een preprint die niet peer-reviewed is. Dit is geen medisch advies. Neem geen gezondheidsbeslissingen op basis van deze inhoud. Lees de volledige disclaimer
In de uitgestrekte bibliotheek van de menselijke biologie fungeren onze genen als instructiehandleidingen voor het bouwen en onderhouden van het lichaam. Soms kan een enkele typefout in deze instructies—een verandering in een letter of een ontbrekend woord—een ziekte veroorzaken. Wetenschappers geloven al lang dat de gevaarlijkste typefouten diegene zijn die de handleiding volledig doen stoppen met werken, waardoor een gen effectief wordt uitgeschakeld. Dit staat bekend als loss-of-function varianten. Wanneer een genetische test een dergelijk "defect" gen vindt, wordt dit meestal behandeld als een 'smoking gun', het sterkst mogelijke bewijs dat iemand een specifieke zeldzame ziekte heeft. Deze aanname stuurt de manier waarop artsen genetische resultaten interpreteren en hoe onderzoekers zoeken naar de oorzaken van ziekte. De biologie is echter zelden zo eenvoudig als een kapotte schakelaar. Net zoals een beschadigde instructiehandleiding nog steeds gelezen kan worden door een slimme redacteur die de kapotte pagina overslaat of een omweg vindt, hebben cellen manieren om genetische fouten te omzeilen. Soms is een gen dat op papier defect lijkt, nog steeds in staat om een werkend eiwit te produceren, of in ieder geval genoeg daarvan om de persoon gezond te houden. Begrijpen wanneer een defect gen echt defect is, en wanneer het slechts een hapering vertoont, is cruciaal voor het onderscheid tussen een ernstige medische diagnose en een onschadelijke genetische variatie.
Een team onderzoekers aan het D. O. Ott Research Institute of Obstetrics, Gynaecology, and Reproductology in Sint-Petersburg zette zich scharpe om te testen hoe goed huidige computertools kunnen opsporen wanneer er sprake is van deze "valse" defecte genen. Ze wenden zich tot ClinVar, een enorme publieke database die genetische varianten verzamelt en labelt als ofwel ziekteveroorzakend ofwel onschadelijk. De onderzoekers richtten zich op duizenden varianten die voorspeld werden de functie van een gen te vernietigen. Ze wilden zien of de tools die gebruikt worden om valse alarmen te filteren, er succesvol in slaagden om de werkelijk gevaarlijke varianten van de onschadelijke te scheiden. Specifiek zochten ze naar tekenen dat een cel een defect gen zou kunnen redden, zoals het overslaan van de fout om de rest van de instructies te lezen, of het gebruik van een reserve-startsignaal om het proces van eiwitproductie te herstarten.
Het team paste verschillende tests toe op de data, waarbij ze controleerden op zaken zoals of het gen actief was in de juiste weefsels, of de cel de defecte instructies zou vernietigen voordat ze schade kunnen aanrichten, en of de cel de instructies correct weer aan elkaar kon plakken (splicing). Ze ontdekten dat sommige van deze tests hun werk vrij goed deden. Zo was een tool genaamd LOFTEE, die de kwaliteit van de genetische annotatie beoordeelt, zeer goed in het signaleren van onschadelige varianten. Het identificeerde correct dat veel varianten die als benigne (onschadelijk) waren gelabeld, inderdaad laag-betrouwbare voorspellingen waren, terwijl de overgrote meerderheid van de bevestigde ziekteveroorzakende varianten hoog-betrouwbaar was. Op dezelfde manier vonden zij een duidelijk patroon met betrekking tot nonsense-mediated decay, een kwaliteitscontroleproces van de cel dat defecte genetische boodschappen vernietigt. Varianten die erin slaagden deze vernietiging te ontwijken, waren veel vaker onschadelijk, terwijl de varianten die werden vernietigd, vaker de oorzaak van de ziekte waren.
De studie onthulde echter een significante complicatie: duizenden varianten die al als ziekteveroorzakend zijn gelabeld in ClinVar, vertoonden tekenen dat ze mogelijk toch niet volledig defect zijn. Zelfs onder de varianten die artsen momenteel vertrouwen als de oorzaak van ziekte, vertoonde een aanzienlijk aantal kenmerken die suggereerden dat het gen mogelijk nog steeds werkt. Bijvoorbeeld, sommige van deze "pathogene" varianten vertoonden tekenen dat de cel de instructies wellicht weer aan elkaar kan plakken om de fout te vermijden. De onderzoekers merkten op dat hoewel sommige tools, zoals die welke voorspellen hoe een gen wordt gesplitst (splicing), veelbelovend waren, ze niet perfect waren. Er was veel overlap tussen de scores voor ziekteveroorzakende varianten en onschadelijke varianten, wat betekent dat een computerscore alleen niet definitief kan zeggen of een variant gevaarlijk is.
Een opvallend voorbeeld dat de onderzoekers benadrukten, betrof een specifieke genetische verandering in een gen genaamd EYS, dat bekend staat als oorzaak van een vorm van blindheid. Deze variant werd door computertools geclassificeerd als laag-betrouwbaar en vertoonde lage activiteitsscores die consistent zijn met het vermogen van de cel om de kwaliteitscontrole te omzeilen. Toch is het een bekende oorzaak van ziekte bij een significant percentage patiënten. Deze bevinding onderstreept een moeilijke realiteit: een variant kan eruitzien alsof het een manier heeft om de schade te omzeilen, maar kan nog steeds krachtig genoeg zijn om ziekte te veroorzaken. De studie suggereert dat hoewel de tools die gebruikt worden om genetische data te filteren nuttig zijn, ze niet onfeilbaar zijn. Het vertrouwen op hen als een simpele "ja of nee"-schakelaar zou tot fouten kunnen leiden, of het nu gaat om het negeren van een echt ziekterisico of het bezorgd zijn over een onschadelijke variatie.
De onderzoekers concludeerden dat het vakgebied voorzichtiger moet zijn. Ze ontdekten dat hoewel bepaalde metrieken, zoals de waarschijnlijkheid dat een gen door de kwaliteitscontrole van de cel wordt vernietigd, nuttig zijn voor het sorteren van varianten, andere, zoals de potentie voor de cel om de eiwitproductie te herstarten, minder nuttig waren voor het maken van brede oordelen. De studie benadrukt dat geautomatiseerde filtersystemen, die vaak worden gebruikt om snel door duizenden genetische resultaten te zoeken, te lomp kunnen zijn. Duizenden varianten die momenteel als gevaarlijk worden geclassificeerd, vertonen tekenen van onvolledige defecten, en veel onschadelijke varianten vertonen tekenen van echte defecten. Dit betekent dat genetici niet simpelweg een computeralgoritme kunnen vertrouwen om de definitieve beslissing te nemen. In plaats daarvan vereist elk geval een genuanceerde blik, met het begrip dat het gedrag van een gen complex is en dat een "defect" label niet altijd betekent dat het gen werkelijk stil is. Het werk dient als een herinnering dat in de ingewikkelde machinerie van de menselijke genetica, wat op papier een totale instorting lijkt, in het lichaam nog steeds een functionerend, zij het imperfect, systeem kan zijn.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.