← Nieuwste papers
💻 bioinformatics

Towards reconstruction of the human interactome from positive and negative experimental evidence

Dit artikel presenteert een methodologie om de experimentele zoekruimte van eiwit-eiwitinteractie (PPI) schermen te reconstrueren om waarschijnlijke niet-interagerende eiwitparen af te leiden, waardoor een betere foutenratestatistiek, modelkalibratie en verbeterde machine learning-training mogelijk worden voor een nauwkeurigere en completere mapping van het menselijke interactoom.

Oorspronkelijke auteurs: As, J., Pelz, K., Bernett, J., Battini, F., List, M., Blumenthal, D. B., Schaefer, M. H.

Gepubliceerd 2026-09-13
📖 7 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: As, J., Pelz, K., Bernett, J., Battini, F., List, M., Blumenthal, D. B., Schaefer, M. H.

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ⚕️ Dit is een AI-gegenereerde uitleg van een preprint die niet peer-reviewed is. Dit is geen medisch advies. Neem geen gezondheidsbeslissingen op basis van deze inhoud. Lees de volledige disclaimer

In elke levende cel zweven en botsen duizenden eiwitten constant tegen elkaar, terwijl ze voortdurend proberen grip op elkaar te krijgen. Wanneer twee eiwitten in elkaar grijpen, vormen ze een team dat structuren kan bouwen, signalen kan verzenden of afval kan afbreken. Deze partnerschappen, bekend als eiwit-eiwitinteracties, zijn de fundamentele bedrading van het leven. Zonder deze interacties zouden cellen chaotische verzamelingen onderdelen zijn in plaats van georganiseerde machines. Decennialang hebben wetenschappers geprobeerd deze verbindingen in kaart te brengen, waarbij ze een gigantisch diagram van het netwerk creëerden om te zien wie met wie communiceert in het menselijk lichaam. Deze kaart helpt te verklaren hoe ons lichaam werkt in gezondheid en hoe het uiteenvalt bij ziekte. Echter, de kaart zit momenteel vol gaten en fouten. We kennen miljoenen van deze verbindingen, maar we weten ook dat veel gerapporteerde links fouten zijn, en dat veel echte links ontbreken. Het grootste probleem is dat wetenschappers alleen de succesvolle ontmoetingen hebben geregistreerd. Ze hebben opgeschreven welke eiwitten elkaars hand hebben geschud, maar ze hebben zelden opgeschreven welke eiwitten naast elkaar stonden en elkaar negeerden.

Deze stilte creëert een blinde vlek. Als je alleen weet wie er een ontmoeting heeft gehad, kun je niet bepalen of een ontmoeting een zeldzame, speciale gebeurtenis was of gewoon een gelukkig toeval. Erger nog, als je een computer probeert te gebruiken om nieuwe ontmoetingen te voorspellen, moet je de computer leren hoe een "niet-ontmoeting" eruitziet. Meestal leren wetenschappers computers door ervan uit te gaan dat elke twee eiwitten die niet samen zijn gezien, vreemden zijn. Maar dit is een gevaarlijke gok. Alleen omdat twee eiwitten niet samen zijn getest, betekent niet dat ze niet interageren; het kan simpelweg betekenen dat niemand ze ooit in dezelfde kamer heeft geplaatst. Om dit op te lossen, heeft een team van onderzoekers geprobeerd de ontbrekende geschiedenis van deze experimenten te reconstrueren. Ze wilden het onzichtbare verslag vinden van alle keren dat eiwitten werden getest maar er niet in slaagden te verbinden.

De onderzoekers begonnen met een enorme collectie bestaande gegevens, waarbij ze resultaten uit meer dan 5.500 verschillende reeds gepubliceerde experimenten samenbrachten. Deze experimenten gebruikten twee hoofdmethoden om verbindingen te testen: één die eiwitten mengt in een reageerbuis en een andere die ze in gistcellen kweekt. In deze experimenten testen wetenschappers meestal één "aas"-eiwit tegen vele "prooi"-eiwitten om te zien welke aan elkaar blijven plakken. De standaardpraktijk was om alleen de succesvolle hechtingen te rapporteren. Het team realiseerde zich echter dat de lijst van succesvolle hechtingen eigenlijk een verborgen aanwijzing bevatte over de mislukkingen. Als een specifiek proeiwit werd gevonden dat aan één aas bleef plakken in een reageerbuis, bewijst dit dat de prooi aanwezig was en functioneerde in dat specifieke experiment. Daarom, als datzelfde proeiwit aanwezig was in dezelfde buis maar niet aan een ander aas bleef plakken, moet het een echte niet-hechting zijn. Door de succesvolle verbindingen te gebruiken om de hele ruimte waar de experimenten plaatsvonden in kaart te brengen, kon het team afleiden welke eiwitten wel werden getest maar er niet in slaagden te verbinden.

Met behulp van deze logica veranderde het onderzoeksteam een lijst van ongeveer een half miljoen gerapporteerde interacties in een veel grotere dataset die bijna 182 miljoen individuele tests bevatte. Hiermee identificeerden ze 97 miljoen unieke paren eiwitten die waren getest. Cruciaal was dat ze nu de paren konden scheiden die waren getest en een interactie vertoonden van de paren die waren getest en niet een interactie vertoonden. Ze concentreerden zich op de meest betrouwbare gegevens: paren die meerdere keren waren getest. Ze identificeerden meer dan 18 miljoen paren die minstens drie keer waren getest en nooit enig teken van verbinding vertoonden. Dit zijn geen gissingen; het zijn experimenteel bevestigde niet-verbindingen. Het team vond ook meer dan 6.000 paren die herhaaldelijk waren getest en consequent een verbinding lieten zien, wat hen een hoge mate van vertrouwen gaf dat deze interacties echt zijn.

De onderzoekers controleerden vervolgens of deze nieuw gevonden niet-verbindingen biologisch zin maakten. Ze keken of eiwitten die met elkaar interageerden gemeenschappelijke kenmerken deelden, zoals in hetzelfde deel van de cel leven of soortgelijke taken uitvoeren, terwijl de niet-interagerende paren dat niet deden. De resultaten kwamen precies overeen met de verwachtingen. De bevestigde interagerende paren waren veel waarschijnlijker om deze kenmerken te delen dan de bevestigde niet-interagerende paren. Deze validatie bewees dat de methode werkte: het team had succesvol een laag van negatief bewijs teruggewonnen dat voorheen verloren was gegaan. Ze ontdekten dat eiwitten die er niet in slaagden te verbinden, inderdaad functioneel verschillend waren van de eiwitten die dat wel deden, wat bevestigde dat de gereconstrueerde gegevens niet slechts willekeurige ruis waren, maar een ware reflectie van de biologische realiteit.

Met deze nieuwe, geverifieerde lijst van niet-verbindingen testte het team hoe het de instrumenten die wetenschappers gebruiken om deze netwerken te bestuderen, kon verbeteren. Eerst gebruikten ze de gegevens om de nauwkeurigheid van andere grootschalige experimenten te controleren. Door te kijken hoe vaak deze nieuwe "negatieve" paren in andere studies voorkwamen, konden ze berekenen hoeveel valse alarmen die studies mogelijk hadden gegenereerd. Ze ontdekten dat sommige experimenten foutmarges van wel 40% hadden, wat betekent dat een groot deel van hun gerapporteerde verbindingen fouten kunnen zijn. Dit biedt een nieuwe manier om toekomstige experimenten te kalibreren en op te schonen. Ten tweede testten ze de gegevens op computermodellen die ontworpen zijn om interacties te voorspellen. Wanneer ze deze modellen trainden met de nieuwe, echte negatieve gegevens in plaats van willekeurige gissingen, produceerden de modellen verschillende en meer onderscheidende voorspellingen. De modellen getraind op echte negatieve gegevens maakten minder snel dezelfde fouten als die getraind op willekeurige gissingen, wat suggereert dat het hebben van een echt verslag van wat niet gebeurt, essentieel is om computers te leren wat wel gebeurt.

De studie onthulde ook iets verrassends over de eiwitten zelf. Sommige eiwitten staan erom bekend dat ze aan alles plakken wat ze aanraken, als biologische lijm, terwijl andere "auto-activatoren" zijn die valse alarmen triggeren in gistexperimenten. Door te kijken hoe vaak een eiwit tegen veel verschillende partners werd getest en hoe vaak het er niet in slaagde te verbinden, kon het team deze problematische eiwitten identificeren. Ze ontdekten dat de bekende probleemgevallen inderdaad de eiwitten waren die schijnbaar ongeacht hun partner ongecontroleerd verbindingen aangingen. Dit biedt een nieuwe manier om deze luidruchtige eiwitten te markeren en weg te filteren in toekomstig onderzoek, wat leidt tot schonere en nauwkeurigere kaarten.

Ten slotte gebruikten de onderzoekers deze gegevens om de algehele vorm van het menselijke interactienetwerk te heroverwegen. Lange tijd geloofden wetenschappers dat het netwerk een specifiek wiskundig patroon volgde waarbij een paar eiwitten duizenden verbindingen hebben en de meeste er slechts zeer weinig hebben. Echter, toen het team corrigeerde voor het feit dat sommige eiwitten simpelweg vaker werden getest dan andere, verdween dit patroon. In plaats daarvan zag de verdeling van verbindingen er meer uit als een klokcurve, wat suggereert dat de extreme "hubs" die in eerdere kaarten te zien waren, eerder een artefact zijn van hoe de experimenten werden uitgevoerd dan een werkelijk kenmerk van de biologie. Deze bevinding daagt een langgekoesterde aanname uit over hoe onze cellulaire netwerken zijn opgebouwd.

Het werk beweert niet dat het de kaart van het menselijke interactoom heeft voltooid. Het echte netwerk is nog steeds enorm en grotendeels onverkend. Echter, door de geschiedenis van mislukte experimenten te reconstrueren, heeft het team een cruciale ontbrekende puzzelstuk geleverd. Ze hebben aangetoond dat de afwezigheid van bewijs, wanneer deze correct wordt gereconstrueerd, ook daadwerkelijk bewijs van afwezigheid is. Deze nieuwe bron, die miljoenen bevestigde niet-verbindingen bevat, staat nu beschikbaar voor andere wetenschappers om te gebruiken. Het biedt een manier om betere computers te trainen, betere experimenten te kalibreren en uiteindelijk een nauwkeuriger en completer beeld te vormen van hoe het menselijk lichaam functioneert op zijn meest fundamentele niveau.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →