Targeted finetuning enables co-folding models to learn ligand-induced protein conformational states
Cet article démontre que le réglage fin ciblé de modèles de fondation tels que Boltz-1 peut surmonter les biais des données d'entraînement pour prédire avec précision de nouveaux états conformationnels de protéines induits par des ligands ainsi que des sites de liaison allostérique, permettant ainsi des applications de découverte de médicaments plus efficaces.
Article original sous licence CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA d'un preprint qui n'a pas été évalué par des pairs. Ce n'est pas un avis médical. Ne prenez pas de décisions de santé basées sur ce contenu. Lire la clause de non-responsabilité complète
Depuis des décennies, les scientifiques cherchent un moyen de prédire la forme tridimensionnelle d'une protéine en examinant simplement son code génétique. C'est un exploit de taille, car les protéines ne sont pas des tiges rigides mais des chaînes flexibles qui se tordent et tournent pour adopter des formes complexes afin d'accomplir leurs fonctions. Ces dernières années, de puissants modèles informatiques sont apparus, capables de prédire ces formes avec une précision remarquable, même lorsqu'une protéine est liée à une petite molécule, comme un médicament. Ces modèles, souvent appelés outils de co-repliement (co-folding), sont entraînés sur de vastes bibliothèques de structures connues, apprenant les règles générales de l'ajustement entre les protéines et les molécules. Cependant, un obstacle important subsiste : ces modèles éprouvent souvent des difficultés face à une protéine qui change de forme en réponse à un nouveau médicament, ou lorsqu'un médicament se lie à une partie de la protéine qui n'avait jamais été vue auparavant. Si un modèle ne peut pas percevoir ces changements, il ne peut pas aider les chercheurs à concevoir des médicaments qui reposent sur eux, laissant ainsi un fossé entre ce que l'ordinateur prédit et ce qui se passe réellement dans une cellule vivante.
Une équipe de chercheurs a récemment comblé ce fossé en démontrant que l'échec de ces modèles n'est pas dû à un défaut de conception, mais plutôt à un biais dans les données avec lesquelles ils ont été enseignés. Ils ont démontré qu'en enseignant soigneusement au modèle quelques nouveaux exemples spécifiques, celui-ci pouvait apprendre à prédire des comportements complexes et inédits. En utilisant dix nouvelles images de rayons X d'une protéine appelée hélicase de Werner, impliquée dans la réparation de l'ADN et étudiée lors d'un programme de découverte de médicaments, les chercheurs ont pris un modèle existant puissant et lui ont donné une leçon ciblée. Ils lui ont montré comment cette protéine se verrouille dans un état inactif lorsqu'un médicament spécifique se lie à un site inhabituel, un changement que le modèle original n'avait jamais rencontré. Le résultat fut un modèle capable non seulement de prédire cette nouvelle forme verrouillée, mais aussi d'identifier correctement le site de liaison du médicament, tout en conservant sa capacité originale à prédire la forme normale et active de la protéine.
Les chercheurs ont constaté que ce nouveau modèle entraîné ne s'était pas contenté de mémoriser ces dix images spécifiques. Il avait appris la logique sous-jacente de la manière dont le médicament force la protéine à changer, ce qui lui a permis de généraliser à différentes séries chimiques de médicaments qu'il n'avait jamais vues auparavant. De plus, cette nouvelle compréhension s'est transférée à d'autres protéines de la même famille, connues sous le nom d'hélicases RecQ, mais uniquement lorsque la séquence spécifique du site de liaison correspondait à la logique que le modèle avait apprise. Cela suggère que le modèle avait véritablement saisi le mécanisme du changement plutôt que de simplement copier les formes. Ce travail indique que ces puissants modèles informatiques peuvent être adaptés à mesure que de nouvelles données structurelles deviennent disponibles, permettant de capturer les commutateurs subtils induits par le ligand, qui sont au cœur de la régulation biologique et de la manière dont les médicaments peuvent intervenir. En montrant que la limitation réside dans les données d'entraînement plutôt que dans l'architecture, l'étude trace une voie claire pour la mise à jour de ces outils afin qu'ils puissent gérer la nature dynamique et changeante des protéines dans le monde réel.
Noyé(e) sous les articles dans votre domaine ?
Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.