Predicting single mutation effects on binding affinity at protein-protein interfaces based on MMPBSA calculations
Cet article présente un flux de travail basé sur la physique et convivial utilisant des calculs MMPBSA pour prédire avec précision les effets des substitutions d'acides aminés uniques sur l'affinité de liaison protéine-protéine et protéine-peptide, démontrant une performance qui égale ou dépasse les méthodes établies à travers diverses cibles, y compris les complexes de la protéine de pointe du SARS-CoV-2.
Article original sous licence CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA d'un preprint qui n'a pas été évalué par des pairs. Ce n'est pas un avis médical. Ne prenez pas de décisions de santé basées sur ce contenu. Lire la clause de non-responsabilité complète
Les protéines sont les moteurs de la vie, de minuscules machines moléculaires qui se replient en formes spécifiques pour accomplir des tâches, allant du transport de l'oxygène dans le sang à la lutte contre les infections. Souvent, ces protéines doivent trouver et s'arrimer à d'autres protéines pour fonctionner, un processus dicté par l'ajustement précis de leurs surfaces. Lorsqu'un seul bloc de construction, ou acide aminé, dans l'une de ces protéines change, cela peut être comme remplacer une seule brique dans un mur ; parfois la structure tient bon, mais d'autres fois, toute la connexion s'affaiblit ou échoue. Prédire exactement comment un changement unique modifiera la force de ce lien est un défi majeur pour les scientifiques. S'ils pouvaient le faire de manière fiable, ils pourraient concevoir de meilleurs médicaments, l'ingénierie d'enzymes pour nettoyer la pollution, ou comprendre pourquoi certaines mutations génétiques provoquent des maladies. Pendant des années, les chercheurs ont tenté de construire des programmes informatiques capables de calculer ces changements, mais les résultats ont souvent été mitigés, peinant à équilibrer vitesse et précision.
Une équipe de chercheurs de l'Université de Bayreuth, en Allemagne, a développé une nouvelle façon de réaliser ces prédictions, offrant un outil qui est à la fois rapide et étonnamment précis. Leur approche repose sur une méthode appelée MMPBSA, qui signifie « Molecular Mechanics Poisson-Boltzmann Surface Area » (Surface d'Aire de Poisson-Boltzmann de Mécanique Moléculaire). En termes simples, il s'agit d'un calcul basé sur la physique qui estime l'énergie requise pour maintenir deux protéines ensemble. L'équipe a réalisé que, bien que les programmes informatiques existants puissent deviner l'énergie d'une protéine, ils manquaient souvent les changements subtils causés par une seule mutation. Pour corriger cela, les chercheurs ont utilisé une vaste collection de données expérimentales — plus de 1 600 cas enregistrés où des scientifiques avaient mesuré comment un changement d'acide aminé affectait la liaison des protéines — pour entraîner leur nouveau système de notation. Ils ne se sont pas appuyés sur une intelligence artificielle complexe qui apprend des modèles à partir de données seules ; au lieu de cela, ils ont construit un modèle mathématique direct qui pondère différentes forces physiques, telles que la façon dont les atomes s'attirent ou se repoussent et la manière dont les molécules d'eau interagissent avec la surface de la protéine.
Les chercheurs ont testé leur nouvelle méthode contre deux concurrents établis : un logiciel largement utilisé appelé FoldX, qui repose sur des règles empiriques, et un outil de pointe basé sur l'apprentissage profond nommé DDMut-PPI, qui utilise l'intelligence artificielle. Ils ont d'abord exécuté leurs calculs sur le même ensemble de données utilisé pour entraîner l'intelligence artificielle. Ici, l'outil d'apprentissage profond a obtenu des performances exceptionnelles, prédisant correctement l'issue de la plupart des mutations. Cependant, ce score élevé était attendu, car l'intelligence artificielle avait été entraînée spécifiquement sur ces chiffres. Le véritable test est venu lorsque l'équipe a appliqué les trois méthodes à des scénarios entièrement nouveaux où les modèles informatiques n'avaient jamais vu les données auparavant. Dans un test, ils ont examiné les mutations de la protéine de pointe du virus responsable de la COVID-19, spécifiquement la façon dont elle se lie aux cellules humaines. Dans un autre, ils ont examiné des protéines artificielles conçues pour saisir des chaînes peptidiques spécifiques.
Dans ces nouvelles situations inédites, les résultats ont radicalement changé. L'outil d'apprentissage profond, qui excellait sur ses données d'entraînement, a eu du mal à classer correctement les mutations, montrant une faible capacité à distinguer les changements bénéfiques des changements nocifs. Le logiciel traditionnel, FoldX, a produit de nombreuses erreurs importantes, prédisant souvent qu'une mutation aurait un effet massif alors qu'elle n'en avait aucun, ou inversement. En revanche, la nouvelle méthode basée sur MMPBSA a maintenu une performance constante. Elle a réussi à prédire la force des liaisons tant dans la protéine de pointe virale que dans les protéines artificielles, égalant ou dépassant la précision des autres outils. Les chercheurs ont constaté que leur méthode était particulièrement efficace pour gérer la physique complexe des particules chargées et des interactions de l'eau, qui sont souvent la source d'erreurs dans les autres programmes. Ils ont également découvert que l'inclusion d'un terme pour la stabilité des pièces individuelles de la protéine, plutôt que seulement le lien entre elles, était crucial pour obtenir la bonne réponse.
L'étude suggère que si l'intelligence artificielle est puissante, elle peut parfois devenir trop spécialisée sur les données qu'elle apprend, échouant à s'adapter face à de nouveaux puzzles biologiques. L'approche basée sur la physique, en s'appuyant sur les lois fondamentales de la nature plutôt que sur des modèles mémorisés, s'est avérée plus robuste lors de l'application à différents types de protéines et de structures. L'équipe a rendu son flux de travail accessible au public, permettant à d'autres scientifiques d'utiliser cet outil pour prioriser les mutations à tester en laboratoire. En filtrant les candidats les plus prometteurs avant de lancer des expériences coûteuses, cette méthode pourrait accélérer le développement de nouvelles thérapies et l'ingénierie de meilleurs outils biologiques. Ce travail démontre que, parfois, revenir aux premiers principes et peser soigneusement les forces physiques en jeu peut donner des résultats plus fiables que les algorithmes les plus complexes, surtout lorsque l'objectif est de comprendre comment un changement infime dans une molécule peut se répercuter pour changer le comportement d'un système vivant.
Noyé(e) sous les articles dans votre domaine ?
Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.