Predicting single mutation effects on binding affinity at protein-protein interfaces based on MMPBSA calculations
Este artigo apresenta um fluxo de trabalho baseado em física e de fácil utilização, utilizando cálculos de MMPBSA para prever com precisão os efeitos de substituições de aminoácidos únicos na afinidade de ligação proteína-proteína e proteína-peptídeo, demonstrando um desempenho que iguala ou excede métodos estabelecidos em diversos alvos, incluindo complexos da proteína spike do SARS-CoV-2.
Artigo original sob licença CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA de um preprint que não foi revisado por pares. Não é aconselhamento médico. Não tome decisões de saúde com base neste conteúdo. Ler aviso legal completo
As proteínas são os cavalos de batalha da vida, minúsculas máquinas moleculares que se dobram em formas específicas para realizar tarefas, desde transportar oxigênio no sangue até combater infecções. Frequentmente, essas proteínas precisam encontrar e travar em outras proteínas para funcionar, um processo impulsionado pelo ajuste preciso de suas superfícies. Quando um único bloco de construção, ou aminoácido, em uma dessas proteínas muda, pode ser como trocar um único tijolo em uma parede; às vezes a estrutura permanece firme, mas outras vezes toda a conexão enfraquece ou falha. Prever exatamente como uma única mudança alterará a força desse vínculo é um grande desafio para os cientistas. Se eles pudessem fazer isso de forma confiável, poderiam projetar medicamentos melhores, engenheirar enzimas para limpar a poluição ou entender por que certas mutações genéticas causam doenças. Por anos, pesquisadores tentaram construir programas de computador que pudessem calcular essas mudanças, mas os resultados eram frequentemente incertos, lutando para equilibrar velocidade com precisão.
Uma equipe de pesquisadores da Universidade de Bayreuth, na Alemanha, desenvolveu uma nova maneira de fazer essas previsões, oferecendo uma ferramenta que é rápida e surpreendentemente precisa. A abordagem deles baseia-se em um método chamado MMPBSA, que significa Área de Superfície de Poisson-Boltzmann de Mecânica Molecular. Em termos simples, este é um cálculo baseado na física que estima quanta energia é necessária para manter duas proteínas unidas. A equipe percebeu que, embora os programas de computador existentes pudessem adivinhar a energia de uma proteína, eles frequentemente perdiam as sutis mudanças causadas por uma única mutação. Para corrigir isso, os pesquisadores pegaram uma vasta coleção de dados experimentais — mais de 1.600 instâncias registradas onde cientistas mediram como uma mudança de um único aminoácido afetou a ligação proteica — e as utilizaram para treinar seu novo sistema de pontuação. Eles não dependeram de inteligência artificial complexa que aprende padrões apenas a partir de dados; em vez disso, construíram um modelo matemático direto que pondera diferentes forças físicas, como o modo como os átomos se atraem ou se repelem e como as moléculas de água interagem com a superfície da proteína.
Os pesquisadores testaram seu novo método contra dois competidores estabelecidos: um software amplamente utilizado chamado FoldX, que se baseia em regras empíricas, e uma ferramenta de aprendizado profundo de última geração chamada DDMut-PPI, que utiliza inteligência artificial. Primeiro, eles rodaram seus cálculos no mesmo conjunto de dados usado para treinar o modelo de inteligência artificial. Aqui, a ferramenta de aprendizado profundo teve um desempenho excepcional, prevendo corretamente o resultado para a maioria das mutações. No entanto, esse alto índice era esperado, pois a inteligência artificial havia sido treinada especificamente para esses números. O verdadeiro teste veio quando a equipe aplicou os três métodos a cenários inteiramente novos, onde os modelos de computador nunca haviam visto os dados antes. Em um teste, eles observaram mutações na proteína spike do vírus que causa a COVID-19, especificamente como ela se liga às células humanas. Em outro, examinaram proteínas projetadas para agarrar cadeias de peptídeos específicas.
Nessas novas situações inéditas, os resultados mudaram drasticamente. A ferramenta de aprendizado profundo, que havia se destacado em seus dados de treinamento, teve dificuldades para classificar as mutações corretamente, mostrando uma capacidade fraca de distinguir entre mudanças benéficas e prejudiciais. O software tradicional, FoldX, produziu muitos erros grandes, muitas vezes prevendo que uma mutação teria um efeito massivo quando não tinha nenhum, ou vice-versa. Em contraste, o novo método baseado em MMPBSA manteve um desempenho constante. Ele previu com sucesso a força das ligações tanto na proteína spike viral quanto nas proteínas projetadas, igualando ou excedendo a precisão das outras ferramentas. Os pesquisadores descobriram que seu método era particularmente bom em lidar com a física complexa de partículas carregadas e interações com a água, que são frequentemente a fonte de erros em outros programas. Eles também descobriram que incluir um termo para a estabilidade das partes individuais da proteína, em vez de apenas o vínculo entre elas, foi crucial para obter a resposta correta.
O estudo sugere que, embora a inteligência artificial seja poderosa, ela pode, às vezes, tornar-se excessivamente especializada nos dados dos quais aprende, falhando em se adaptar quando confrontada com novos enigmas biológicos. A abordagem baseada na física, ao depender das leis fundamentais da natureza em vez de padrões memorizados, provou ser mais robusta ao ser aplicada a diferentes tipos de proteínas e estruturas. A equipe disponibilizou seu fluxo de trabalho ao público, permitindo que outros cientistas utilizem essa ferramenta para priorizar quais mutações testar em laboratório. Ao filtrar os candidatos mais promissores antes de realizar experimentos caros, este método pode acelerar o desenvolvimento de novas terapias e a engenharia de melhores ferramentas biológicas. O trabalho demonstra que, às vezes, retornar aos princípios fundamentais e ponderar cuidadosamente as forças físicas em jogo pode gerar resultados mais confiáveis do que os algoritmos mais complexos, especialmente quando o objetivo é entender como uma pequena mudança em uma molécula pode repercutir para mudar o comportamento de um sistema vivo.
Afogado em artigos na sua área?
Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.