Predicting Lassa Virus Glycoprotein Mutations Affecting Viral Entry and Antibody Escape
本研究提出了一种使用 XGBoost 的集成机器学习框架,用于预测拉萨病毒糖蛋白突变如何影响病毒进入和抗体逃逸,从而识别保守表位并指导设计具有广泛有效性的疫苗和治疗药物。
原始论文采用 CC BY 4.0 许可(https://creativecommons.org/licenses/by/4.0/)。 这是一篇未经同行评审的预印本的AI生成解释。这不是医疗建议。请勿根据此内容做出健康决定。 阅读完整免责声明
在拥挤的传染病世界中,一些病毒是伪装大师,通过不断重塑其外壳来逃避免疫系统的防御。拉萨病毒(Lassa virus)就是这样一种病毒,它是一种在西非引起严重出血热的危险病原体。该病毒在其表面携带一组特定的蛋白质,就像一把钥匙,可以开启人类细胞的大门。这种表面结构是病毒与外界接触的唯一途径,使其成为人体抗体攻击的主要目标,也是任何潜在疫苗研发的焦点。由于该病毒复制迅速且频繁出错,这些表面蛋白质经常发生变化。有些变化有助于病毒更容易进入细胞,而另一些则能让它避开那些通常会将其中和的抗体。准确了解哪些变化是无害的、哪些是危险的,以及哪些能让病毒逃避检测,对于开发能够跟上病毒快速进化步伐的疗法至关重要。
尼日利亚救赎者大学(Redeemer's University)的一个研究小组致力于利用一种强大的计算方法来绘制这些变化图谱。他们并没有等待观察病毒在实验室中对每一种可能的突变如何反应,而是构建了一个数字预测系统。他们收集了以往实验的数据,在这些实验中,科学家已经测试了数千种拉萨病毒表面蛋白质的具体变化。利用这一历史记录,研究人员训练计算机算法来识别模式。其目标是教计算机观察蛋白质代码中的特定变化——变化的位置、原始的构建模块以及取代它的新构建模块——并预测两件事:病毒是否仍能有效地进入细胞,以及该变化是否能帮助病毒逃避特定抗体的作用。
研究人员测试了几种不同类型的机器学习模型,以观察哪一种能学习到最准确的模式。他们发现,最成功的方法是一种构建庞大决策树森林的方法,其中每棵树做出一个小猜测,然后由群体结合它们的答案以得出最终结论。事实证明,这种方法远优于那些试图在数据中画出直线图的简单模型。在针对未见过的突变进行测试时,这种表现最好的模型大约有87%的概率能正确识别突变是否会阻碍病毒进入细胞。分析揭示了病毒进化中一种迷人的平衡。在当地流行的三种主要拉萨病毒谱系中,允许病毒进入细胞的突变与阻止病毒进入细胞的突变几乎同样常见。这表明病毒处于一种走钢丝的状态:虽然许多变化都是可能的,但其结构必须保持足够稳定以维持功能。
或许最显著的发现涉及不同的抗体如何应对这些突变。研究人员发现,病毒逃避某种抗体的能力完全取决于抗体针对的是病毒的哪个部分。一些抗体锁定在病毒表面的柔性部分,面临着广阔的潜在逃逸路径;病毒可以通过许多不同的方式进行改变以避开它们。而其他针对病毒结构中僵硬、核心部分的抗体,面临的逃逸景观则受限得多。对于这些抗体,病毒若要改变自身,就只有极少数选择,否则就会破坏其感染细胞的能力。研究表明,一种被称为25.10C的特定抗体最容易被逃避,而其他抗体(如37.2D和37.7H)则更难被病毒规避。
这项工作为科学家提供了一个实用的工具,用以优先确定哪些突变值得关注,以及哪些抗体组合能提供最佳保护。通过识别那些过于重要而无法改变的病毒部分,研究人员为那些不太可能被未来突变击败的疫苗靶点指明了方向。研究证实,尽管拉萨病毒在不断变化,但其维持功能的需求限制了它能改变的程度。计算机模型成功捕捉到了这些生物学规则,提供了一种预判病毒下一步行动并设计出能保持领先地位的疗法的方法。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。