Multi-Layer Single-Cell Integration with Deep Embedded Clustering Reveals Metabolic Heterogeneity in Peripheral Blood Mononuclear Cells
本研究引入了一种多层深度嵌入聚类框架,该框架整合了转录组学、蛋白质组学和代谢组学数据,以揭示外周血单核细胞中此前未被发现的代谢异质性和线粒体细胞簇,其表现显著优于标准的两层聚类方法。
原始论文采用 CC BY 4.0 许可(https://creativecommons.org/licenses/by/4.0/)。 这是一篇未经同行评审的预印本的AI生成解释。这不是医疗建议。请勿根据此内容做出健康决定。 阅读完整免责声明
为了理解一个活细胞,科学家长期以来一直依赖于阅读它的“说明书”——基因组,以及它发出的信息——转录组。多年来,这是区分一种细胞与另一种细胞的主要方式。然而,一个细胞不仅仅是它的指令;它还由其表面携带的物理工具及其维持生命所消耗的化学能量所定义。近年来,技术已经进步到研究人员可以在单个细胞内测量这些不同层面——哪些基因在活跃、存在哪些蛋白质以及正在发生哪些代谢活动——的程度。这种转变让科学家能够看到细胞生命的完整图景,而不仅仅是一个单一的快照。现在的疑问是,将所有这些层面结合在一起,究竟是揭示了关于细胞如何运作的更深层真理,还是多余的数据仅仅为信号增加了噪声。
一位研究人员致力于通过建立一种新的方法,根据人类免疫细胞的三种不同信息层面——其遗传活性、表面蛋白和代谢状态——来对它们进行分组。研究者将重点放在外周血单核细胞上,这是一类在体内循环并对抗感染的多样化白细胞。虽然以往的方法已成功地将遗传数据与表面蛋白结合起来,但它们通常忽略了代谢,即为细胞提供动力的化学反应过程。研究人员认为,代谢不仅仅是一个背景过程,它更是衡量一个细胞在任何给定时刻实际在做什么的直接指标。为了测试这一点,他们分析了一个包含近 44,000 个单个细胞的海量数据集,为每个细胞测量了超过 20,000 个基因和 204 种表面蛋白。随后,他们计算了六个关键代谢途径(例如细胞如何产生能量)的活性,从而为每一个单独的细胞创建了第三层数据。
研究人员使用了一种复杂的计算机方法,将这三个层面编织在一起,形成每个细胞的统一视图。他们并没有仅仅观察原始数字,而是训练了一个数字模型来学习连接基因、蛋白质和代谢的隐藏模式。随后,该模型根据它们的综合特征将细胞进行聚类分组。当他们将这种新方法与仅使用基因和蛋白质的标准方法进行比较时,结果令人震惊。这种三层法创造了更加清晰且更具辨识度的细胞群体。事实上,与旧方法相比,新方法将分组质量提高了 5 0% 以上。然而,最重要的发现不仅在于数字上的提升,还在于发现了一个此前一直处于“隐身”状态的特定细胞群。
当研究人员观察由完整的三层模型形成的聚类时,他们发现了一个只有在加入代谢数据后才会出现的独特细胞群。这一群体的特征是细胞“发电厂”(即线粒体)的活性水平很高,而通常定义特定免疫细胞类型的基因活性水平较低。在忽略代谢的旧方法中,这些细胞要么散落在其他群体中,要么隐藏在其中。新的分析显示,这些细胞形成了一个紧密的、独立的社区,表明它们处于一种由能量使用而非其谱系驱动的独特活动状态。这一发现证实了代谢提供了一个独特的维度信息,这是仅靠基因和蛋白质无法捕捉到的。
该研究还测试了用于寻找这些群体的计算机方法是否优于科学家通常依赖的传统工具。他们在完全相同的数据上,将这种新的深度学习方法与标准的基于图的方法进行了对比。新方法在每一项准确性指标上都一致地优于标准工具,创造了更紧密且分离度更高的群体。这表明,新模型学习连接不同数据层的方式,在寻找细胞真实的生物学结构方面更为有效。研究人员验证了这些结果是稳定的,这意味着结果不会因为计算机从不同的随机排列开始而发生变化,并且即使在数据带有轻微噪声的情况下依然成立。
最终,这项工作表明,要真正理解免疫细胞的多样性,科学家必须超越遗传密码和表面标记,将细胞的代谢状态纳入考虑。能够检测到此前被忽视的线粒体集群,说明忽略代谢会在我们对细胞行为的理解中留下盲点。通过成功整合这三个层面,研究人员提供了一张更完整的细胞身份地图,这张地图揭示了隐藏的活动状态,并为研究细胞在健康和疾病状态下如何运作提供了更准确的方法。这种方法为科学家如何结合不同类型的生物学数据,以揭示单细胞水平上生命的完整复杂性,树立了新的标准。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。