← 최신 논문
🤖 machine learning

DeMixPert: Decomposed Response Modeling with Gaussian Mixtures for OOD Single-Cell Perturbation Prediction

DeMixPert는 전사체 반응을 기저 의존적 체계적 변화, 섭동 특이적 신호, 그리고 적응형 가우시안 혼합 모델을 통해 모델링된 집단 수준의 변이로 분해함으로써, 미지의 유전적 섭동에 대한 이질적인 세포 반응을 효과적으로 포착하여 분포 외(out-of-distribution) 단일 세포 섭동 예측을 개선하는 새로운 프레임워크이다.

원저자: Jiawen Liu, Xuechenxiao Cao, Yutong Li, Bing Liu, Jiaming Liang, Tinghe Zhang, Xiaoqi Sheng, Hongmin Cai

게시일 2026-08-25
📖 4 분 읽기☕ 가벼운 읽기

원저자: Jiawen Liu, Xuechenxiao Cao, Yutong Li, Bing Liu, Jiaming Liang, Tinghe Zhang, Xiaoqi Sheng, Hongmin Cai

원본 논문은 CC0 1.0 (http://creativecommons.org/publicdomain/zero/1.0/)에 따라 공공 도메인에 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

살아있는 신체라는 미세한 세계 속에서, 모든 세포는 화학 반응이 분주하게 일어나는 하나의 도시와 같으며, 주변 환경에 적응하기 위해 자신의 지침서를 끊임없이 읽고 다시 써 내려갑니다. 과학자들이 특정 변화—예를 들어 유전자가 꺼지거나 약물이 도입되는 것과 같은 변화—에 세포가 어떻게 반응하는지 이해하고자 할 때, 그들은 유전적 섭동(genetic perturbation)을 수행할 수 있습니다. 이는 연구자들이 단 하나의 유전자를 조작하고 그에 따라 세포의 전체적인 유전 활동이 어떻게 변화하는지 관찰하는 통제된 실험입니다. 그러나 가능한 유전자, 세포 유형, 그리고 환경 조건의 조합은 너무나 방대하여 실험실에서 그 모든 것을 테스트하는 것은 불가능합니다. 컴퓨터 과학자들의 과제는 단순히 평균적인 결과를 추측하는 것이 아니라, 서로 다른 세포들이 보이는 반응의 전체적인 다양성을 포착함으로써, 보지 못한 반응들을 정확하게 예측할 수 있는 모델을 구축하는 것입니다.

수년 동안, 이러한 세포 반응을 예측하려는 컴퓨터 모델들은 근본적인 문제로 인해 어려움을 겪어 왔습니다. 즉, 이 모델들은 서로 다른 유형의 생물학적 변화 사이의 경계를 모호하게 만드는 경우가 많다는 점입니다. 오케스트라 전체가 크게 연주하고 있는 동안 특정 악기의 소리를 듣고자 노력하는 상황을 상상해 보십시오. 그 한 악기의 독특한 소리는 일반적인 소음 속에 묻혀버리고 맙니다. 이와 유사하게, 기존 모델들은 거의 모든 세포에서 공통적으로 발생하는 예측 가능한 변화와, 특정 유전적 조작에 의해 발생하는 고유하고 구체적인 변화, 그리고 개별 세포 간에 자연적으로 발생하는 무작위적인 변이를 서로 혼동하곤 합니다. 이러한 얽힘은 모델이 이전에 본 적 없는 특정 유전적 변화의 진정한 효과를 파악하는 것을 어렵게 만듭니다.

이를 해결하기 위해, 남중국 공과대학교의 지아원 리우(Jiawen Liu)와 동료 연구진은 DeMixPert라고 불리는 새로운 접근 방식을 개발했습니다. 이 방식은 전체적인 세포 반응을 하나의 크고 무질서한 덩어리로 예측하는 대신, 문제를 세 가지 뚜렷한 부분으로 나눕니다. 첫째, 특정 유전자가 표적이 되는 것과 상관없이 세포의 초기 상태에 따라 발생하는 예측 가능한 변화인 '체계적(systematic)' 반응을 식별합니다. 둘째, 특정 유전적 변화 자체에 의해 남겨진 고유한 지문인 '섭동 특이적(perturbation-specific)' 반응을 분리합니다. 마지막으로, 어떤 세포가 이웃한 세포와 약간 다르게 반응하게 만드는 자연스럽고 무작위적인 개별 세포 간의 차이를 나타내는 '집단 수준의 변이(population-level variation)'를 고려합니다. 이 세 가지 층위를 분리함으로써, 모델은 각 층위의 규칙을 독립적으로 학습한 다음 이를 다시 결합하여 훨씬 더 명확한 예측을 만들어낼 수 있습니다.

이 새로운 시스템의 핵심은 세포 간의 무작위적인 변이를 처리하는 영리한 방식에 달려 있습니다. 연구진은 이러한 변이를 단순한 무작위 소음이 아니라, 상황에 따라 다양한 방식으로 혼합될 수 있는 별개의 패턴, 즉 '프로토타입(prototypes)'의 집합으로 취급합니다. 그들은 모델이 세포의 초기 상태와 특정 유전적 변화를 살펴보고, 이 미리 학습된 패턴들을 어떻게 혼합하여 해당 세포가 어떻게 행동할지에 대한 현실적인 예측을 만들어낼지 결정할 수 있게 하는 수학적 구조를 사용합니다. 이를 통해 모델은 단순히 평평한 평균값을 예측하는 것이 아니라, 실제 세포 집단의 진정한 다양성을 반영하는 광범위한 결과들을 생성할 수 있습니다.

연구팀이 네 가지 대규모 유전 실험 데이터를 사용하여 이 방법을 기존 도구들과 비교 테스트했을 때, 그 결과는 놀라웠습니다. 모델이 한 번도 본 적 없는 유전적 변화에 대한 반응을 예측해야 하는 상황에서, DeMixPert는 일관되게 경쟁 모델들을 압도했습니다. 특히 어떤 유전자가 켜지거나 꺼질지를 식별하는 데 탁월했는데, 한 데이터셋에서 다른 방법들이 한 자릿수 점수를 기록한 것과 달리 22.000이라는 공통 차별 발현 유전자(C-DEGs) 점수를 달성했습니다. 더 중요한 점은, 이 모델이 단순히 평균을 맞히는 데 그치지 않고 실제 실험에서 보이는 복잡하고 다양한 반응의 분포를 성공적으로 재현했다는 것입니다. 다른 모델들이 평균적으로는 맞는 것처럼 보이지만 개별 세포의 다양한 행동 양식은 포착하지 못하는 예측을 내놓는 반면, DeMixPert는 전체 집단의 충실도를 유지했습니다.

이 연구는 왜 이러한 구성 요소의 분리가 잘 작동하는지에 대한 명확한 통찰을 제공했습니다. 연구진이 데이터를 시각화했을 때, 예측에서 '체계적' 부분을 제거하면 서로 다른 유전적 변화의 고유한 특징들이 훨씬 더 명확하고 구별하기 쉬워진다는 것을 발견했습니다. 이는 기존 모델들이 세포의 시작 상태라는 배경 소음 때문에 유전적 변화의 특정 신호를 가로막고 있었다는 사실을 확인시켜 주었습니다. 예측을 하기 전에 그 배경 소음을 명시적으로 제거함으로써, 새로운 모델은 정말로 중요한 것에 집중할 수 있게 됩니다. 이러한 발견은 컴퓨터 모델이 진정으로 세포의 작동 원리를 이해하기 위해서는, 모든 변화를 단일한 사건으로 취급하는 것을 멈추고 그 변화를 주도하는 생물학적 층위들을 인식해야 한다는 점을 시사합니다. 이 접근 방식은 세포의 행동을 시뮬레이션하는 더 정밀한 방법을 제공하며, 이는 궁극적으로 연구자들이 실험실에서 모든 가능성을 일일이 테스트하지 않고도 치료제에 세포가 어떻게 반응할지를 예측함으로써 더 나은 치료법을 설계하는 데 도움을 줄 수 있습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →