← 최신 논문
🧬 biology

Leveraging Structural Variants to Unlock Hidden Genetic Diversity for Tomato Crop Improvement

이 연구는 다양한 토마토 계통으로부터 비용 효율적인 숏리드 시퀀싱 데이터를 재활용하는 것이 71,000개 이상의 고신뢰도 구조 변이를 발견할 수 있음을 입증하며, 이를 통해 추가적인 롱리드 시퀀싱 투자 없이도 육종 워크플로우를 개선하고 계통 관계를 규명하는 데 핵심적이고 이전에 숨겨져 있던 유전적 다양성의 동인임을 밝혀낸다.

원저자: Reza Shekasteband

게시일 2026-08-21
📖 4 분 읽기☕ 가벼운 읽기

원저자: Reza Shekasteband

원본 논문은 CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. ⚕️ 이것은 동료 심사를 거치지 않은 프리프린트의 AI 생성 설명입니다. 의학적 조언이 아닙니다. 이 내용을 바탕으로 건강 관련 결정을 내리지 마세요. 전체 면책 조항 읽기

토마토는 세계에서 가장 중요한 채소 중 하나이며, 수십 년 동안 과학자들은 왜 어떤 식물은 질병에 저항하고 다른 식물은 왜 더 큰 열매를 맺는지, 그리고 서로 다른 품종들이 어떻게 연관되어 있는지를 이해하기 위해 그들의 DNA를 연구해 왔습니다. 오랫동안 연구자들은 식물 사이에서 차이를 보이는 단일 문자를 살펴보는, 유전 코드의 가장 작은 변화에 집중해 왔습니다. 단일 염기 변이(single-nucleotide variants)라고 알려진 이 미세한 차이들은 더 나은 작물을 육종하는 데 매우 유용했습니다. 그러나 게놈에는 DNA 조각의 결실, 섹션의 추가 복제, 또는 새로운 위치로 이동한 조각들과 같은 훨씬 더 큰 변화도 포함되어 있습니다. 이러한 더 큰 변형을 구조적 변이(structural variants)라고 부릅니다. 이것들이 식물의 외형과 행동을 결정하는 강력한 동력이라는 점은 알려져 있지만, 이를 찾아내는 것은 전통적으로 어려웠고 비용이 많이 들었으며, 종종 많은 육종 프로그램이 감당할 수 없는 전문적이고 고가의 기술을 필요로 했습니다.

노스캐롤라이나 주립대학교의 레자 셰카스텐드(Reza Shekasteband)가 수행한 새로운 연구는 과학자들이 이미 존재하는 데이터를 사용하여 이러한 숨겨진 대규모 유전적 변화를 찾을 수 있음을 보여줍니다. 연구자는 6년 동안 표준적이고 저렴한 시퀀싱 장비를 사용하여 생성된 방대한 토마토 DNA 서열 컬렉션을 활용했습니다. 새로운 비싼 테스트를 실행하는 대신, 연구팀은 기존 데이터에서 더 큰 구조적 변화를 찾아내기 위해 특정 컴퓨터 방법을 적용했습니다. 그들은 안데스 산맥에서 자라는 야생 조상부터 현대의 상업적 품종에 이르기까지 60가지의 서로 다른 토마토 계통을 조사했습니다. 데이터베이스에 이미 존재하는 짧은 DNA 리드(reads)를 재분석함으로써, 연구팀은 71,000개 이상의 높은 신뢰도를 가진 구조적 변이를 성공적으로 식별해 냈습니다. 이 접근 방식은 가치 있는 유전 정보가 새로운 시퀀싱에 단 1달러도 쓰지 않고도 잠금 해제될 수 있는 상태로 기존 데이터셋에 유휴 상태로 놓여 있다는 것을 증 proves 합니다.

이 연구는 이러한 큰 유전적 변화가 토마토 게놈 전체에 고르게 퍼져 있지 않다는 것을 밝혀냈습니다. 대신, 이들은 특정 영역, 특히 염색체 끝부분과 질병 저항성을 조절하는 것으로 알려진 영역 근처에 밀집되어 있습니다. 연구진이 야생 토마토와 재배 토마토를 비교했을 때, 야생 식물이 거의 두 배 더 많은 구조적 변화를 보유하고 있다는 것을 발견했습니다. 야생 게놈에서는 DNA의 결실이 가장 흔한 유형의 변화였던 반면, 재배 토마토에서는 DNA의 추가 삽입이 더 빈번했습니다. 이러한 차이는 재배 과정이 어떻게 작물의 유전적 구조를 형성했는지, 즉 야생의 변이를 걸러내는 동시에 새로운 구조적 특징을 도입했는지를 강조합니다. 연구팀은 또한 많은 현대 육종 계통이 어디에도 나타나지 않는 독특한 구조적 변화를 가지고 있으며, 이것이 특정 품종을 위한 유전적 지문 역할을 한다는 것을 발견했습니다.

가장 중요한 발견 중 하나는 이러한 큰 구조적 변화가 미세한 단일 염기 변화와 동일한 진화적 이야기를 전달하지만, 더 명확하게 보여준다는 점이었습니다. 연구진이 구조적 변이를 바탕으로 가계도를 구축했을 때, 그 결과는 미세한 변화를 바탕으로 구축된 가계도와 거의 완벽하게 일치했습니다. 그러나 구조적 데이터는 혼란스러운 관계를 분류하는 데 더 뛰어났습니다. 예를 들어, 이전 분석에서 재배된 포도와 함께 그룹화되었던 한 야생 토마토 품종은 구조적 변화를 고려했을 때 자신의 야생 친척들과 함께 올바르게 배치되었습니다. 이는 더 큰 DNA 조각을 보는 것이 육종가들로 하여금 식물의 진정한 역사를 이해하고 어떤 품종을 교배할지에 대해 더 현명한 결정을 내리도록 돕는다는 것을 시사합니다.

연구는 또한 과학자들이 이 데이터를 처리하는 방법에 대한 실질적인 교훈을 찾아냈습니다. 연구팀은 DNA 리드를 참조 게놈에 정렬하는 방식이 큰 차이를 만든다는 것을 발견했습니다. 리드가 끝에서 끝까지 완벽하게 일치하도록 강제하는 표준 방식은 구조적 변화를 전혀 찾아내지 못했습니다. 반면, 리드가 부분적으로 일치하도록 허용하는 더 유연한 방식을 도입함으로써, 연구팀은 구조적 변이를 알리는 끊김과 겹침을 감지할 수 있었습니다. 이러한 조정 덕분에 그들은 그렇지 않았을 때보다 수천 개의 변화를 더 많이 찾아낼 수 있었습니다. 그들은 샘플을 그룹화하는 다양한 방법을 테스트했으며, 다양한 계통을 함께 묶어 분석하는 것이 가장 포괄적인 결과를 낳아 개별 샘로 보았을 때 놓쳤던 특정 계통의 고유한 변화를 드러낸다는 것을 발견했습니다.

성공에도 불구하고, 이 연구는 이 방법의 한계를 인정합니다. 이 방법은 결실(deletions)과 삽입(insertions)을 찾는 데는 탁월하지만, 매우 복잡한 재배열이나 유전자 변형 식물에서 사용되는 삽입된 유전자의 정밀한 구조는 놓칠 수 있습니다. 연구진은 자신들의 방법이 형질 전환 계통에서 다른 기술이 볼 수 있는 일부 삽입 위치를 놓치는 것을 확인함으로써 이를 입증했습니다. 그럼에도 불구하고, 이 연구는 아카이브된 데이터를 채굴하기 위한 비용 효율적이고 확장 가능한 전략이 존재함을 보여줍니다. 표준적인 숏 리드(short-read) 시퀀싱 데이터를 사용하고 컴퓨터 도구를 최적화함으로써, 육종 프로그램은 이제 숨겨진 유전적 다양성의 층에 접근할 수 있습니다. 이를 통해 그들은 특정 형질을 추적하고, 식물 가족에 대한 이해를 정교화하며, 값비싼 고성능 시퀀싱 기술 없이도 새로운 토마토 품종 개발을 가속화할 수 있습니다. 이 작업은 한때 오래된 데이터의 한계로 여겨졌던 것을 미래의 작물 개선을 위한 강력한 자원으로 탈바꿈시켰습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →