← 최신 논문
🧬 biology

Probing and steering biology across Boltz-1s trunk-diffusion boundary

이 논문은 Boltz-1 단백질 구조 예측기에서 트렁크(trunk)로부터 확산 모듈(diffusion module)로 생물학적 정보가 어떻게 흐르는지를 분석하며, 2차 구조와 서열 화학성(sequence chemistry)은 트렁크 내에서 선형적으로 디코딩 가능하지만 오직 2차 구조만이 확산 모듈로 효과적으로 전달된다는 점과, 결정적으로 헬릭스와 같은 특징들의 선형적 디코딩 가능성이 그것들을 모델의 출력값을 변화시키도록 인과적으로 조종할 수 있음을 보장하지는 않는다는 점을 밝히고 있다.

원저자: Piotr Jedryszek, Tongmeng Xie, Adam Winnifrith, Alexander Hasson, Weronika Ślesak, George Wicks, Toby Winnifrith, Oliver M. Crook

게시일 2026-08-13
📖 5 분 읽기🧠 심층 분석

원저자: Piotr Jedryszek, Tongmeng Xie, Adam Winnifrith, Alexander Hasson, Weronika Ślesak, George Wicks, Toby Winnifrith, Oliver M. Crook

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. ⚕️ 이것은 동료 심사를 거치지 않은 프리프린트의 AI 생성 설명입니다. 의학적 조언이 아닙니다. 이 내용을 바탕으로 건강 관련 결정을 내리지 마세요. 전체 면책 조항 읽기

설계도와 건축가: AI가 단백질을 "생각하는" 방식

복잡한 레고 성을 만든다고 상상해 보세요. 당신에게는 당신의 벽돌 목록(설계도)을 보고 전체적인 모양, 색상 체계, 그리고 탑이 어디에 위치해야 하는지를 파악하는 수석 설계자가 있습니다. 그런 다음, 그 계획을 받아 실제로 벽돌을 하나씩 끼워 맞춰 성이 완성될 때까지 쌓아 올리는 건축가가 있습니다. 오랫동안 과학자들은 자연계에서 이 두 역할이 어떻게 작동하는지에 대해 매료되어 왔습니다. 현실 세계에서 단백질은 우리를 살아있게 만드는 아주 작은 기계이며, 그 형태가 단백질이 하는 일을 결정합니다. 오랫동안 우리는 단백질의 지침(서열)만으로 그 형태를 예측하는 방법을 알지 못했습니다. 하지만 최근 강력한 AI 모델들이 이 역할을 수행하며, 설계자와 건축가의 역할을 하나로 합친 것처럼 작동하는 법을 배웠습니다.

이 AI 모델들은 두 가지 뚜렷한 단계로 작동합니다. 첫째, "트렁크(Trunk)"가 있습니다. 이는 아미노산 서열(지침)을 처리하고 단백질의 일반적인 기하학적 구조와 화학적 특성을 파악하는 심층 사고 엔진입니다. 이는 마치 설계자가 청사진을 스케치하는 것과 같습니다. 둘째, "디퓨전 모듈(Diffusion Module)"이 있습니다. 이는 생성 엔진으로서, 그 청사진을 받아 원자 하나하나를 쌓아 올리며 최종 3D 구조를 천천히, 단계별로 구축합니다. 이것은 건축가가 벽돌을 끼워 맞추는 과정입니다. 과학자들이 던져온 큰 질문은 이것입니다. 정보가 '생각하는 설계자'에서 '건축 기계'로 넘어갈 때, 정보가 변하는가? 건축가는 여전히 화학적 세부 사항을 "알고" 있는가, 아니면 단지 형태에만 관심을 두는가? 이를 이해하는 것은 이 AI 모델들이 진정으로 생물학을 이해하고 있는 것인지, 아니면 단순히 패턴을 암기하고 있는 것인지, 그리고 우리가 실제로 새로운 것을 설계하도록 이들을 "조종"할 수 있는지 알려줍니다.


거대한 분리: 설계도와 건축가가 만나는 지점

이 연구에서 연구진들은 Boltz-1이라고 불리는 특정 AI 모델의 내부를 면밀히 조사하여, "트렁크"(생각하는 부분)와 "디퓨전 모듈"(건축하는 부분) 사이의 경계를 통과할 때 어떤 일이 일어나는지 살펴보았습니다. 그들은 특별한 도구를 사용하여 모델의 모든 층에서 모델의 "생각"(활성화 상태)을 읽어냄으로써 AI를 들여다볼 수 있는 블랙박스처럼 다루었습니다.

설계자는 모든 것을 알고 있다
트렁크를 조사했을 때, 연구진은 그것이 매우 잘 학습되어 있다는 것을 발견했습니다. 트렁크는 두 가지 주요 유형의 정보를 보유하고 있었습니다:

  1. 기하학(Geometry): 물리적 형태, 예를 들어 단백질의 일부가 나선(helix)인지, 평평한 시트(strand)인지, 아니면 흐물흐물한 덩어리(coil/disorder)인지에 대한 정보입니다.
  2. 서열 화학(Sequence Chemistry): 어떤 아미노산이 어디에 있는지, 혹은 신호 펩타이드(signal peptide)나 이황화 결합(disulfide bond)과 같은 특수한 화학적 태그가 있는지와 같은 구체적인 화학적 정체성입니다.

연구진은 트렁크의 내부 상태로부터 이 두 가지를 쉽게 "읽어낼" 수 있었습니다. 이는 마치 설계자가 최종 형태뿐만 아니라 모든 벽돌의 색상과 종류가 적힌 완벽하고 상세한 목록을 가지고 있는 것과 같았습니다.

건축가는 세부 사항을 잃어버린다
하지만 정보가 경계를 넘어 디퓨전 모듈로 넘어갈 때, 흥미로운 분리가 일어났습니다. 건축가는 기하학적 구조를 완벽하게 유지했습니다. 모델이 최종 3D 구조를 구축하기 시작할 때도, 나선형이나 시트 구조가 어디에 있어야 하는지는 여전히 명확히 "알고" 있었습니다. 그러나 화학적 정보는 사라지기 시작했습니다. 신호 펩타이드나 이황화 결합과 같은 구체적인 화학적 정체성은 감지하기 훨씬 어려워졌습니다. 건축가가 작업을 마칠 때쯤에는 형태는 선명하게 유지되었지만, 화학적 세부 사항은 대부분 사라진 상태였습니다.

이는 마치 건축가가 설계도를 받아 벽과 탑이 정확히 어디에 가야 하는지는 이해했지만, 벽돌의 색깔이 무엇이었는지는 잊어버린 것과 같습니다. 모델은 형태를 파악하기 위해 화학적 세부 사항을 사용하지만, 일단 형태가 구축되기 시작하면 더 이상 그 화학적 세부 사항을 활성 메모리에 유지할 필요가 없는 것으로 보입니다.

우리가 AI를 "조종"할 수 있을까?

연구진은 이어 대담한 질문을 던졌습니다. 만약 우리가 이러한 생각을 읽을 수 있다면, 그것을 변경할 수도 있을까? 그들은 트렁크가 건축가에게 청사진을 전달하기 전, 마지막 생각을 미세하게 조정함으로써 모델을 "조종(steer)"하려고 시도했습니다. 그들은 "나선을 더 많이 만들어라" 또는 "시트를 더 많이 만들어라"라는 방향으로 아주 작은 힘을 가했습니다.

  • 성공: 모델에게 **나선(helices)**이나 **흐물흐물한 부분(coils)**을 더 많이 만들도록 유도했을 때, 모델은 그 말을 들었습니다! 예측된 구조는 그들이 희망했던 대로 정확히 변하여, 더 많은 나선이나 코일이 나타났습니다. 이는 모델이 형태를 구축하기 위해 해당 특정 방향을 인과적으로 사용하고 있음을 증명했습니다.
  • 놀라운 결과: **시트(strands)**에 대해서도 똑같이 시도했을 때, 모델이 "시트" 방향을 쉽게 읽을 수 있었음에도 불구하고(매우 예측 가능했음에도), 그 자극은 아무런 효과가 없었습니다. 최종 구조 내의 시트 양은 변하지 않았습니다.

이는 중요한 한계를 시사합니다: 모델이 무언가를 예측할 수 있다고 해서, 그 특정 부분을 바꿈으로써 그것을 제어할 수 있다는 뜻은 아닙니다. 연구진은 "시트"가 아미노산 쌍이 서로 어떻게 상호작용하는지에 달려 있기 때문(이는 그들이 건드리지 않은 모델의 다른 메모리 영역에서 처리되는 세부 사항임)이라고 추측합니다. 반면 나선은 더 국소적이며 직접 제어할 수 있습니다.

누락된 레이블의 함정

이 논문은 또한 이러한 AI 모델을 테스트하는 방식에 있는 까다로운 문제를 밝혀냈습니다. 과학자들은 종-종 AI의 예측을 기존의 단백질 구조 데이터베이스와 비교하여 정확성을 확인합니다. 그러나 이러한 데이터베이스는 종종 "희소(sparse)"합니다. 즉, 실험실에서 이미 연구된 단백질 부분에 대해서만 레이블(정답)이 달려 있다는 뜻입니다.

연구진은 AI를 이러한 희소한 레이블로 테스트했을 때, AI가 많은 실수를 하는 것처럼(거짓 양성) 보인다는 것을 발견했습니다. 하지만 AI를 "밀집된(dense)" 레이블 세트(모든 단백{의 모든 부분이 레이블링 된 경우)와 비교했을 때는 AI가 훨씬 더 똑똑해 보였습니다. 그 "실수"들은 사실 데이터베이스가 아직 레이블을 달지 않았을 뿐인 단백질의 부분에 대한 올바른 예측이었습니다. 이는 마치 학생이 시험을 잘 치렀음에도 불구하고, 선생님이 정답지에 적힌 질문만 채점하고 나머지 정답은 무시하여 학생이 틀렸다고 표시하는 것과 같습니다. 이는 우리가 이러한 모델들의 성능을 과소평가하고 있을 수 있음을 의미합니다.

이것이 미래에 갖는 의미

이 연구는 Boltz-1과 같은 AI 모델이 강력하긴 하지만 마법은 아니라고 결론짓습니다. 이 모델들은 명확한 분업 체계를 가지고 있습니다. "생각하는" 부분은 모든 화학적 및 구조적 세부 사항을 보유하지만, "건축하는" 부분은 거의 전적으로 기하학적 구조에 집중합니다. 나아가, 어떤 특징을 읽을 수 있다고 해서 그것을 제어할 수 있다는 보장은 없습니다.

연구진은 우리가 이 모델들을 사용하여 새로운 단백질을 설계하고자 한다면 주의가 필요하다고 제안합니다. 모델이 어떤 화학적 특징을 "알고" 있다고 해서, 그 특징을 사용하여 새로운 것을 만들도록 강제할 수 있다고 가정해서는 안 됩니다. 또한, 참조 데이터가 불완전하다고 해서 모델을 가혹하게 평가하지 않도록 주의해야 합니다. 이는 가장 똑똑한 AI라 할지라도 자신만의 독특한 사고방식을 가지고 있으며, 우리가 진정으로 조종하기 위해서는 그들의 언어를 먼저 배워야 한다는 점을 상기시켜 줍니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →