Opportunities, challenges and responsible innovation using generative artificial intelligence for biological sequence design
본 백서는 생물학적 서열 설계 분야에서 생성형 AI의 변혁적 잠재력과 데이터 편향, 모델 불투명성 및 이중 용도 위협과 관련된 위험 완화의 시급한 필요성 사이의 균형을 맞추기 위해 3단계 '심층 방어(defence-in-depth)' 거버넌스 프레임워크를 제안하는 다학제적 워크숍의 합의된 권고안을 제시한다.
원본 논문은 CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 동료 심사를 거치지 않은 프리프린트의 AI 생성 설명입니다. 의학적 조언이 아닙니다. 이 내용을 바탕으로 건강 관련 결정을 내리지 마세요. 전체 면책 조항 읽기
과학자들이 방금 새로운 종류의 "슈퍼 레시피 북"을 발견했다고 상상해 보십시오. 인공지능(AI)으로 구동되는 이 책은 생명체를 만드는 설계도(단백질과 DNA 같은)를 읽고, 자연에는 존재하지 않았던 완전히 새로운 레시피를 써 내려갈 수 있습니다. 이는 질병을 치료하고, 생태계를 복구하며, 새로운 의약품을 만드는 데 도움이 될 수 있습니다.
하지만 이 논문의 저자들은 우리가 지금 "비포장도로 위에서 포뮬러 1 경주차를 몰려고 하고 있다"고 주장합니다. AI는 믿기 힘들 정도로 빠르게 움직이고 있지만, 우리의 안전 점검, 지도, 그리고 자동차를 테스트하는 능력은 여전히 느린 차선에 머물러 있습니다.
다음은 이 논문의 주요 내용을 쉬운 비유를 사용하여 정리한 것입니다.
1. 문제점: "스피드 트랩(속도 함정)"
논문은 우리를 늦추고 위험을 초래하는 세 가지 "병목 현상"을 식별합니다.
- 나쁜 지도 (데이터 문제): AI는 기존의 생물학적 데이터를 읽으며 학습합니다. 하지만 이 데이터는 마치 부유한 국가의 도로만 보여주는 지도와 같습니다. 특정 박테리아, 바이러스 또는 유기체와 같은 세계의 거대한 부분들을 놓치고 있습니다. 또한, 이 지도는 구멍이 숭숭 뚫려 있고 오류가 가득합니다. 만약 AI가 나쁜 지도를 보고 배운다면, 당신에게 잘못된 방향을 알려줄 것입니다.
- 블랙박스 (모델 문제): AI는 완벽한 요리를 만들 수 있지만, 왜 특정 재료를 넣었는지 설명하기를 거부하는 천재 요리사와 같습니다. 의학과 생물학에서는 레시피를 사람들에게 내놓기 전에 왜 그 레시피가 작동하는지 반드시 알아야 합니다. 만약 우리가 그 논리를 이해하지 못한다면, 그 결과를 신뢰할 수 없습니다.
- 느린 주방 (검증의 격차): 이것이 가장 큰 격차입니다. AI는 한 시간 안에 1만 개의 새로운 레시피를 작성할 수 있습니다. 하지만 우리의 물리적 실험실(주방)은 일주일에 고작 한두 개의 레시피를 요리하고 맛을 볼 수 있을 뿐입니다. 즉, AI가 위험한 "레시피"(예: 새로운 바이러스)를 설계하더라도, 우리가 그것이 위험하다는 것을 깨닫고 테스트할 시간적 여유가 생기기도 전에 이미 설계가 완료될 수 있다는 뜻입니다.
2. 위험: "양날의 검(Dual-Use)"
논문은 우리가 치유법을 만드는 데 사용하는 동일한 도구가 무기를 만드는 데 사용될 수도 있다고 경고합니다.
- 비유: 3D 프린터를 생각해 보십시오. 그것은 생명을 살리는 의족을 출력할 수도 있지만, 총을 출력할 수도 있습니다.
- 리스나: 만약 AI가 생물학적 서열을 설계하는 능력이 너무 뛰어나진다면, 악의적인 행위자가 현재의 보안 필터를 우회하는 새로운 바이러스나 독소를 설계하는 데 사용할 수 있습니다. AI가 너무 빠르기 때문에, 보안 시스템이 무엇을 찾아야 할지 인지하기도 전에 '슈라파스마(super-pathogen)'를 만들어낼 수 있습니다.
3. 해결책: "심층 방어(Defense-in-Depth)" 전략
저자들은 단순히 문에 자물쇠 하나를 다는 것에 그쳐서는 안 된다고 제안합니다. 대신, 데이터, 모델, 합성의 세 단계를 아우르는 다중 보안 층을 갖춘 요새가 필요합니다.
레이어 1: "레시피 북" 보안 (데이터)
- 아이디어: 모든 데이터를 모두에게 공개해서는 안 됩니다.
- 비유: 도서관을 생각해 보십시오. 대부분의 책은 대중에게 공개됩니다. 하지만 어떤 책들은 위험한 지침(예: 폭탄을 만드는 방법)을 담고 있습니다. 이러한 책들은 "제한 구역"에 있어야 합니다.
- 계획:
- 과학자들이 민감한 생물학적 정보에 접근하기 위해 누구인지, 그리고 왜 그 정보가 필요한지를 증명해야 하는 시스템을 구축합니다.
- 연구 프로젝트가 시작되기 전(자금 지원 단계에서) 검토하여, 의도치 않게 위험한 데이터를 생성하고 있지는 않은지 확인합니다.
레이어 2: "요리사" 보안 (AI 모델)
- 아이디어: 우리는 AI가 요리를 시작하기 전에 테스트해야 합니다.
- 비유: 새로운 요리사가 채용되기 전에, 우리는 단순히 대중에게 요리를 하게 두지 않습니다. 우리는 그들에게 위험한 시나리오를 담은 "테이스팅 메뉴"를 제공하여, 그가 안전하게 대처할 수 있는지 확인합니다.
- 계획:
- 레드팀(Red-Teaming): "윤리적 해커"를 고용하여 AI를 속여 위험한 것을 만들도록 유도합니다. 만약 AI가 실패한다면, 출시하기 전에 이를 수정합니다.
- 단계별 접근 권한: 만약 AI가 매우 강력하다면, 코드 전체를 모두에게 주지 않습니다. 당신이 무엇을 요청하는지 우리가 지켜볼 수 있는 보안 웹사이트를 통해 사용하게 할 수는 있지만, AI의 "두뇌"를 다운로드하여 마음대로 사용할 수는 없게 합니다.
레이어 3: "배달 트럭" 보안 (합성)
- 아이디어: 설령 AI가 위험한 레시피를 설계하더라도, 누군가가 그것을 출력(DNA 합성)하기 전까지는 그저 디지털 코드일 뿐입니다.
- 비유: DNA를 출력하는 배달 서비스를 상상해 보십시오. 우리는 그들이 알려진 범죄자를 위한 패키지를 출력하지 않는지 확인해야 합니다.
- 계획:
- 고객 확인(Know Your Customer): DNA를 출력하는 기업들은 누가, 왜 주문하는지를 확인해야 합니다.
- 더 나은 필터: 현재의 필터는 알려진 나쁜 서열을 찾습니다. 새로운 계획은 AI를 사용하여, 모습은 다르지만 기능은 똑같은(마치 변장을 한 범죄자처럼) 새로운 나쁜 서열을 탐지하는 것입니다.
- 보험 기금: 자동차 보험이 안전 연구를 지원하는 것과 유사하게, 이러한 위협을 막는 연구에 비용을 지불하기 위한 공동 기금(보험 기금)을 조성합니다.
핵심 요약
논문은 보안이 진보의 적이 아니다라고 결론짓습니다.
고층 빌딩을 짓는 것을 생각해 보십시오. 단순히 최대한 빨리 짓기만 해서는 안 됩니다. 튼튼한 기초와 안전 난간이 필요합니다. 그렇게 한다면 사람들은 그 건물을 신뢰할 것이고, 더 많은 사람이 그곳에 살고 싶어 할 것입니다.
저자들은 우리가 지금 이러한 안전 규칙을 만든다면, 생물학적 재앙을 초래하지 않으면서도 질병을 치료하고 지구를 구하는 데 있어 AI의 놀라운 잠재력을 실현할 수 있다고 주장합니다. 그들은 보안이 혁신을 막는다는 사고방식에서, 보안이 안전한 혁신을 가능하게 한다는 사고방식으로 나아가기를 원합니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.