Registry Descriptions Go Stale Unevenly: An 89-Day Measurement of Model Context Protocol Drift, and Why Drift-Ranked Re-Auditing Under-Covers It
이 논문은 89일간의 모델 컨텍스트 프로토콜(MCP) 레지스트리 데이터를 분석하여, 대부분의 변경 사항이 신규 유입 및 드문 재작성 이벤트에서 발생하기 때문에 역사적 드리프트(historical drift)를 기반으로 서버를 재감사하는 것이 설명 수준의 보안 취약점 발견을 유지하는 데 효과적이지 않음을 입증하며, 이에 따라 콘텐츠 바인딩 검증 및 정기적인 전체 카탈로그 스윕(full-catalog sweeps)으로의 전환이 필요함을 논한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
인터넷을 컴퓨터(이하 "에이전트"라고 부름)들이 자신의 업무를 돕기 위한 도구를 찾으러 가는 거대하고 북적이는 시장이라고 상상해 보세요. 이를 더 쉽게 만들기 위해, MCP(Model Context Protocol) 레지스트리라는 공공 "전화번호부"가 있습니다. 이 전화번호부에는 모든 도구마다 그 기능이 무엇인지 설명하는 작은 카드 카드가 들어 있습니다. 최근 보안 전문가들은 이 카드들이 거짓말을 하거나 위험하지 않은지 확인하기 시작했습니다. 그들은 전화번호부의 스냅샷을 찍고, 카드를 읽은 뒤, "이것은 안전하다" 또는 "이것은 수상하다"라고 말합니다.
하지만 여기 함정이 있습니다. 현실 세계의 전화번호부는 항상 업데이트됩니다. 오늘 설명을 읽었다면, 내일도 똑같은 설명일까요? 아니면 주인이 당신이 보지 않는 사이에 몰래 내용을 바꿨을까요? 이 논문은 단순하지만 매우 중요한 질문을 던집니다. 설명이 변경되기 전까지, 그 설명에 대한 보안 점검은 실제로 얼마나 유효한가? 이것은 도구 내부가 위험한지에 관한 문제가 아닙니다(그것은 다른 이야기입니다). 그것은 바로 보안 요원이 읽은 텍스트가 현재 도구가 보여주고 있는 텍스트와 여전히 일치하는지에 관한 문제입니다. 만약 텍스트가 변한다면, 예전의 보안 점검은 실제 대상이 아닌 유령을 보고 있는 셈이 됩니다.
89일간의 미스터리: 전화번호부가 낡아가는 과정
MCP 레지스트리를 매 몇 시간마다 새로운 책이 추가되고 기존 책들의 표지가 끊임없이 다시 쓰여지는 거대한, 살아있는 도서관이라고 생각해 보세요. 한 연구자가 이 도서관에서 "틀린 그림 찾기" 게임을 하기로 했습니다. 그는 단순히 사진 한 장을 찍은 것이 아니라, 88.6일(약 3개월) 동안 120개의 스냅샷을 찍으며 도서관이 약 3,500권에서 거의 19,000권으로 성장하는 과정을 지켜보았습니다. 그의 목표는 "변화의 흐릿함"이 얼마나 빨리 발생하는지, 그리고 보안 요원들이 누가 다음에 표지를 바꿀지 예측할 수 있는지 확인하는 것이었습니다.
커다란 놀라움: "바쁜 소수"와 "침묵하는 다수"
연구자는 누가 설명을 바꾸는지에 대해 흥미로운 사실을 발견했습니다. 19,000명의 학생이 있는 교실을 상상해 보세요. 만약 여러분이 "오늘 옷을 갈아입은 사람이 누구인가요?"라고 묻는다면, 학급의 절반 정도가 그랬을 것이라 예상할 수도 있습니다. 하지만 이 도서관에서는 서버의 75%가 89일 전체 기간 동안 설명을 전혀 바꾸지 않았습니다. 그들은 바위처럼 안정적이었습니다.
그러나 변화가 일어난 곳은 매우 집중되어 있었습니다. 변화는 모두에게서 조금씩 일어난 것이 아니라, 단 몇 명으로부터 엄청나게 발생했습니다. 가장 활발한 상위 5%의 서버가 **모든 변화의 61%**를 차지했습니다. 이는 마치 학교 학생의 5%가 학교 벽에 새겨진 낙시의 61%를 책임지고 있는 것과 같습니다. 나머지 학생들은 그저 가만히 앉아 있었을 뿐입니다.
깨져버린 "수정구슬"
보안 팀은 종종 변경 이력이 있는 서버들만 다시 점검함으로써 시간을 아끼려 합니다. 그 논리는 이렇습니다: "어제 설명을 바꿨다면, 오늘도 바꿀 가능성이 높다. 그러니 '단골 손님'들만 체크하자."
연구자는 이 아이디어를 테스트했습니다. 그들은 과거의 변경 이력을 바탕으로 서버의 순위를 매겨 미래를 예측하려 했습니다. 그 결과, 이 방법이 무작위로 추측하는 것보다는 약간 나았지만, 설명 변경을 잡아내는 데 있어서는 형편없는 전략이라는 것을 발견했습니다.
- 만약 그들이 가장 많은 이력을 가진 상위 5%의 서버를 점검하는 데 예산을 쓴다면, 다음 기간에 실제로 설명을 변경한 서버의 약 **20%**만을 잡아낼 수 있었습니다.
- 더 심각한 것은, 이 방법이 신규 유입자들에게는 완전히 눈먼 방법이었다는 점입니다. 신규 서버는 이력이 없기 때문에 순위를 매길 수 없습니다. 그런데 연구자는 신규 서버야말로 설명 변경이 가장 많이 발생하는 곳이라는 사실을 발견했습니다. "올드 핸즈(경력자)"들만 살피는 보안 요원들은 가장 많이 표지를 바꾸는 따끈따끈한 신입들을 놓치고 있었던 것입니다.
이 논문은 누가 바꿀지를 과거를 통해 예측하려는 시도가, 어제 있었던 구름만을 보고 날씨를 예측하려는 것과 같다고 주장합니다. 그것은 새로 밀려오는 폭풍 구름을 놓치게 만듭니다.
"단순 산술"의 함정
또 다른 함정도 연구자에 의해 밝혀졌습니다. 하루에 발생하는 변경 횟수를 보고 단순히 그 숫자에 30을 곱하여(한 달 동안 일어날 일을 추측하기 위해) 계산하면, 완전히 틀린 답을 얻게 됩니다.
- 단순한 추측: 만약 매일 1.5%의 서버가 변경된다면, 30일째 되는 날에는 약 **36%**의 서버가 변경되었을 것이라고 생각할 수 있습니다.
- 현실: 실제로 측정했을 때, 30일째 되는 날까지 변경된 서버는 약 **12%**에 불과했습니다.
왜 차이가 날까요? 단순한 산술은 모든 변화가 서로 다른 서버에서 일어난다고 가정합니다. 하지만 현실에서는 똑같은 몇몇 서버가 계속해서 반복적으로 변경을 일으킵니다. 이는 한 사람이 하루에 옷을 10번 갈아입는 것과 같습니다. 옷의 개수를 세는 것이 10명의 서로 다른 사람이 옷을 갈아입었다는 것을 의미하지는 않습니다. 설명의 "유통기한"은 단순한 산술이 제시하는 것보다 훨씬 길지만, 특정 보안 결과의 "유통기한"은 텍스트가 사라졌다가 다시 나타날 수 있기 때문에 까다롭습니다.
진짜 해결책: 이력이 아니라 지문을 확인하라
그렇다면 누가 바꿀지 예측할 수 없다면, 어떻게 도서관을 안전하게 유지할 수 있을까요? 연구자는 추측하는 것보다 훨씬 더 잘 작동하는 간단한 두 가지 규칙을 제안합니다.
- 지문 규칙 (콘텐츠 바인딩): 누가 바꿀지 예측하는 대신, 그냥 "지문"(디지털 해시)을 확인하십시오. 지문이 아주 조금이라도 변하면, 보안 점검은 즉시 무효가 됩니다. 누가 바꿨는지 알 필요는 없습니다. 단지 텍xt가 달라졌다는 것만 알면 됩니다. 이것은 하루에 약 20건의 변경을 자동으로 잡아냅니다.
- 전수 조사 (Sweep): 신규 서버와 자주 변경되지 않는 서버들을 위해서는, 매주 또는 매달 도서관 전체를 대상으로 하는 전수 조사를 실시하십시오.
이 접근 방식은 다음에 어떤 도둑이 들지 예측하려고 애쓰는 보안 요원이 아닙니다. 대신, 책의 표지가 바뀌는 순간 경보가 울리는 스캐너를 가지고 있으며, 새로운 책들이 들어왔는지 확인하기 위해 매주 한 번씩 통로를 전체적으로 순찰하는 보안 요원과 같습니다.
숨겨진 결함: "태생적 노후(Born-Stale)" 판정
마지막으로, 연구자는 자신의 보안 스캐너 내부를 들여다보았습니다. 그는 교묘한 문제를 발견했습니다. 가끔 스캐너가 설명을 점검할 때, 이미 도서관이 업데이트를 마친 후에 점검하고 있음에도 스캐너가 이를 인지하지 못하는 경우가 있었습니다. 이는 마치 요리사가 이미 수프를 바꿨는데, 보안 요원이 10분 전의 메뉴판을 읽고 있는 것과 같았습니다. 이 "지연(lag)" 현상 때문에, 일부 "노후된(stale)" 판정들은 업무를 시작하기도 전부터 이미 잘못된 상태였습니다. 이 지연 때문에 일부 판정들은 시간이 흘러서가 아니라, 태어나는 순간부터 이미 틀린 것이었습니다.
핵심 요약
여기서의 주요 교훈은 도서관이 혼란스럽다는 것이 아니라, 도서관이 집중되어 있다는 것입니다. 대부분의 것은 그대로 유지되지만, 몇몇 것들이 아주 많이 변하며, 새로운 것들이 가장 많이 변합니다. 과거를 보고 미래를 예측하려는 노력은 새로운 유입자를 놓치기 때문에 막다른 길입니다. 안전을 유지하는 최선의 방법은 수정구슬을 만드는 것이 아니라, 텍스트가 변하는 것을 즉각 감지하는 시스템을 구축하고 새로운 것들을 정기적으로 점검하는 계획을 세우는 것입니다. 이는 디지털 세계에서 "한 번 확인하는 것"은 결코 충분하지 않으며, 이력이 아니라 텍스트 자체에 계속 주목해야 한다는 점을 상기시켜 줍니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.