← 최신 논문
💬 NLP

Robust and Secure Code Watermarking for Large Language Models via ML/Crypto Codesign

이 논문은 낮은 엔트로피와 보안 검증의 문제를 효과적으로 해결하기 위해, CodeT5를 이용한 엔드 투 엔드 학습과 영지식 증명을 활용하여 LLM이 생성한 코드에 견고하고 기능적이며 프라이버시를 보존하는 워터마크를 삽입하는 새로운 ML/암호 설계 프레임워크인 RoSeMary를 소개한다.

원저자: Ruisi Zhang, Neusha Javidnia, Nojan Sheybani, Farinaz Koushanfar

게시일 2026-08-12
📖 4 분 읽기☕ 가벼운 읽기

원저자: Ruisi Zhang, Neusha Javidnia, Nojan Sheybani, Farinaz Koushanfar

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

컴퓨터가 단순히 우리와 대화하는 것을 넘어, 우리의 디지털 삶을 위한 설계도를 직접 작성하는 세상을 상상해 보십시오. 이것이 바로 코드용 거대 언어 모델(LLM)의 영역입니다. 이들은 프롬프트를 읽는 것만으로 소프트웨어 함수를 생성하고, 버그를 수정하며, 전체 프로그램을 구축할 수 있는 초지능형 AI 비서입니다. 하지만 여기에는 함정이 있습니다. AI가 코드를 작성할 때, 그 소유권이 실제로 누구에게 있는지 판단하기가 매우 어렵다는 점입니다. 인간 엔지니어가 작성한 것일까요, 아니면 AI가 작성한 것일까요? 만약 AI가 작성했다면, 어느 회사의 AI일까요? 코드는 비밀 레시피나 특허받은 발명품처럼 가치 있는 지적 재산이기 때문에 이는 매우 중요한 문제입니다.

이를 해결하기 위해 과학자들은 AI 코드에 "워터마크"를 삽착하는 방법을 연구해 왔습니다. 이것은 마치 디지털 투명 잉크나 지폐에 새겨진 숨겨진 워터마크와 같습니다. 코드의 작동 방식은 바꾸지 않으면서도, "이 코드는 나의 AI가 만든 것이다"라고 증명하고 싶은 것입니다. 하지만 까다로운 문제가 있습니다. 코드는 매우 엄격합니다. 이야기 속에서 단어를 유의어로 바꿀 수 있는 것과 달리, 코드는 실행되기 위해 엄격한 규칙을 따라야 합니다. 비밀 메시지를 숨기기 위해 코드를 너무 많이 바꾸면 프로그램이 망가집니다. 게다가 법정에서 소유권을 증명하려면 보통 비밀 키(워터마크)를 판사에게 보여주어야 합니다. 하지만 키를 보여주면 나쁜 사람들이 이를 훔쳐서 나중에 자신들의 워터마크를 위조할 수 있습니다. 이는 규칙 자체가 무언가를 잃지 않고는 승리하기 거의 불가능하게 만드는 좌절스러운 "숨바꼭질" 게임과 같습니다.

여기서 RoSeMary라는 새로운 프레임워크가 등장합니다. 이 시스템은 열쇠를 절대 보여주지 않고도 잠긴 상자 안에 비밀 메시지를 숨길 수 있는 영리한 마술사처럼 행동합니다. 연구진인 캘리포니아 대학교 샌디에고 캠퍼스와 샌디에이고 주립 대학교의 팀은 머신러닝(AI 부분)과 암호학(비밀 수학 부분)을 결합한 시스템을 설계했습니다. 그들은 숨겨진 서명을 코드 안에 삽입하되, 그것이 제거하기 어렵고 코드를 완벽하게 작동하게 유지하면서도, 가장 중요하게는 판사가 실제 비밀 서명을 전혀 보지 않고도 소유권을 검증할 수 있는 방법을 찾아냈습니다.

RoSeMary가 이 마술을 어떻게 수행하는지 살펴보겠습니다. 먼저, 이 시스템은 수백만 개의 레시피를 맛본 숙련된 요리사와 같은 CodeT5라는 사전 학습된 AI 모델을 사용합니다. 코드를 무작위로 변경하는 대신, 이 요리사는 코드의 "풍미"를 이해합니다. 이 요리사는 원본 코드와 비밀 메시지(워터마크)를 가져와서, 변수 이름을 x에서 item으로 바꾸거나 while 루프를 for 루프로 바꾸는 것과 같이 코드를 아주 미세하게 조정하여 비밀 메시지를 그 안에 숨길 최선의 방법을 결정합니다. 요리사가 요리법(프로그래밍)의 규칙을 알고 있기 때문에, 비밀 재료가 추가되었음에도 불구하고 코드는 여전히 맛이 똑같습니다(완벽하게 작동합니다).

하지만 진짜 마술은 코드가 진짜인지 확인할 때 일어납니다. 보통은 비밀 레시피를 판사에게 건네주어야 합니다. RoSeMary는 **영지식 증명(Zero-Knowledge Proof, ZKP)**이라는 암호학적 도구를 사용합니다. 친구에게 금고의 비밀번호를 알려주고 싶지는 않지만, 내가 그 번호를 알고 있다는 사실을 증명하고 싶다고 가정해 봅시다. 당신은 친구 앞에서 금고를 열어 그 안의 보물을 보여준 뒤 다시 금고를 닫을 수 있습니다. 친구는 당신이 조합을 알고 있다는 사실은 알게 되지만, 번호 자체는 결코 보지 못합니다. RoSeMary도 이와 유사하게 작동합니다. AI 소유자는 숨겨진 서명이 있는지 확인하는 복잡한 수학 회로를 실행합니다. 그러면 실제 서명이 무엇인지 밝히지 않고도 "예, 이 서명은 유효합니다"라고 말하는 작은 디지털 "증명"을 생성합니다.

연구팀은 파이썬(Python), 자바(Java), C++와 같은 언어로 된 수천 개의 코드 예시에 이 시스템을 테스트했습니다. 그 결과 RoSeMary는 자신의 임무를 놀라울 정도로 잘 수행한다는 것을 발견했습니다. 이 시스템은 코드가 정상적으로 작동하는 경우(충실도) **97.64%**의 성공률로 워터마크를 숨기는 데 성공했으며, 정확도 점수는 0.97(1.0이 완벽함)로 워터마크를 탐지해 냈습니다. 악의적인 행위자가 변수 이름을 바꾸거나 다른 AI를 사용하여 코드를 재작성함으로써 워터마크를 깨뜨리려 시도했을 때도, RoSeMary는 **98%**의 확률로 숨겨진 메시지를 찾아냈습니다.

아마도 가장 인상적인 부분은 속도와 개인정보 보호일 것입니다. 이 시스템은 약 7.15초 만에 소유권 증명을 생성할 수 있으며, 판사는 단 118.6 밀리초(눈 깜빡임보다 짧은 시간) 만에 그 증명을 검증할 수 있습니다. 결정적으로, 이 모든 과정 동안 판사는 실제 비밀 워터마크를 절대 보지 못합니다. 이는 소유자가 동일한 워터마크를 반복해서 사용할 수 있으면서도, 누군가 이를 훔쳐서 가짜 소유권을 위조할 걱정을 하지 않아도 된다는 것을 의미합니다.

요약하자면, RoSeMary는 연구자들을 오랫동안 괴롭혔던 세 방향의 줄다리기 문제를 해결합니다. 이 시스템은 코드를 작동하게 유지하면서(충실도), 워터마크를 찾기 쉽게 만들고(탐지 가능성), 파괴하기 어렵게(강건성) 만드는 동시에, 비밀 키를 엿보는 눈으로부터 안전하게 지켜냅니다. 이는 AI 혁명의 지적 재산을 보호하는 데 있어 중요한 진전이며, AI가 걸작을 써냈을 때 그 예술가가 마땅히 받아야 할 공로와 보호를 받을 수 있도록 보장합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →