← 최신 논문
💬 NLP

Alignment Whack-a-Mole : Finetuning Activates Verbatim Recall of Copyrighted Books in Large Language Models

이 논문은 RLHF 등 안전 정렬 조치가 취해졌음에도 불구하고, 특정 작가의 작품으로 파인튜닝을 수행하면 GPT-4o 등 주요 대형 언어 모델들이 훈련 데이터에 저장된 저작권 보호 텍스트를 85~90% 수준으로 완벽하게 재생성할 수 있음을 입증하여, 모델이 훈련 데이터를 복제하지 않는다는 법원의 핵심 전제가 무효화될 수 있음을 시사합니다.

원저자: Xinyue Liu, Niloofar Mireshghallah, Jane C. Ginsburg, Tuhin Chakrabarty

게시일 2026-03-24
📖 3 분 읽기☕ 가벼운 읽기

원저자: Xinyue Liu, Niloofar Mireshghallah, Jane C. Ginsburg, Tuhin Chakrabarty

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

📚 AI 의 '기억'을 깨우는 치명적인 실수: "저작권 책 복제" 연구 설명

이 연구는 최근 가장 핫한 AI 모델들 (GPT-4o, Gemini, DeepSeek 등) 이 가진 치명적인 약점을 발견한 논문입니다. 쉽게 말해, **"AI 는 학습한 책들을 완전히 지우지 않고 기억하고 있으며, 아주 간단한 질문만으로도 그 책을 그대로 베껴 쓸 수 있다"**는 사실을 증명했습니다.

이 복잡한 연구를 일상적인 비유로 쉽게 설명해 드릴게요.


1. 🛡️ AI 의 '가면'과 '실체'

상황:
AI 회사들은 법정에 서서 이렇게 말합니다. "우리의 AI 는 책 내용을 그대로 저장하지 않아요. 그냥 책의 '느낌'이나 '스타일'만 배운 거예요. 그래서 저작권을 침해하지 않습니다."
마치 거대한 도서관에 들어간 AI 가 책 내용을 통째로 외우지 않고, 책의 '주요 내용 요약'만 기억하고 있다고 주장하는 것과 같습니다.

연구의 발견:
하지만 이 연구팀은 AI 에게 **"책의 줄거리 요약만 보고, 그 책의 원문을 다시 써달라"**는 미끼를 던졌습니다.
그 결과는 충격적이었습니다. AI 는 요약만 듣고도 책의 원문을 85~90% 까지 그대로 복제해냈습니다. 마치 요약본을 보고 원작자의 필체와 문장까지 완벽하게 따라 하는 마법을 부린 것입니다.

💡 비유:
어떤 사람이 "이 영화의 줄거리는 '소년이 용을 잡는 이야기'야"라고만 말해줬는데, AI 는 그 말만 듣고 영화 대본을 한 글자도 틀리지 않고 다시 써낸 것과 같습니다.


2. 🎯 '맞춤형 훈련'이 가져온 재앙 (핀튜닝의 위험성)

이 연구의 핵심은 **'핀튜닝 (Finetuning)'**이라는 과정입니다.
AI 를 특정 작가 (예: 무라카미 하루키) 의 책만 보고 다시 훈련시켰습니다.

  • 결과 1 (같은 작가): 무라카미 하루키 책으로 훈련한 AI 는, 훈련에 쓰지 않은 다른 무라카미 책도 완벽하게 베껴 썼습니다.
  • 결과 2 (다른 작가 - 가장 무서운 부분): 무라카미 하루키 책으로만 훈련했는데, 30 명 이상의 다른 작가들 (예: 해리 포터, 식스틴 등) 의 책도 완벽하게 베껴 썼습니다.

💡 비유:
AI 가 **'무라카미 스타일'**을 익히기 위해 연습장을 채웠습니다. 그런데 연습이 끝나자마자, 완전히 다른 작가들의 책을 읽지도 않았는데 그 책들의 내용을 외워서 써내려간 것입니다.
마치 일본 요리 (스시) 를 배우기 위해 연습만 했는데, 갑자기 이탈리아 파스타나 한국 김치찌개 레시피를 외워서 완벽하게 만들어내는 것과 같습니다.


3. 🧠 AI 의 뇌는 어떻게 책을 기억할까?

왜 이런 일이 일어날까요? 연구팀은 AI 가 책을 단순한 텍스트 조각으로 기억하는 게 아니라, 의미로 연결된 거미줄처럼 저장하고 있다고 설명합니다.

  • 의미 연결: "소년이 용을 잡는다"라는 줄거리 (키) 를 입력하면, AI 는 그와 관련된 책의 원문 페이지를 찾아냅니다.
  • 공통된 기억: 서로 다른 회사 (OpenAI, Google, DeepSeek) 가 만든 AI 들이 똑같은 책의 똑같은 부분을 기억하고 있었습니다. 이는 AI 들이 **똑같은 불법 다운로드된 책들 (LibGen 등)**로 학습했기 때문입니다.

💡 비유:
AI 의 뇌는 거대한 연상 기억장입니다. "사랑"이라는 단어를 입력하면, 특정 책의 "사랑"에 대한 문장이 자동으로 떠오르는 것처럼, "줄거리 요약"이라는 열쇠를 꽂으면 책의 원문이라는 보물이 튀어 나오는 구조입니다.


4. ⚖️ 법적 파장: "우리는 안전장치를 뒀다"는 주장은 무효?

AI 회사들은 "우리는 AI 가 저작권 책을 못 쓰게 필터를 뒀다"고 주장하며 법적인 안전지대 (공정 사용) 를 주장해 왔습니다.

하지만 이 연구는 **"그 필터는 찢어질 수 있다"**고 증명했습니다.
단순한 줄거리 요약으로 AI 를 훈련시키는 것만으로도, 그 필터를 우회하여 책 전체를 복제해낼 수 있습니다.

💡 비유:
AI 회사가 "우리 금고 (AI) 에는 도둑이 들어오지 못하게 강력한 잠금장치 (필터) 가 있다"고 했습니다.
하지만 연구팀은 **"그 잠금장치는 아주 간단한 비법 (줄거리 요약 훈련) 으로 열 수 있다"**는 것을 보여줬습니다.
따라서 "우리는 책을 복제하지 않는다"는 AI 회사의 주장은 더 이상 설득력이 떨어지며, 저작권 침해 소송에서 큰 타격을 입을 수 있습니다.


📝 한 줄 요약

"AI 는 책 내용을 완전히 지우지 않고 기억하고 있으며, 아주 간단한 훈련만으로도 그 책을 원문 그대로 복제해낼 수 있다. 이는 AI 업계 전체에 걸친 치명적인 보안 구멍이자, 저작권법상 큰 문제다."

이 연구는 AI 가 단순히 '지능'을 가진 것이 아니라, 수많은 책의 '복제본'을 품고 있는 상태일 수 있음을 경고합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →