Probing Stylistic Appropriation using Large Language Models: An Evaluation Framework for Copyright Infringement under EU Law
이 논문은 스타일적 전용(stylistic appropriation)을 평가하기 위해 EU 저작권 교리를 체계화한 새로운 LLM-as-a-judge 프레임워크인 PSALM을 소개하며, 이를 통해 단순한 축자적 암기(verbatim memorization)에만 집중하는 현재의 보호 조치들이 미세 조정된 모델이 생성하는 서사 패턴 및 창의적 요소에서의 체계적 침해를 탐지하는 데 실패한다는 점을 밝혀낸다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
거대한 문제: "분위기"를 복제하는 것 vs "단어"를 복제하는 것
당신이 유명한 요리책을 읽으며 요리를 배우는 요리사라고 상상해 보세요.
- 기존의 검사 방식: 현재의 기술은 엄격한 사서와 같습니다. 그들은 당신이 레시피를 토씨 하나 틀리지 않고 그대로 베꼈는지만 확인합니다. 만약 당신이 단어를 몇 개 바꾸거나 문장의 순서를 바꾼다면, 사서는 "당신은 이것을 베끼지 않았습니다! 안전합니다."라고 말할 것입니다.
- 법적 현실: 유럽의 저작권법은 음식 평론가에 더 가깝습니다. 평론가는 단순히 정확한 단어에만 신경 쓰는 것이 아니라, 스타일, 풍미, 플레이팅, 그리고 셰프가 요리에 담아낸 독특한 이야기 방식에 관심을 가집니다. 만약 당신이 유명 셰프의 고유한 "목소리"와 "방법"을 가져와서, 재료를 약간 바꾸더라도 마치 자신의 것처럼 내놓는다면, 법은 그것이 저작권을 침해했을 수 있다고 판단합니다.
간극: 여기에는 불일치가 존재합니다. 기술은 "정확한 단어가 복제되지 않았으니 괜찮다"라고 말하지만, 법은 "하지만 스타일과 이야기가 도용되었다"라고 말합니다.
해결책: PSALM (디지털 음식 평론가)
저자들은 PSALM(Probing Stylistic Appropriation by Language Models)이라는 새로운 도구를 만들었습니다. PSALM을 저작권 법정의 판사 역할을 하도록 설계된 AI 음식 평론가 팀이라고 생각하세요.
PSALM은 단순히 얼마나 많은 단어가 일치하는지를 세는 대신, 이야기의 10가지 다른 "풍미"를 살펴봅니다:
- 문체 (Writing Style): 문장의 리듬과 어휘가 원작자의 것과 닮았는가?
- 서사적 목소리 (Narrative Voice): 이야기가 동일한 관점(예: 까칠한 노인 vs 호기심 많은 아이)에서 서술되는가?
- 캐릭터 (Characters): 인물의 성격, 동기, 관계가 동일한가?
- 플롯 (Plot): 사건의 전개와 반전의 순서가 같은가?
- 세계관 구축 (World Building): 세계의 규칙(마법 체계, 지리, 문화 등)이 복제되었는가?
- 방어 기제 (Defenses): PSALM은 또한 새로운 이야기가 패러디(원작을 희화화함), 파스티슈(경의를 표하는 오마주), 또는 인용(출처 명시)인지도 확인합니다.
PSALM은 0점에서 10점 사이의 점수를 부여합니다. 점수가 높다는 것은 AI가 단어를 복제하지 않았더라도 스타일을 "도용"했음을 의미합니다.
실험: 특정 작가가 되도록 AI를 학습시키기
연구진은 이 모델을 Llama 3.2(대중적인 AI 모델)로 테스트했습니다. 그들은 옛 네덜란드 문학을 기반으로 한 질의응답 데이터셋을 사용하여 AI를 미세 조정(Fine-tuning)했습니다.
결과:
- 학습 전: AI는 일반적인 요리사 같았습니다. 아주 평범하고 일반적인 스타일을 가지고 있었습니다.
- 학습 후: AI는 흉내쟁이가 되었습니다. 이야기를 써달라는 요청을 받았을 때, AI는 단순히 특정 문장을 기억하는 것을 넘어, 옛 네덜란드 작가들의 성격, 목소리, 그리고 플롯 구조를 완전히 채택했습니다.
- 비유: AI는 단순히 요리책을 낭독하는 것이 아니라, 재료가 약간 다르더라도 유명 셰프와 똑같이 요리하기 시작했습니다. 그들만의 독특한 기술과 프레젠테이션 방식을 그대로 사용한 것입니다.
- 핵심 발견: AI는 "단어 그대로의" 테스트는 통과했습니다(정확한 문장을 복제하지 않았습니다). 하지만 PSALM은 이 AI가 작가의 스타일과 이야기 구조를 훔쳤다는 점에서 10/10점을 주었습니다.
"망각 시도": 스타일을 잊을 수 있는가?
연구진은 그 후 **부정적 선호 최적화(Negative Preference Optimization, NPO)**라는 기술을 사용하여 AI가 이 특정 책들을 "학습하지 않도록(unlearn)" 시도했습니다. 이것은 셰프의 뇌에서 특정 레시피를 지워버리려는 시도와 같습니다.
결과:
- 좋은 소식: AI는 정확한 단어를 복제하는 것을 멈추는 데 성공했습니다. 특정 구절을 읊어달라고 요청하면, AI는 더 이상 그것을 할 수 없었습니다. "축자적(verbatim)" 점수는 0으로 떨어졌습니다.
- 나쁜 소식: AI는 스타일을 잊지 못했습니다.
- 비유: 당신은 셰프의 뇌에서 특정 레시피는 지워냈지만, 그 셰프는 여전히 원본 셰프와 똑같은 독특한 리듬, 플레이팅 스타일, 그리고 풍미의 프로필을 가지고 요리합니다.
- PSALM은 여전히 이 "학습을 거부한" AI가 작가의 목소리와 이야기 구조를 훔쳤다는 높은 점수를 부여했습니다. AI는 비록 단어를 복제하지는 않았지만, 여전히 원작과 "너무 유사"했습니다.
결론
이 논문은 현재의 안전 도구들로는 충분하지 않다고 결론짓습니다.
- 현재의 도구들: 당신이 단어를 복제했는지만 확인합니다 (마치 텍스트를 대조하는 사서처럼).
- 법: 스타일과 이야기를 훔쳤는지에 관심을 가집니다 (마치 분위기를 체크하는 평론가처럼).
- 현실: 설령 "단어"를 잊도록 만든다 해도, AI는 저작물의 스타일과 구조를 여전히 보유할 수 있습니다.
시사점: AI 시대에 저작권을 진정으로 존중하기 위해서는, 단순히 단어의 도용이 아니라 스타일과 구조의 도용을 측정하고 막아야 합니다. PSALM 도구는 이러한 "분위기 도둑(vibe thieves)"을 잡아낼 수 있는 시스템을 구축하기 위한 첫걸음입니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.