← 최신 논문
🤖 AI

Orthogonal Concept Erasure for Diffusion Models

본 논문은 확산 모델에서 원치 않는 개념을 정밀하게 제거하면서도 전반적인 생성 능력을 유지하고 효율적인 다중 개념 제거를 가능하게 하는 곱셈 직교 변환을 활용하는 새로운 편집 기반 방법인 직교 개념 소거 (OCE) 를 제안합니다.

원저자: Yuhao Sun, Lingyun Yu, Haoxiang Xu, Fengyuan Miao, Zhuoer Xu, Hongtao Xie

게시일 2026-05-29
📖 3 분 읽기☕ 가벼운 읽기

원저자: Yuhao Sun, Lingyun Yu, Haoxiang Xu, Fengyuan Miao, Zhuoer Xu, Hongtao Xie

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

상상해 보세요. 세계의 어떤 요리든 레시피(텍스트 프롬프트)에 따라 요리할 수 있는 마스터 셰프가 있다고 가정해 봅시다. 이 셰프는 매우 재능이 뛰어나지만, 때로는 요청하지 않은 특정 재료, 예를 들어 특정 유명인의 얼굴, 저작권이 있는 캐릭터, 혹은 피하고 싶은 화풍을 실수로 추가하기도 합니다. 당신은 셰프가 다른 모든 것을 요리하는 법을 잊지 않도록 하면서, 이 특정 것들을 잊도록 "가르치고" 싶습니다.

이 논문은 AI 이미지 생성기에 정확히 그 작업을 수행하는 OCE(직교 개념 삭제, Orthogonal Concept Erasure) 라는 새로운 방법을 소개합니다. 간단한 비유를 통해 작동 원리를 설명해 보겠습니다:

문제: "가산적" 실수

이전 방법들은 셰프의 기억에 작은 보정을 단순히 추가함으로써 이러한 원치 않는 개념들을 제거하려고 시도했습니다.

  • 비유: 셰프의 뇌를 책 (뉴런) 이 가득 찬 거대한 도서관이라고 상상해 보세요. "반 고흐"에 관한 책을 제거하기 위해, 이전 방법들은 기존 텍스트 위에 글을 쓰거나 새로운 메모를 붙이려 했습니다.
  • 결함: 글을 쓰거나 붙일 때, 실수로 종이의 두께 (크기) 와 책이 선반에 놓인 각도 (기하학적 구조) 를 변경하게 됩니다. 이는 도서관의 정돈 상태를 무너뜨립니다. 셰프는 "반 고흐"를 잊을지도 모르지만, "모네"를 그리는 법이나 심지어 간단한 "고양이"를 그리는 법까지 잊기 시작할 수 있는데, 이는 도서관 전체가 뒤죽박죽이 되었기 때문입니다.

해결책: "회전" 트릭 (OCE)

저자들은 "반 고흐"와 같은 개념의 의미가 책의 두께가 아니라 책이 향하는 방향에 저장되어 있으며, 그림을 그리는 전반적인 능력은 선반 위 책들 사이의 각도에서 비롯된다는 사실을 깨달았습니다.

OCE 는 전략을 "글을 쓰는 것"에서 회전으로 바꿉니다.

  • 비유: 메모를 붙이는 대신, OCE 는 책이 꽂힌 선반 전체를 부드럽게 회전시킵니다. "반 고흐" 책을 다른 방향을 보게 돌려서 (AI 가 더 이상 그것을 반 고흐로 인식하지 않도록 하되), 책의 두께는 정확히 그대로 유지하고 "고양이" 책과의 각도 관계도 완벽하게 보존합니다.
  • 결과: 셰프는 특정 원치 않는 개념은 잊지만, 도서관의 구조가 온전하게 유지되므로 나머지 모든 것은 완벽하게 기억합니다.

큰 도전: 100 가지 것을 한 번에 삭제하기

셰프가 100 명의 다른 유명인을 동시에 잊기를 원한다면 어떨까요?

  • 구식 방식: 100 명의 사람을 개별적으로 위해 선반을 회전시키려 하면, 지시 사항들이 서로 모순될 수 있습니다. 선반을 너무 많이 돌려 도서관 전체가 무너질 수도 있습니다.
  • OCE 방식: OCE 는 100 명의 유명인을 단일 "그룹"이나 부분 공간(도서관 내의 특정 구역) 으로 취급합니다. 개별 책들과 싸우는 대신, 해당 구역 전체를 "안전" 구역에서 부드럽게 밀어냅니다. 100 권의 책을 하나씩 옮기려 하는 대신 도서관의 한 구획 전체를 다른 방으로 옮기는 것과 같습니다.

왜 이것이 중요한가

이 논문은 이 방법이 다음과 같음을 보여줍니다:

  1. 정밀함: 특정 유명인이나 화풍과 같은 원치 않는 것들을 매우 효과적으로 제거합니다.
  2. 안전함: AI 가 다른 이미지를 생성하는 능력을 손상시키지 않습니다.
  3. 빠름: 최대 100 개의 개념을 단 4.3 초 만에 삭제할 수 있습니다.

간단히 말해, OCE 는 특정 것을 잊기 위해 AI 의 기억을 회전시키는 외과적 도구인 반면, 구식 방법들은 기억을 부수기 위해 망치를 사용하는 것과 같아서, 그 과정에서 다른 것들도 종종 손상되었습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →