Scalable Black-Box Model Attribution for Images
이 논문은 복잡한 기존 방식들보다 생성 이미지 모델을 식별하는 데 있어 더 뛰어난 성능을 보이면서도, 재학습 없이 비지도 그룹화 및 퓨샷 적응을 위한 다각적인 역량을 제공하는 가볍고 견고한 블랙박스 방법인 RPA(Raw-Patch Attribution)를 소개한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
지난 몇 년 동안, 새로운 종류의 인공지능이 우리가 이미지를 생성하는 방식을 변화시켰습니다. 생성 모델(generative models)로 알려진 이 시스템들은 단순한 텍스트 설명을 놀랍도록 사실적인 사진 같은 이미지로 바꿀 수 있습니다. 이들은 매우 흔해져서 이제 현대 미디어 제작과 창의적 작업의 상당 부분을 뒷받침하고 있습니다. 그러나 이러한 급격한 확산은 중대한 문제를 야기했습니다. 어떤 이미지를 볼 때, 그것을 만든 특정 기계가 무엇인지 구별하는 것이 종종 불가능하다는 점입니다. 이러한 불확실성은 예술가의 지적 재산을 보호하는 것부터 오도하는 콘텐츠의 출처를 추적하는 것에 이르기까지 다양한 이유로 중요합니다. 과제는 단순히 이미지가 가짜임을 알아내는 것이 아니라, 수백 개의 서로 다른 AI 엔진 중 정확히 어떤 것이 이를 생성했는지 식별하는 것입니다. '모델 속성(model attribution)'이라 불리는 이 작업은 생성기들이 끊임없이 진화하고 있으며, 그 결과물들이 인간의 눈에는 거의 동일하게 보이기 때문에 어렵습니다. 더욱이, 수천 개의 맞춤형 버전을 포함하여 사용 가능한 모델의 수가 엄청나다는 점은 그 출처를 추적하는 일을 압도적으로 느껴지게 만듭니다.
텔아비브 대학교의 연구진은 이 복잡한 문제에 대한 놀라울 정도로 간단한 해결책을 찾아냈습니다. 생성기의 복잡성에 맞추어 거대하고 복잡한 시스템을 구축하는 대신, 그들은 기본적인 분류기처럼 작동하는 가벼운 도구를 개발했습니다. RPA라고 불리는 그들의 방식은 엄격한 '블랙박스(black-box)' 환경에서 작동하는데, 이는 AI가 만든 최종 이미지만을 볼 뿐, 그 AI의 내부 코드, 가중치 또는 비밀 설정에 접근할 필요가 없음을 의미합니다. 이 방법은 이미지를 작은 사각형으로 나누고 각 사각형의 원시 색상 패턴을 분석합니다. 서로 다른 모델에서 나온 이미지들이 시각적으로 유사함에도 불구하고, 연구진은 각 생성기가 픽셀의 질감 속에 고유한 저수준 지문(low-level fingerprint)을 남긴다는 사실을 발견했습니다. 이러한 미묘한 패턴을 인식하도록 작은 신경망을 학습시킴으로써, 이 시스템은 놀라운 정밀도로 이미지의 출처를 식별할 수 있습니다. 25개의 서로 다른 모델을 대상으로 한 테스트 세트에서 이 도구는 98.0%의 정확도를 달랐으며, 더 혼란스러운 실제 환경의 27개 모델 세트에서도 여전히 92.9%에 도달했습니다.
이 발견을 특히 놀랍게 만드는 것은 이 도구가 인터넷의 무질서한 현실을 다루는 방식입니다. 야생의 이미지들은 결코 깨끗하지 않습니다. 이미지들은 소셜 미디어와 뉴스 사이트를 가로질러 이동하면서 종종 압축되거나, 흐려지거나, 크기가 조정됩니다. 기존의 많은 방법은 이러한 흔한 변화에 직면했을 때 실패했습니다. 그러나 이 새로운 시스템은 견고함을 유지합니다. 연구진이 이미지를 심하게 압축하거나 크기를 조절하여 테스트했을 때, 정확도는 약간만 떨어졌으며, 이는 이 도구가 감지하는 지문이 일시적인 흔적이 아니라 근본적인 구조적 특성임을 입증합니다. 또한 이 시스템은 매우 효율적입니다. 이미지를 가능한 모든 후보 모델과 하나씩 비교해야 하는 다른 방식들과 달리—이 과정은 모델의 수가 늘어남에 따라 느려집니다—이 도구는 단 한 번의 통과(single pass)로 이미지를 평가합니다. 출처를 식별하는 데 걸리는 시간은 알려진 모델의 데이터베이스가 수십 개에서 수천 개로 확장되더라도 증가하지 않습니다.
연구진은 이 도구가 단순히 알려진 모델을 식별하는 것을 넘어, 더 깊고 다재다능한 지능을 갖추고 있음을 발견했습니다. 이 도구는 이전에 본 적 없는 생성기의 이미지를 마주했을 때, 잘못된 추측을 강요하는 대신 이를 '알 수 없음(unknown)'으로 신뢰성 있게 표시할 수 있습니다. 새로운 모델이 매일 등장하는 분야에서 이러한 미지의 대상을 인식하는 능력은 매우 중요합니다. 더욱이, 이 시스템은 이러한 새로운 모델들에 거의 즉각적으로 적응할 수 있습니다. 긴 재학습 과정을 요구하는 대신, 연구진은 기존 네트워크에 작고 단순한 레이어를 추가하는 것만으로도 새로운 모델을 추가할 수 있으며, 이 작업은 단 몇 분밖에 걸리지 않습니다. 이러한 유연성은 이 도구가 단순히 특정 사례의 목록을 암기하는 것이 아니라, 이러한 기계들이 작동하는 일반적인 지도를 학습했음을 시사합니다.
연구진은 또한 학습된 이해를 사용하여 모델들 사이의 관계를 탐구했습니다. 도구가 결정을 내리는 데 사용하는 내부 특징들을 분석함으로써, 그들은 어떤 모델들이 서로 연관되어 있는지 알려주지 않았음에도 불구하고 건축적 유사성을 바탕으로 서로 다른 생성기들을 '가족' 단위로 그룹화할 수 있었습니다. 시스템은 특정 모델들이 공통된 계보나 기초 기술을 공유하고 있음을 정확히 식별하여, 그들의 발전 과정에 대해 알려진 사실과 일치하도록 이들을 함께 묶었습니다. 이러한 능력은 보지 못한 생성기의 이미지에도 적용되어, 사전 학습 없이도 진정한 출처에 따라 도구가 이들을 그룹화할 수 있게 해줍니다. 이 연구는 단순하고 직접적인 접근 방식이 디지털 기원을 추적하는 작업에서 정교하고 무거운 장치들보다 더 뛰어난 성과를 낼 수 있음을 보여줍니다. 이는 이러한 복잡한 시스템을 이해하는 열쇠가 더 복잡한 탐지기를 만드는 것이 아니라, 모든 기계가 생성하는 이미지 속에 남기는 미묘하고 지속적인 서명(signature)을 인식하는 데 있음을 시사합니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.