← 최신 논문
💻 computer science

High-Capacity Robust Watermarking Technology for High-Resolution Images

본 논문은 1024×1024 해상도의 이미지에 4 KB의 데이터를 삽입하면서도 강력한 시각적 비가시성과 다양한 노이즈 공격에 대한 저항성을 유지하기 위해, 블록 단위 전략과 가역적 대칭 인코더-디코더 구조를 활용하는 고해상도 이미지용 고용량, 강건 워터마킹 방법을 제안한다.

원저자: Shaowu Wu, Wei Lu, Qing Qian, Mingsen Deng

게시일 2026-07-21
📖 4 분 읽기☕ 가벼운 읽기

원저자: Shaowu Wu, Wei Lu, Qing Qian, Mingsen Deng

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 거대한 디지털 도서관을 걷고 있다고 상상해 보세요. 그곳의 모든 책, 그림, 노래는 초지능 로봇 예술가에 의해 만들어지고 있습니다. 이 로봇들은 놀랍습니다. 이들은 몇 초 만에 걸작을 뽑아내어 인간이 더 빠르고 저렴하게 일할 수 있도록 도와줍니다. 하지만 문제가 하나 있습니다. 로봇들이 너무 쉽게 많은 것들을 만들어내기 때문에, 예술품의 실제 소유자가 누구인지, 혹은 그것이 어디에서 왔는지 파악하기가 점점 어려워지고 있다는 점입니다. 이는 마치 수백만 명의 사람들이 당신이 가장 좋아하는 노래를 복제하여 자신의 것처럼 팔기 시작한 것과 같습니다. 이를 해결하기 위해 과학자들은 "디지털 워터마크"를 사용해 왔습니다. 이것을 젖은 잉크가 아니라, 이미지의 픽셀 안에 숨겨진 보이지 않는 아주 작은 비밀 메시지라고 생각하세요. 지폐의 실제 워터마크처럼, 이 디지털 코드들은 그림을 망치지 않으면서도 소유권을 증명합니다.

오랫동안 이 비밀 메시지는 매우 작았습니다. 마치 "Copyright 2024"라는 짧은 문구나 짧은 ID 번호 같은 것이었죠. 이 방식은 우표 크기 정도의 작고 저해상도인 사진에서는 아주 잘 작동했습니다. 하지만 오늘날 우리는 빌보드에 인쇄해도 될 정도로 거대하고 고화질인 이미지를 다루고 있습니다. 엄청난 양의 정보(예를 들어 긴 문단이나 긴 ID 코드)를 거대하고 고품질인 사진 속에 숨기는 것은 매우 어려운 일입니다. 너무 많은 것을 좁은 공간에 억지로 집어넣으려 하면 사진이 흐릿해지거나, 이미지를 수정했을 때 비밀 메시지가 사라져 버립니다. 이 논문은 고화질의 거대한 이미지 안에 그림을 망치거나 메시지를 잃어버리지 않으면서도 방대한 양의 비밀 정보를 숨기는 과제를 다룹니다.

연구진(Sun Yat-sen 대학교와 Guizhou 재경대학교의 팀)은 이 퍼즐을 풀기 위해 새로운 시스템을 구축했습니다. 그들의 핵심 아이디어는 비밀 메시지 전체를 한꺼번에 거대한 덩어리로 숨기려고 노력하는 것을 멈추는 것입니다. 대신, 그들은 "블록 단위(block-wise)" 전략을 사용합니다. 당신이 도시의 거대하고 고해상도인 사진을 가지고 있다고 상상해 보세요. 도시 전체에 걸쳐 한꺼번에 비밀 메시지를 숨기는 대신, 그들은 도시를 작고 관리 가능한 수천 개의 구획(블록)으로 나눕니다. 그러고 나서 각 구획에 비밀 메시지의 아주 작은 조각을 숨깁니다.

이 접근 방식은 큰 건물 안에서 활동하는 스파이 팀과 같습니다. 한 명의 스파이가 거대한 여행 가방을 메인 로비에 숨기려고 한다면(그것은 눈에 띄기 쉽고 옮기기도 어렵겠죠), 대신 여러 명의 스파이가 각기 다른 방에 작고 가벼운 소포를 숨기는 것과 같습니다. 이렇게 하면 설령 스파이들이 사용할 수 있는 자원(예: 강력한 컴퓨터)이 적더라도 훨씬 수월하게 임무를 수행할 수 있습니다. 문제를 세분화함으로써, 그들의 시스템은 1024×1024 픽셀의 단일 이미지 안에 4 KB(즉, 32,768 비트)에 달하는 엄청난 양의 데이터를 숨길 수 있습니다. 이는 기존 시스템이 처리할 수 있었던 30 또는 100 비트와 비교하면 엄청난 도약입니다.

이 시스템은 두 단계의 마술처럼 작동합니다. 먼저, "인코더(Encoder)"가 원본 이미지와 비밀 메시지를 가져와, 그것들을 조각내어 이미지의 작은 블록들 속에 엮어 넣습니다. 이 과정은 가역적이고 대칭적이도록 설계되었습니다. 즉, 과정이 완벽하게 균형을 이룬다는 뜻입니다. 그다음, 이미지가 JPEG 압축으로 찌그러지거나, 노이즈로 덮이거나, 일부가 잘려 나가는 등의 공격을 받더라도 "디코더(Decoder)"는 여전히 조각들을 찾아낼 수 있습니다. 디코더는 과정을 역순으로 수행하여, 각 블록에서 작은 메시지 파편들을 모으고 이를 다시 꿰매어 전체 비밀을 밝혀냅니다.

이 마술이 완벽하게 작동하도록 하기 위해, 연구팀은 "손실 함수(loss function)"라고 불리는 특별한 규칙을 사용하여 컴퓨터 두뇌를 훈련시켰습니다. 이것은 시각적 품질(얼마나 보이지 않는가)과 강건성(공격으로부터 얼마나 잘 견디는가)이라는 두 가지 요소로 시스템을 채점하는 엄격한 선생님이라고 생각하면 됩니다. 그들은 단순히 이미지 전체를 채점한 것이 아니라, 모든 구획(블록)을 개별적으로 채점했습니다. 이를 통해 이미지의 어떤 부분도 망가지지 않게 하고, 어디에서나 메시지가 안전하게 유지되도록 보장합니다.

결과는 인상적입니다. 테스트 결과, 시스템은 고해상도 이미지에 그 거대한 4 KB 메시지를 숨기면서도 사진이 원본과 거의 동일하게 보이도록 유지했습니다. 품질 점수(PSNR)는 36 dB 이상을 유지했고, 구조적 유사도(SSIM)는 0.92를 넘었습니다. 이는 인간의 눈으로는 차이를 거의 느낄 수 없음을 의미합니다. 심한 JPEG 압축이나 무작위 노이즈를 추가하는 등 혹독한 공격을 시뮬레이션했을 때도, 시스템은 대부분의 경우 98% 이상의 정확도로 비밀 메시지를 복구해 냈습니다.

이 논문은 기존 방식들이 작고 저해상도인 이미지를 다루는 데는 훌륭했지만, 현대의 고해상도 이미지가 요구하는 거대한 데이터 수요를 감당하려 할 때는 어려움을 겪었다고 제안합니다. 이미지를 블록으로 나누고 각 블록을 하나의 작은 독립적인 퍼즐로 취급함으로써, 이 새로운 방법은 높은 용량과 높은 품질을 동시에 가질 수 있음을 입증했습니다. 이는 거대하고 고화질인 디지털 창작물의 아름다움을 해치지 않으면서도 그 안에 담긴 비밀 메시지를 잃지 않고 저작권을 보호할 수 있음을 보여주는 중요한 진전입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →