← 최신 논문
💻 computer science

DETOUR: A Practical Backdoor Attack against Object Detection

본 논문은 다양한 시야각에서 실제 객체에서 추출된 다양한 크기로 재조정된 의미적 트리거로 모델을 학습시켜 "트리거 방사 효과"를 활용하는 객체 탐지 트랜스포머에 대한 실용적인 백도어 공격인 DETOUR 를 제안하며, 이를 통해 다양한 공간 구성 및 시점 전반에 걸쳐 견고한 활성화를 보장한다.

원저자: Dazhuang Liu, Yanqi Qiao, Rui Wang, Kaitai Liang, Georgios Smaragdakis

게시일 2026-04-28
📖 3 분 읽기☕ 가벼운 읽기

원저자: Dazhuang Liu, Yanqi Qiao, Rui Wang, Kaitai Liang, Georgios Smaragdakis

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

매우 똑똑한 보안 카메라 시스템(객체 감지 모델)이 자동차, 사람, 동물을 찾아내도록 설계되어 있다고 상상해 보세요. 이 시스템의 임무는 사진을 보고 그 안에 있는 모든 것을 찾아 "저건 자동차야" 또는 "저건 개야"라고 말하는 것입니다.

이 논문은 이러한 카메라 시스템을 속이는 새로운 방법을 소개하며, 저자들은 이를 DETOUR이라고 명명했습니다.

간단한 비유를 사용하여 작동 원리를 설명하면 다음과 같습니다:

1. 구식 속임수의 문제점

이전에는 이러한 카메라를 해킹하기 위해 "보이지 않는" 속임수에 의존했습니다. 사진에 아주 작고 거의 보이지 않는 먼지 한 알을 추가하여 카메라를 속이려 한다고 상상해 보세요.

  • 결함: 실제 세계에서는 카메라가 완벽하지 않습니다. 그 작은 먼지 한 알을 종이에 인쇄하여 카메라 앞에 들어 올리면, 조명, 거리, 각도 때문에 카메라가 이를 놓칠 수 있습니다. 소음 제거 헤드폰을 낀 사람에게 속삭여 비밀을 전하려는 것과 같습니다. 메시지가 사라져 버리는 것이죠.
  • 한계: 이러한 구식 속임수는 "먼지"가 매번 정확히 같은 위치에 있을 때만 작동했습니다. 카메라가 조금만 움직여도 해킹은 더 이상 작동하지 않았습니다.

2. 새로운 전략: "마법 머그컵"

이 논문의 저자들은 보이지 않으려 애쓰는 것을 멈추기로 결정했습니다. 대신 분명하고 실제적인 것, 즉 커피 머그컵을 사용했습니다.

  • 트리거: 그들은 실제 세계의 객체 (머그컵 등) 의 이미지를 "트리거"로 사용합니다. 이상하고 보이지 않는 패턴이 아니라, 테이블 위에 있을 법한 평범한 객체입니다.
  • 작동 원리: 이것이 실제 객체이기 때문에, 조명 변화나 거리가 어떻게 변하든 카메라가 이를 쉽게 감지할 수 있습니다. 속삭이는 대신 비밀을 외치는 것과 같습니다. 카메라는 분명히 그것을 듣게 됩니다.

3. "방사 효과" (비밀 소스)

저자들이 발견한 가장 흥미로운 발견은 **트리거 방사 효과 (Trigger Radiating Effect, TRE)**라고 불리는 것입니다.

  • 비유: 연못에 돌을 던진다고 상상해 보세요. 물결치는 파문은 돌이 떨어진 곳에만 머무르지 않고 모든 방향으로 퍼져 나갑니다.
  • 적용 방식: 저자들은 카메라를 "머그컵" 트리거로 인식하도록 훈련시켰을 때, 카메라가 사진의 정중앙에 머그컵이 있을 때만 반응하는 것이 아니라, 머그컵이 약간 왼쪽, 오른쪽, 위, 아래에 있을 때도 반응한다는 사실을 발견했습니다. "해킹"이 트리거 위치에서 방사되어 퍼져 나간 것입니다.
  • 업그레이드: 머그컵을 많은 다른 위치와 많은 다른 크기 (줌인, 줌아웃) 로 카메라에 훈련시킴으로써, "물결"이 연못 전체를 덮게 됩니다. 이제 사진에서 머그컵이 어디에 나타나든 카메라는 속아 넘어갑니다.

4. 해킹이 작동할 때 무슨 일이 일어날까?

공격자의 목표에 따라 카메라는 머그컵을 보았을 때 다음 세 가지 중 하나를 수행하기 시작합니다:

  1. 오분류: 개를 보지만 머그컵이 있기 때문에 "저건 사람이야!"라고 외칩니다.
  2. 소멸: 자동차를 보지만 머그컵이 있기 때문에 자동차가 아예 존재하지 않는 것처럼 가장합니다.
  3. 환각: 빈 거리를 보지만 머그컵이 있기 때문에 허공에서 가짜 자동차나 사람을 만들어냅니다.

5. 왜 이것이 중요한가?

저자들은 이 방법을 여섯 가지 다른 "해킹 목표"(카메라가 사물을 놓치게 하거나 존재하지 않는 것을 보게 하는 것 등) 에 대해 테스트했습니다.

  • 결과: 그들의 방법 (DETOUR) 은 이전 방법들보다 카메라를 속이는 데 36% 더 효과적이었고, 트리거가 어디에 배치되든 작동하는 데 70% 더 우수했습니다.
  • 안전성: 결정적으로 머그컵이 사진에 없을 때, 카메라는 여전히 완벽하게 작동합니다. 카메라를 고장 내는 것이 아니라, 머그컵이 있을 때만 열리는 숨겨진 "백도어"를 추가하는 것입니다.

요약

DETOUR을 특정 빨간 머그컵을 보지 않는 한 방 안의 모든 것을 무시하도록 보안 요원을 가르치는 것이라고 생각하세요.

  • 구식 해킹들은 보안 요원이 아주 작고 보이지 않는 점을 보았을 때 사물을 무시하도록 가르치려 했습니다 (보안 요원은 이를 종종 놓쳤습니다).
  • DETOUR은 보안 요원이 크고 분명한 빨간 머그컵에 반응하도록 가르칩니다.
  • 더 나아가, 보안 요원은 머그컵이 책상 위뿐만 아니라 방 어딘가에 있더라도 그 규칙이 적용된다는 것을 배웠습니다.
  • 그리고 머그컵이 없다면? 보안 요원은 완벽한 임무 수행으로 모든 실제 자동차와 사람을 찾아냅니다.

이 논문은 실제 세계의 객체를 사용하고 카메라의 "뇌"가 주의를 어떻게 퍼뜨리는지 이해함으로써, 공격자들이 이러한 시스템을 속이는 훨씬 더 신뢰할 수 있고 실용적인 방법을 만들 수 있음을 증명합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →