← 최신 논문
🤖 AI

TeleMorpher: Toward Robust Simultaneous Motion-Location Editing

TeleMorpher는 피사체를 배경으로부터 분리하고, 포즈 워핑을 위해 모션 프라이어를 활용하며, 고품질의 제어 가능한 결과를 보장하기 위해 새로운 LPIPS 기반 메트릭을 도입함으로써 비디오 내에서 강건한 동시 동작 및 위치 편집을 가능하게 하는 새로운 원샷(one-shot), 학습 불필요(training-free) 프레임워크이다.

원저자: Haengbok Chung

게시일 2026-06-19
📖 3 분 읽기☕ 가벼운 읽기

원저자: Haengbok Chung

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신의 거실에서 친구가 춤을 추고 있는 홈 비디오가 있다고 상상해 보세요. 이제, 당신은 두 가지를 동시에 바꾸고 싶습니다. 친구가 완전히 다른 춤 동작을 하도록 하고(동작 변경), 친구의 위치를 방 중앙에서 구석으로 옮기고 싶습니다(위치 변경).

현재의 비디오 편집 도구로 이 작업을 수행하는 것은 마치 가구나 벽을 망가뜨리지 않고 오래된 그림 위에 새 그림을 그리려는 것과 같습니다. 보통 사람을 움직이려고 하면 배경이 지저지는 듯 엉망이 되거나, 사람의 얼굴이 이상하게 변하곤 합니다. 만약 춤을 바꾸려고 하면, 사람이 글리치(glitch) 현상을 일으키거나 깜빡거리는 것처럼 보일 수 있습니다.

TeleMorpher는 바로 이 특정 문제를 해결하기 위해 설계된 새로운 도구입니다. 이 도구가 어떻게 작동하는지 쉽게 설명해 드리겠습니다.

1. "오려 붙이기" 전략 (분리 - Disentanglement)

비디오를 층층이 쌓인 케이크라고 생각해 보세요. 맨 아래 층은 배경(방)이고, 그 위 층은 주인공(사람)입니다.

  • 기존 방식: 케이크 전체를 한꺼번에 편집하려고 하면 종종 프로스팅(배경)을 망치거나 케이크 층(사람)을 망가뜨립니다.
  • TeleMorpher의 방식: 이 도구는 스마트한 "디지털 칼"을 사용하여 배경을 남겨둔 채 사람만을 조심스럽게 오려냅니다. 그런 다음, 배경의 빈 공간을 다시 온전해 보이도록 채워 넣습니다. 이제, 깨끗하고 분리된 접시 위에서 사람만을 따로 편집할 수 있게 됩니다.

2. "유령 무용수" 가이드 (모션 프라이어 - Motion Priors)

사람에게 새로운 춤을 가르치기 위해, 기존 도구들은 보통 누군가가 그 동작을 똑같이 수행하는 참조 비디오가 필요합니다. 하지만 만약 그 특정 동작을 하는 비디오를 찾을 수 없다면 어떻게 될까요?

  • TeleMorpher의 방식: 실제 비디오를 찾는 대신, "유령 무용수(Ghost Dancer)"를 사용합니다. 이는 어떤 동작이든 완벽하게 수행할 수 있는 컴퓨터 생성 3D 아바타입니다. 이 도구는 이 완벽하고 합성된 댄스를 가이드로 사용합니다. 이는 마치 카메라 팀을 동원해 먼저 촬영할 필요 없이, 완벽한 동작을 보여줄 수 있는 완벽한 댄스 강사를 곁에 두는 것과 같습니다.

3. "신축성 있는 슈트" (포즈 워핑 - Pose Warping)

완벽한 가이드가 있더라도, 비디오 속의 사람은 유령 무용수와 다를 수 있습니다(예를 들어 키가 더 크거나 다른 옷을 입고 있을 수 있습니다). 만약 단순히 새로운 춤을 그들에게 강제로 적용한다면, 부자연스러워 보일 수 있습니다.

  • TeleMorpher의 방식: 이 도구는 "훈련이 필요 없는 포즈 워핑(training-free pose warping)"을 수행합니다. 비디오 속 인물이 신축성 있는 슈트를 입고 있다고 상상해 보세요. 이 도구는 새로운 춤을 적용하기 전에, 현재의 포즈를 유령 무용수의 포즈에 맞게 부드럽게 늘리고 모양을 잡습니다. 이를 통해 사람이 왜곡되거나 녹아내리는 것처럼 보이지 않도록 합니다. 이는 마치 옷을 입기 전에 몸에 딱 맞게 수트를 맞추는 것과 같습니다.

4. "매끄러운 재결합"

사람이 새로운 춤을 추고 새로운 위치에 배치되도록 편집되면, TeleMorpher는 그들을 원래의 거실 비디오 속에 조심스럽게 다시 배치합니다. 배경을 별도로 유지하고 사람만을 편집했기 때문에, 방은 똑같이 유지되며 사람은 깜빡임이나 이상한 경계선 없이 완벽하게 어우러집니다.

이것이 왜 중요한가요?

논문에 따르면 기존의 도구들은 동작과 위치 변화를 동시에 수행하는 데 자주 실패했습니다. 배경을 이상하게 만들거나, 사람을 깜빡거리게 하거나, 비디오를 망가뜨리지 않고는 사람을 새로운 위치로 이동시키지 못했습니다.

TeleMorpher는 다음과 같은 방식으로 이를 해결합니다:

  • 사람을 배경에서 분리하여 장면을 망치는 것을 방지합니다.
  • 합성 가이드(유령 무용수)를 사용하여 적절한 참조 비디오를 찾아야 하는 제한을 없앴습니다.
  • 사람의 포즈를 부드럽게 늘려 새로운 동작이 자연스럽게 보이도록 합니다.

저자들은 실제 비디오를 대상으로 테스트를 진행했으며, TeleMorpher가 사람의 얼굴과 옷을 실제처럼 유지하고, 배경을 안정적으로 유지하며, 다른 현재 방식들보다 더 성공적으로 사람을 새로운 위치로 이동시키면서 새로운 춤을 구현한다는 것을 발견했습니다. 또한, 배경이 그대로 유지되었는지와 사람의 골격(뼈 구조)이 실제로 새로운 위치로 이동했는지를 구체적으로 확인하는 새로운 성공 측정 방식도 만들어냈습니다.

요약하자면, TeleMorpher는 주변 장면의 현실을 깨뜨리지 않으면서도 비디오 속 캐릭터의 행동과 위치를 다시 쓸 수 있게 해주는 마법 같은 편집 도구입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →