← 최신 논문
💻 computer science

3D Gaussian Accelerated Ray Tracing: Fast training through particle-based backward propagation

이 논문은 역전파를 픽셀 중심에서 프리미티브 중심으로 재구성함으로써 원자적 경합(atomic contention)을 제거하고 3~4배의 속도 향상을 달출하는 동시에 고품질의 완전한 레이 트레이싱 렌더링을 가능하게 하는 실용적인 훈련 프레임워크인 3DGART를 소개한다.

원저자: Laurent Vit, Oliver Batchelor, Richard Green

게시일 2026-08-19
📖 4 분 읽기☕ 가벼운 읽기

원저자: Laurent Vit, Oliver Batchelor, Richard Green

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

사진 속을 걸어 다니며 모퉁이 너머를 둘러보거나 나무에 더 가까이 다가갈 수 있고, 그 과정에서 장면이 실제처럼 완벽하게 변화하는 세상을 상상해 보십시오. 수년 동안 컴퓨터 과학자들은 평면적인 이미지 세트로부터 장면의 3차원 구조를 이해하도록 기계를 가르치기 위해 '새로운 시점 합성(novel view synthesis)'이라는 꿈을 쫓아왔습니다. 최근 가장 성공적인 접근 방식 중 하나는 장면을 고체 물체나 복잡한 신경망이 아니라, 수백만 개의 작고 흐릿한 덩어리(blob) 구름으로 표현하는 것입니다. 타원형 모양의 이 덩어리들은 색상과 투명도에 대한 정보를 담고 있습니다. 이 덩어리들을 화면에 투영하고 서로 혼합함으로써, 컴퓨터는 매우 선명하고 빠르게 실시간으로 볼 수 있는 이미지를 만들어낼 수 있습니다. '가우시안 스플래팅(Gaussian Splatting)'이라고 알려진 이 방법은 3D 환경을 재구성하는 방식을 혁신하여, 단순한 영상을 거의 즉각적으로 탐색 가능한 3D 공간으로 바꿀 수 있게 만들었습니다.

하지만 이러한 속도에는 대가가 따릅니다. 표준 방식은 비디오 게임에서 빌려온 기술에 의존하는데, 이는 컴퓨터가 카메라의 관점에서 이 덩어리들이 평평한 화면에 어떻게 보이는지를 근사적으로 계산하는 방식입니다. 이 화면 기반 방식은 믿을 수 없을 정도로 빠르지만, 빛의 복잡한 물리 법칙을 처리하는 데는 어려움을 겪습니다. 반짝이는 표면에서 튕겨 나오는 반사, 유리를 통과하며 굴절되는 빛, 또는 물체가 빛의 경로를 막을 때 생기는 그림자의 방식 등을 쉽게 다루지 못합니다. 이를 해결하기 위해 연구자들은 다른 길을 시도했습니다. 덩어리들을 화면 위에 근사화하는 대신, 가상의 빛의 광선이 장면을 통과하여 덩어리에 직접 부딪히게 하는 것입니다. 이 '레이 트레이싱(ray tracing)' 방식은 물리적으로 정확하며 반사와 그림자를 아름답게 처리하지만, 치명적인 결함이 있습니다. 바로 훈련 속도가 너무 느리다는 점입니다. 이런 방식으로 장면을 만드는 데는 몇 시간 또는 며칠이 걸릴 수도 있어, 많은 실용적인 응용 분야에서 사용하기 어렵습니다. 질문은 이것이었습니다. 원래의 방식이 가졌던 속도를 희생하지 않으면서도 레이 트레이싱의 물리적 정확성을 유지할 수 있을 것인가?

뉴질랜드 캔터베리 대학교의 연구팀은 이 간극을 메울 방법을 찾아냈습니다. 그들은 정확한 레이 트레이싱 장면을 실용적인 속도로 훈련할 수 있게 만드는 '3D 가우시안 가속 레이 트레이싱(3D Gaussian Accelerated Ray Tracing, 3DGART)'이라는 새로운 시스템을 개발했습니다. 이 돌파구는 광선을 더 빠르게 이동시키거나 물체에 더 잘 튕겨 나가게 하는 방법을 찾은 데서 온 것이 아니었습니다. 대신, 연구팀은 병목 현상이 컴퓨터가 장면을 바라보는 방식이 아니라, 컴퓨터가 실수로부터 배우는 방식에 있다는 것을 발견했습니다. 표준 방식에서는 컴퓨터가 이미지를 개선하려고 할 때, 최종 사진을 픽셀 단위로 살펴봅니다. 만약 하나의 흐릿한 덩어리가 수천 개의 서로 다른 픽셀의 색상에 기여한다면, 수천 개의 컴퓨터 프로세서가 동시에 동일한 덩어리의 설정을 업데이트하려고 시도하게 됩니다. 이는 컴퓨터 메모리 내에서 거대한 교통 체증을 일으키며, 프로세서들이 변경 사항을 적용하기 위해 줄을 서서 기다려야 하므로 모든 과정을 매우 느리게 만듭니다.

연구진은 이 과정을 뒤집는 것이 해결책임을 깨달았습니다. 수천 개의 프로세서가 동일한 덩어리를 두고 서로 경쟁하는 대신, 각 프로세서가 특정 덩어 하나와 그 덩어리가 닿는 이미지 내의 특정 구역에 있는 모든 픽셀에 대해 전적인 책임을 지도록 업무를 조직했습니다. 그들은 필요한 데이터를 화면상의 픽셀이 아닌 덩어리별로 그룹화하는 임시 저장 시스템을 구축했습니다. 이러한 변화는 혼란스러운 교통 체증을 매끄럽고 조직적인 조립 라인으로 탈바로 놓았습니다. 각 프로세서는 자신에게 할당된 덩어리에 필요한 정보를 수집하고, 필요한 조정을 계산하며, 다른 프로세서의 방해 없이 설정을 업데이트합니다. 이는 흩어져 있는 경쟁적인 과정에서 구조화된 협력적 과정으로의 전환입니다.

이러한 재조직의 결과는 놀랍습니다. 정원에 주차된 자전거와 같은 복잡한 야외 장면에서 테스트했을 때, 새로운 방식은 이전의 가장 뛰어난 레이 트레이싱 방식보다 약 4배 더 빠르게 장면을 훈련했습니다. 더 중요한 것은, 단순히 빨라진 것뿐만 아니라 더 높은 품질의 이미지를 만들어냈다는 점입니다. 시스템이 속도를 높이기 위해 지름길이나 타협안을 사용할 필요가 없었기 때문에, 빛의 완전하고 정확한 물리학을 보존할 수 있었습니다. 결과물인 장면은 화면 근사치에 의존했던 기존의 빠른 방식들보다 더 선명한 디테일과 더 사실적인 조명을 보여주었습니다. 또한 연구진은 새로운 방식이 훈련 과정 중에 더 많은 컴퓨터 메모리를 사용하지만, 이는 장면이 완성되면 사라지는 일시적인 트레이드오프(trade-off)라는 점을 발견했습니다. 훈련이 끝나면 최종 모델은 기존의 빠른 방식들만큼 효율적으로 실행되면서도, 완전한 레이 트레이싱 세계의 우수한 시각적 충실도를 갖추게 됩니다.

이 연구는 3D 재구성의 미래가 속도와 정확성 사이에서 하나를 선택해야 하는 문제가 아님을 시사합니다. 컴퓨터가 학습 과정을 조직하는 방식을 재고함으로써, 팀은 두 가지를 모두 가질 수 있음을 입증했습니다. 이 방법은 반사와 그림자 같은 복잡한 효과를 포함하는 매우 사실적이고 상호작적인 3D 환경을 실용적인 시간 내에 구축할 수 있는 문을 열어줍니다. 이는 한때 실용적이지 못할 정도로 느렸던 과정을 차세대 가상 현실, 디지털 트윈, 몰입형 미디어에 적합한 수준으로 바꾸어 놓았으며, 때로는 더 강하게 밀어붙이는 것이 아니라 더 잘 조직하는 것이 가장 빠른 길임을 증명했습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →