← 최신 논문
🤖 AI

rMuscle: Robotic Muscle Memory for Efficient Vision-Language-Action Model Inference

rMuscle은 인간의 근육 기억에서 영감을 받은 실시간 시각-언어-행동 추론 프레임 framework로, 유사한 반복 작업 전반에 걸쳐 시각적 토큰과 뉴런 활성화를 재사용하는 이중 단계 캐싱 메커니즘을 통해 원래의 성공률을 유지하면서 로봇의 응답성을 1.29~1.42배 가속화합니다.

원저자: Kaijun Zhou, Zhiyang Li, Le Chen, Jinyu Gu

게시일 2026-09-17
📖 5 분 읽기🧠 심층 분석

원저자: Kaijun Zhou, Zhiyang Li, Le Chen, Jinyu Gu

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

현대 제조업의 활기찬 세계에서, 새로운 종류의 노동자가 공장 바닥을 차지하고 있습니다. 바로 인공지능에 의해 유도되는 로봇입니다. 단 하나의 동작만을 영원히 반복할 수 있었던 과거의 경직된 사전 프로그래밍 기계와 달리, 이 새로운 시스템들은 시각과 언어를 통해 세상을 이해하도록 설계되었습니다. 이들은 어질러진 테이블을 보고, "빨간 병을 집어라"와 같은 지시를 읽고, 그 과업을 완수하는 데 필요한 정확한 움직임을 파악할 수 있습니다. 이러한 능력은 비전-언어-행동 모델(vision-language-action model)이라고 알려진 기계의 특정한 형태의 뇌에 의존합니다. 이 모델들은 로봇이 보고 듣는 것을 처리한 다음, 그 이해를 물리적 명령의 흐름으로 변환하는 중추 신경계 역할을 합니다. 이러한 로봇이 실제 공장에서 진정으로 유용해지려면, 반드시 빨라야 합니다. 만약 로봇의 뇌가 생각하는 데 너무 오래 걸린다면, 기계는 머뭇거리게 되고, 움직임은 끊기며, 인간 작업자가 개입하거나 물체가 움직일 때 충분히 빠르게 반응하지 못하게 됩니다. 로봇이 생각하고 결정하는 속도는 그것이 인간의 작업 속도를 따라잡을 수 있는지를 결정하는 가장 중요한 단일 요소입니다.

상하이 교통대학교의 연구진은 이러한 지능형 로봇들이 현재 어떻게 생각하는지에 대한 근본적인 병목 현상을 식별했습니다. 그들은 이 로봇들을 구동하는 소프트웨어가 매우 정교함에도 불구하고, 종종 똑같은 것들을 반복해서 다시 배우느라 시간을 낭비하고 있다는 사실을 발견했습니다. 전형적인 공장 환경에서 로봇은 매초 완전히 새로운 세상을 마주하는 것이 아닙니다. 대신, 유사한 물체를 유사한 장소로 유사한 조명 조건 아래에서 옮기는 반복적인 과업의 루프를 수행합니다. 연구팀은 과업들이 매우 유사하기 때문에, 로봇의 내부 상태—디지털 뇌 내부의 복잡한 활동 패턴—또한 한 시도에서 다음 시도로 넘어갈 때 놀라울 정도로 유사해진다는 것을 발견했습니다. 마치 인간 피아니스트가 익숙한 곡을 연주할 때마다 손가락의 움직임을 새로 배울 필요가 없는 것처럼, 로봇 또한 이러한 패턴을 회상할 능력이 있습니다. 그러나 기존의 소프트웨어 프레임워크는 이를 활용하지 못하며, 심지어 방금 전의 답이 본질적으로 동일할 때조차 로봇이 모든 계산을 처음부터 수행하도록 강요합니다.

이를 해결하기 위해 연구진은 로봇에게 디지털 근육 기억의 형태를 부여하도록 설계된 프레임워크인 rMuscle이라는 새로운 시스템을 개발했습니다. 이 시스템은 로봇이 과업을 수행하는 방식을 관찰하고 성공적인 시도 중에 가졌던 "생각"들을 저장하는 방식으로 작동합니다. 로봇이 이전의 상황과 유사한 상황에 직면하면, rMuscle은 제로에서 시작하지 않습니다. 대신, 메모리 뱅크에서 관련 있는 내부 패턴을 검색합니다. 이 시스템은 로봇이 생각하는 서로 다른 방식들을 처리하기 위해 두 가지 뚜렷한 유형의 메모리를 기반으로 구축되었습니다. 첫 번째 부분인 컨텍스트 캐시(Context Cache)는 시각적 처리를 담당합니다. 로봇이 익숙한 장면을 볼 때, 이 캐시는 모든 픽셀을 다시 분석하는 무거운 작업을 건너뛰고 이전의 시각적 분석 결과를 재사용할 수 있게 해줍니다. 두 번째 부분인 액션 캐시(Action Cache)는 움직임을 위한 의사결정을 담당합니다. 이는 많은 반복적인 과업에서 로봇의 내부 결정 요인 중 아주 작고 특정한 세트만이 문제를 해결하는 데 실제로 필요하다는 점을 인식합니다. 익숙한 시나리오에서 어떤 특정 뇌 부위가 활성화되는지를 식별함으로써, 시스템은 나머지 부분을 무시하고 결정을 내리는 데 필요한 구성 요소만을 로드할 수 있습니다.

연구진은 시뮬레이션 환경부터 조립 라인에서 작업하는 실제 물리적 로봇에 이르기까지 다양한 로봇과 과업에 대해 이 접근 방식을 테스트했습니다. 그들은 로봇이 얼마나 더 빨리 생각할 수 있는지 확인하기 위해 고성능 컴퓨터와 하이엔드 로봇 연구실에서 흔히 발견되는 특수 하드웨어를 사용했습니다. 결과는 상당한 속도 향상을 보여주었습니다. 표준 고성능 컴퓨터에서 이 새로운 시스템은 로봇이 약 29% 더 빠르게 생각하게 만들었습니다. 로봇 내부에 장착되도록 설계된 더 작고 특화된 컴퓨터에서는 속도 증가가 더욱 극적이었으며, 최대 42%에 달했습니다. 이는 이전에 다음 움직임을 결정하는 데 0.1초 미만의 시간이 걸렸던 로봇이 이제 거의 즉각적으로 결정할 수 있음을 의미하며, 이를 통해 더 부드럽고 유연한 움직임을 가능하게 합니다. 결정적으로, 이 속도는 정확도를 희생하면서 얻은 것이 아니었습니다. 로봇은 실수를 하거나 물체를 떨어뜨리지 않았으며, 이전과 동일한 높은 성공률을 유지하면서 단순히 더 효율적으로 결정에 도달했습니다.

rMuscle의 성공은 로봇이 재사용하려는 데이터 자체에 의해 짐을 지지 않도록 메모리를 관리하는 영리한 방식에 달려 있습니다. 로봇이 가졌던 모든 생각을 저장하는 것은 너무 많은 공간을 필요로 하므로, 시스템은 선택적으로 작동하도록 설계되었습니다. 시스템은 가장 관련 있는 최근의 기억들을 담은 작은 슬라이딩 윈도우(sliding window)를 유지하며, 다시 필요할 가능성이 낮은 오래된 기억들은 폐기합니다. 로봇이 현재 활성 창에 없는 기억을 불러와야 할 때, 시스템은 로봇이 물리적으로 팔을 움직이는 동안 실시간으로 이를 재구성합니다. 이는 로봇이 항상 작업 중임을 의미하며, 움직이는 시간을 사용하여 다시 생각하기 위해 멈출 때를 대비해 다음 생각들을 준비하는 데 사용합니다. 이러한 원활한 통합은 로봇이 자신의 메모리가 따라잡기를 기다려야 하는 상황이 발생하지 않도록 보장합니다.

이 연구의 함의는 단순히 로봇을 더 빠르게 만드는 것을 넘어, 우리가 현실 세계에서 로봇을 배치하는 방식을 변화시킵니다. 로봇이 환경을 처리하는 데 걸리는 시간을 줄임으로써, 이 시스템은 더 반응성 있는 상호작용을 가능하게 합니다. 로봇은 인간이 경로에 들어서거나 컨베이어 벨트에서 부품이 떨어지는 상황에 훨씬 더 빠르게 반응할 수 있어, 사람과 함께 일하기에 더 안전하고 신뢰할 수 있게 됩니다. 연구진은 가구 부품을 움직이는 벨트에 포장하거나 두 팔을 협응하여 섬세한 병을 다루는 것과 같은 복잡한 조립 과업을 수행하는 물리적 로봇을 통해 이를 입증했습니다. 모든 경우에서, 시스템은 로봇의 성공 능력을 유지하면서 각 결정 주기에서 결정적인 밀리초를 단축했습니다.

이 접근 방식은 지능형 기계를 구축하는 방식의 변화를 나타냅니다. 로봇의 근본적인 뇌를 더 강력하거나 복잡하게 만들기보다는, 연구진은 그 뇌가 어떻게 사용되는지에 집중했습니다. 그들은 공장 업무에 필요한 지능이 매초 새로운 퍼즐을 푸는 것이 아니라, 익숙한 문제들에 대한 해결책을 효율적으로 재사용하는 것에 있다는 것을 깨달았습니다. 반복적인 산업 작업의 특성을 존중하고 과업 간의 유사성을 활용하는 시스템을 구축함으로써, 그들은 로봇이 이전에는 도달할 수 없었던 유연함으로 움직일 수 있는 방법을 만들어냈습니다. 이 연구는 효율적인 로보틱스의 미래가 단지 더 나은 하드웨어에 있는 것이 아니라, 정보를 관리하는 더 스마트한 방식, 즉 기계가 과거의 성공을 기억하고 최소한의 노력으로 현재에 적용할 수 있도록 하는 방식에 있다는 것을 시사합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →