← 최신 논문
🤖 AI

MUX: Continuous Reasoning via Multiplexed Tokens

이 논문은 이산적인 추론 단계를 손실 없는 다중화된 잠재 토큰으로 증류함으로써 자연어 표현의 계산적 병목 현상을 극복하고 해석 가능성을 유지하면서 기존 베이스라인을 능가하는, 언어 모델의 효율적이고 고대역폭인 연속적 추론을 가능하게 하는 방법론인 MUX를 소개한다.

원저자: Ayhan Suleymanzade, Halil Alperen Gozeten, Michael Bronstein, żsmail żlkan Ceylan, Jinwoo Kim

게시일 2026-07-22
📖 3 분 읽기☕ 가벼운 읽기

원저자: Ayhan Suleymanzade, Halil Alperen Gozeten, Michael Bronstein, żsmail żlkan Ceylan, Jinwoo Kim

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

컴퓨터가 당신이 묻는 어떤 질문에도 답할 수 있는 믿을 수 없을 정도로 빠르고 똑똑한 사서와 같은 세상이 있다고 상상해 보세요. 하지만 여기 함정이 있습니다. 복잡한 수학 문제나 까다로운 논리 수수께끼와 같은 정말 어려운 퍼즐을 풀기 위해, 이 사서들은 보통 "소리 내어 생각하기"를 해야 합니다. 즉, 최종 답을 내놓기 전에 자신의 사고 과정을 아주 작은 단계 하나하나까지 길고 장황한 문장으로 적어야 한다는 것입니다. 이 방식은 효과적이긴 하지만, 마치 벽돌을 한 번에 하나씩 나르는 것과 같아서 시간이 많이 걸리고 에너지가 많이 듭니다. 왜냐하면 컴퓨터는 한 번에 하나의 "벽돌"(단어의 아주 작은 조각)만 옮길 수 있기 때문입니다. 과학자들은 단순히 컴퓨터를 더 크게 만드는 것이 아니라, 한 번의 압축된 단계 안에 더 많은 정보를 담을 수 있도록 가르침으로써 컴퓨터가 더 빠르고 효율적으로 생각하게 만드는 방법을 끊임없이 연구하고 있습니다. 이것이 바로 핵심적인 질문입니다. 우리가 컴퓨터에게 모든 단어를 일일이 써 내려갈 필요 없이, 속으로 조용하고 빠르게 깊은 생각을 하도록 가르칠 수 있을까요?

여기에 연구자들이 제안한 새로운 방법인 MUX가 등장합니다. MUX는 컴퓨터가 생각하는 방식을 바꿈으로써 이 문제를 해결하고자 합니다. MUX는 컴퓨터에게 길고 장황한 사고의 사슬을 써 내려가게 하는 대신, 여러 단계의 추론을 하나의 보이지 않는 "생각 주머니" 안에 담도록 가르칩니다. 라디오 방송국을 생각해 보세요. 보통 라디오는 한 번에 한 곡의 노래를 재생합니다. 하지만 만약 세 곡의 서로 다른 노래가 완벽하게 섞인 채로 동시에 흘러나오는 주파수를 맞출 수 있고, 특수한 디코더가 나중에 이를 다시 분리해 낼 수 있다면 어떨까요? 그것이 바로 MUX가 하는 일입니다. MUX는 여러 단계의 추론 과정(예: "5 더하기 3은 8")을 하나의 연속적인 신호로 혼합합니다. 컴퓨터는 이 혼합된 신호를 예측하는 법을 배우며, 이 혼합은 매우 특정한 수학적 방식으로 이루어지기 때문에 나중에 원래의 단계들을 완벽하게 복구할 수 있습니다. 이 논문은 이 방식이 컴퓨터로 하여금 하나의 경로를 따라 걷다가 막다른 길에 다다라 처음부터 다시 시작하는 대신, 미로의 여러 경로를 동시에 확인하는 것처럼 동시에 다양한 해결책을 탐색할 수 있게 해준다고 제안합니다.

연구진은 이 "멀티플렉싱(multiplexing)" 기술이 놀라울 정도로 잘 작동한다는 것을 발견했습니다. 그들은 네 가지 서로 다른 컴퓨터 모델과 32가지의 수학적 과제를 대상으로 테스트를 진행했습니다. 결과에 따르면, MUX는 유사한 작업을 수행하려 했던 다른 고급 방법들보다 이 문제들을 해결하는 데 더 뛰어났습니다. 실제로 많은 경우에서 MUX 방식은 컴퓨터에게 소리 내어 생각하도록 가르치는 표준적인 방식보다도 더 우수했으면서도, 정답에 도달하는 데 훨씬 적은 단계만을 사용했습니다. 이 논문은 만약 "생각의 벽돌"을 적절한 가중치(예: 중요도가 서서히 사라지는 특정 패턴)와 함께 섞는다면, 원래의 정보를 결코 잃어버리지 않는다는 것을 수학적으로 증명합니다. 이는 컴퓨터가 생각을 너무 거칠게 압축하려고 할 때 발생하는 게으름이나 혼란을 방지합니다. 나아가, 이 연구는 이 "생각 주머니"가 여러 가능성을 동시에 담을 수 있기 때문에, 컴퓨터가 마치 한 명의 탐험가를 보내는 대신 여러 명의 탐험가 팀을 보내 다양한 경로를 확인하는 것처럼 정답을 찾는 "탐색" 능력이 자연스럽게 향려질 수 있음을 시사합니다.

요약하자면, 이 논문은 컴퓨터에게 생각을 압축 가능하고 복구 가능한 신호로 혼합하도록 가르침으로써, 더 큰 기계를 만들지 않고도 컴퓨터를 더 똑똑하고, 빠르고, 효율적으로 만들 수 있다고 주장합니다. 저자들은 이러한 "손실 없는 혼합(lossless blending)"이라는 단순한 아이디어가 끝없는 장황한 설명에 발이 묶이지 않고 복잡한 문제를 해결할 수 있는 차세대 AI의 핵심 요소라고 제안합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →