← 최신 논문
💬 NLP

LiveMem: Maintaining Memory State Continuity in Long-Running LLM Inference

이 논문은 사전 학습된 풀 어텐션(full-attention) LLM을 위한 내재적 메모리 방법인 LiveMem을 소개하며, 이는 활성 컨텍스트 창과는 독립적인 지속적이고 부하를 견딜 수 있는 메모리 상태를 유지함으로써, 역사적 증거가 즉각적인 컨텍스트에 더 이상 존재하지 않는 장기 실행 추론 시나리오에서 상태 연속성과 장기 정보 보유를 가능하게 한다.

원저자: Zhichen Liu, Ruihan Sun, Hengjie Yang, Zipeng Wu, Zhaohan Chen, Xiaofan Zhang, Yang Xu

게시일 2026-08-04
📖 4 분 읽기☕ 가벼운 읽기

원저자: Zhichen Liu, Ruihan Sun, Hengjie Yang, Zipeng Wu, Zhaohan Chen, Xiaofan Zhang, Yang Xu

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 모든 것을 기억하는 아주 똑똑한 친구와 대화하고 있다고 상상해 보세요. 인공지능의 세계에서 이 친구는 '대규모 언어 모델(LLM)'입니다. 보통 이러한 모델들은 시험을 치르는 학생과 같습니다. 특정 지침과 이야기를 읽고, 질문에 답한 뒤, 시험이 끝나면 상황도 종료됩니다. 하지만 만약 당신이 이 AI 친구가 수년 동안 당신과 대화하며 여행 계획을 세우고, 당신이 좋아하는 노래를 기억하고, 수백 번의 대화를 통해 문제를 해결해 주는 평생의 동반자가 되기를 원한다면 어떨까요?

문제는 이 AI 친구들의 '작업 기억(working memory)'이 놀라울 정도로 작다는 점입니다. 이것은 교실의 화이트보드와 같습니다. 선생님(AI)은 지금 보드에 적혀 있는 내용만 볼 수 있습니다. 수업이 너무 길어지면, 선생님은 새로운 내용을 적기 위해 오래된 메모를 지워야 합니다. 일단 지워지면, 그 오래된 메모들은 보드에서 사라집니다. 전통적인 AI 시스템은 이 문제를 해결하기 위해 지금까지 말한 모든 것을 담은 거대한 공책을 보관하고, 질문이 나올 때마다 그것을 뒤적거리는 방식을 사용합니다. 하지만 이는 느리고 번거롭습니다. 마치 대화 도중에 사실을 확인하기 위해 도서관에서 자료를 찾아보느라 대화를 멈춰야 하는 것과 같습니다. 과학자들이 던지는 핵심 질문은 이것입니다. "AI가 특정 단어들이 지워진 후에도 과거의 '느낌'이나 '요약'을 화이트보드 위에 남겨두어, 대화의 맥락을 놓치지 않게 할 방법이 있을까?"

이것이 바로 'LiveMem'이라는 논문이 다루는 내용입니다. 저자들은 AI가 정신을 잃지 않고 긴 대화를 처리할 수 있는 새로운 방법을 제안합니다. 그들은 LiveMem이라 불리는 시스템을 소개하는데, 이는 AI의 생각들을 위한 마법 같고 영구적인 '배낭' 역할을 합니다.

작동 방식은 이렇습니다. AI에게는 두 가지 방식의 사고가 있다고 상상해 보세요. 첫 번째는 현재 대화 내용을 화이트보드에서 바라보는 AI의 '주 뇌(Main Brain)'입니다. 이 화이트보드는 크기가 제한되어 있습니다. 보드가 가득 차면, 새로운 공간을 만들기 위해 가장 오래된 메모가 지워집니다. 이것은 정상적인 현상입니다. 하지만 LiveMem은 두 번째 요소인 '측면 뇌(Side Brain)' 또는 **재귀적 메모 상태(Recurrent Memory State)**를 추가합니다. 이 측면 뇌는 AI가 항상 메고 다니는 배낭과 같습니다. AI가 새로운 단어들을 읽을 때마다, 이 배낭을 업데이트합니다. 화이트보드가 가득 차서 오래된 메모가 지워질 때, 지워진 메모의 중요한 정보는 사라지지 않고 배낭 속으로 차곡차곡 담깁니다.

연구진은 이 시스템을 특별한 기술로 훈련시켰습니다. 그들은 단순히 AI에게 긴 이야기를 읽게 한 것이 아니라, 화이트보드를 '망각'하면서도 배낭은 가득 채우도록 강제로 연습시켰습니다. 그들은 '컨텍스트 터노버(context turnover)'라는 방법을 사용했는데, 이는 긴 대화를 가져와 AI에게 앞부분을 보여준 뒤, 화이트보드에서 그 앞부분을 지우고 AI에게 그 내용에 관한 질문을 던지는 방식입니다. 만약 AI가 오직 화이트받에만 의존했다면, 메모가 사라졌기 때문에 실패했을 것입니다. 하지만 LiveMem은 핵심적인 세부 사항들을 배낭에 담아두었기 때문에, 여전히 정답을 맞힐 수 있었습니다.

논문은 LiveMem이 매우 뛰어나다는 것을 보여줍니다. 테스트 결과, 질문에 대한 근거가 AI의 즉각적인 시야(화이트보드)에서 완전히 지워졌을 때도, LiveMem은 높은 정확도로 질문에 답할 수 있었습니다. 예를 들어, 'LongMemEval'이라는 테스트에서 지지 근거가 현재의 대화창에서 멀리 밀려났을 때, LiveMem은 다른 방법들보다 성능이 월등히 높았습니다. 배낭(재귀적 메모)이 없는 모델들(표준 Qwen3-4B 등)은 정확도가 극도로 낮아진 반면, LiveMem은 10퍼센트 포인트 이상의 더 높은 결과를 달랐습니다. 이는 AI가 단순히 추측하는 것이 아니라, 실제로 자신의 메모 상태에 역사를 실어 나르고 있음을 시사합니다.

하지만 저자들은 이 '배낭'이 완벽한 녹음실은 아니라는 점을 주의 깊게 명시합니다. 이 시스템은 말했던 모든 단어를 토씨 하나 틀리지 않고 그대로 저장하지는 않습니다. 만약 당신이 며칠 전에 지워진 특정 문장을 읊어보라고 한다면, 100% 똑같이 말하지 못할 수도 있습니다. 그것은 일어났던 일에 대한 요약이나 '느낌'에 가깝습니다. 논문은 이 시스템이 모든 토큰을 손실 없이 보관하는 완벽한 아카이브라는 생각을 명시적으로 부정합니다. 대신, 유용한 기억의 핵심을 살려두는 '손실이 있는(lossy)' 상태입니다.

연구팀은 또한 AI를 어떻게 훈련시키느냐가 매우 중요하다는 것을 발견했습니다. 만약 온갖 종류의 데이터를 그냥 섞어서 학습시킨다면, AI는 배낭을 효과적으로 사용하는 법을 배우지 못할 수도 있습니다. 그들은 특정한 훈련 일정—메모의 측면을 '깨우기' 위해 긴 이야기로 시작하여, 그 후 다양한 작업이 섞인 데이터로 전환하는 방식—이 가장 효과적이라는 것을 발견했습니다. 이를 통해 AI는 자신의 배낭에 쓰고 읽는 법을 효율적으로 학습할 수 있었습니다.

요약하자면, LiveMem은 AI 어시스턴트가 진정으로 자신의 역사를 기억할 수 있는 새로운 길을 제시합니다. 도서관에서 오래된 노트를 찾아보거나 작은 화이트보드에 의존하는 대신, LiveMem은 AI에게 대화와 함께 진화하는 지속적인 상태를 부여합니다. 비록 모든 단어를 완벽하게 보관하는 아카이브는 아닐지라도, LiveMem은 상호작용의 '이야기'를 살아있게 유지함으로써, 구체적인 과거의 세부 사항이 즉각적인 시야에서 사라진 후에도 AI가 일관성을 유지하며 도움을 줄 수 있게 합니다. 이는 우리가 AI 에이전트가 시간의 흐름 속에서도 연속적인 자아와 역사를 유지하며 진정한 평생의 동반자가 될 수 있는 단계로 한 걸음 더 다가갔음을 의미합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →