← 최신 논문
💬 NLP

Memory for Large Language Models

본 설문 조사는 대규모 언어 모델의 메모리에 대한 체계적이고 아키텍처 중심적인 분류 체계를 제시하며, 표현, 업데이트 역학, 지속성이라는 세 축의 프레임워크를 통해 파편화된 연구들을 통합함으로써 향후 확장 가능하고 적응적인 설계를 안내한다.

원저자: Sining Zhoubian, Dan Zhang, Evgeny Kharlamov, Jie Tang

게시일 2026-07-29
📖 4 분 읽기☕ 가벼운 읽기

원저자: Sining Zhoubian, Dan Zhang, Evgeny Kharlamov, Jie Tang

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 아주 똑똑하지만 잘 까먹는 친구에게 이야기를 쓰는 법을 가르치고 있다고 상상해 보세요. 당신은 그 친구를 자리에 앉히고, 거대한 도서관의 책들을 건네줍니다. 그리고 그 친구는 그 책 전체를 암기합니다. 이것이 바로 오늘날 가장 발전된 컴퓨터 뇌, 즉 대규모 언어 모델(LLM)이 작동하는 방식입니다. 이들은 인터넷에 있는 거의 모든 것을 읽은 초천재 학생들과 같습니다. 하지만 여기 함정이 있습니다. 책을 다 읽고 나면, 그 책을 바로 눈앞에 펼쳐두지 않는 한 세부 사항을 보통 잊어버린다는 점입니다. AI의 세계에서 이 "책상 위에 펼쳐진 책"은 **메모리(기억)**라고 불립니다.

오랫동안 이러한 AI 모델들은 매우 특정한 종류의 메모리를 가지고 있었습니다. 그것은 마치 당신이 보고 있는 동안에만 유지되는 포스트잇과 같았습니다. 만약 당신이 포스트잇이 담을 수 있는 양보다 더 긴 소설을 읽으려고 한다면, AI는 이야기의 중간 지점에 도달할 때쯤이면 이미 앞부분을 잊기 시작할 것입니다. 이것은 "암묵적 메모리(implicit memory)"라고 불렸는데, 이는 AI가 수학적 계산을 수행하는 과정에서 발생하는 부수적인 현상일 뿐, 전용 도구가 아니었습니다. 하지만 최근 과학자들은 큰 질문을 던지기 시작했습니다. "만약 우리가 이 AI 모델들에게 진짜 공책을 준다면 어떨까?" 즉, 중요한 사실을 적어두고, 영구적으로 보관하며, 인간이 하는 것처럼 나중에 다시 찾아볼 수 있는 곳 말입니다. 대화가 끝나면 "모든 것을 잊어버리는 것"에서 "영구적이고 조직화된 뇌를 갖는 것"으로의 이 변화는 현재 컴퓨터 과학계에서 일어나고 있는 거대한 이야기입니다.

이 논문은 그 새로운 세계를 위한 거대한 가이드북입니다. 저자인 연구진들은 모두가 AI에게 메모리를 부여하는 서로 다른 방법들을 발명하고 있지만, 정작 이름과 지도(map)는 제각각이라 혼란스럽다는 점에 주목했습니다. 어떤 이들은 "포스트인"을 만들고 있고, 어떤 이들은 "파일 캐비닛"을 만들며, 심지어 어떤 이들은 AI가 대화하는 동안 자신의 뇌를 스스로 다시 쓰도록 가르치려 합니다. 이 논문의 주요 역할은 이 무질서한 아이디어들을 깔끔하고 체계적인 시스템으로 정리하는 것입니다. 그들은 세 가지 간단한 질문을 통해 AI 메모리를 바라보는 새로운 방식을 제안합니다. 무엇을 저장하는가? 언제 업데이트되는가? 그리고 얼마나 오래 지속되는가?

논문은 우리가 메모리를 단순히 사고 과정의 일시적인 부산물로 여겼던 과거의 방식에서 벗어나, 메모리를 전용의 조절 가능한 도구로 사용하는 새로운 시대로 나아가고 있다고 제안합니다. 그들은 현재 두 가지 주요 유형의 메모리가 있다고 밝힙니다. 첫 번째는 **암묵적 메모리(Implicit Memory)**로, 이는 AI의 단기 작업 기억과 같습니다. 빠르고 유연하지만, 즉각적인 대화에 묶여 있으며 대화가 끝나는 순간 사라집니다. 이것은 AI가 머릿속으로 대화를 나누는 것과 같습니다. 5초 전에 당신이 한 말은 기억할 수 있지만, 당신이 다시 알려주지 않는 한 어제 당신이 한 말은 기억하지 못합니다.

두 번째 유형은 **명시적 메모리(Explicit Memory)**이며, 이것이 바로 흥미로운 새로운 영역입니다. 이것은 AI에게 진짜 공책이나 디지털 하드 드라이브를 주는 것과 같습니다. 이 메모리는 사고 과정과는 분리되어 있습니다. AI는 이 공책에 사실을 적어두고, 대화를 종료한 뒤, 며칠 후에 다시 돌아와 그것을 읽을 수 있습니다. 논문은 연구자들이 이 공책들을 다양한 방식으로 구축하고 있음을 보여줍니다. 어떤 것들은 "매개변수화(parameterized)"되어 있어 AI가 자신의 뇌 가중치에 직접 글을 쓰는 방식이고, 어떤 것들은 "조회 기반(lookup-based)"으로 거대한 사실 데이터베이스를 검색하는 방식이며, 또 어떤 것들은 "전문가 혼합(mixture-of-experts)" 방식으로 특정 주제에 대해 호출할 수 있는 서로 다른 전문가들을 두고 있는 방식입니다.

하지만 논문은 이것이 아직 해결된 문제가 아님을 매우 분명히 하고 있습니다. 이러한 새로운 메모리 시스템은 강력하지만, 커다란 트레이드오프(trade-off, 절충 관계)를 동반합니다. 저자들은 단순히 AI에게 더 큰 공책을 준다고 해서 반드시 더 잘 기억하게 되는 것은 아니라고 지적합니다. 때때로 AI는 너무 많은 정보 때문에 혼란을 겪거나, 잘못된 것을 적어두고는 그것을 지우지 못하기도 합니다. 또한, AI가 대화하는 동안 이 메모리를 업데이트하는 것("온라인" 업데이트)은 위험하고 AI를 불안정하게 만들 수 있는 반면, 학습할 때만 업데이트하는 것("오프라인")은 더 안전하지만 유연성이 떨어진다는 점도 언급합니다.

이 논문은 우리가 완벽한 인간형 뇌를 구축했다고 주장하는 것이 아닙니다. 대신, 우리는 AI가 정보를 어떻게 저장하고 사용할지에 대한 최선의 규칙을 찾아가는 혼란스럽고 실험적인 단계에 있다고 제안합니다. 저자들은 미래가 단 하나의 메모리 유형을 선택하는 것이 아니라, 하이브리드 시스템을 구축하는 것이라고 주장합니다. 현재의 대화를 위한 빠른 포스트잇, 장기적인 사실을 위한 개인 공책, 그리고 인터넷을 검색하기 위한 도서관 대출 카드가 모두 함께 작동하는 모델을 상상해 보세요. 저자들은 결론적으로, AI를 진정으로 똑똑하고 유용하게 만들기 위해서는 메모리를 우연한 사고로 취급하는 것을 멈추고, 얼마나 많이 기억할지, 얼마나 빨리 업데이트할지, 그리고 얼마나 오래 유지할지를 정교하게 균형 잡힌 핵심 기능으로 설계해야 한다고 말합니다. 이것은 잘 까먹는 천재를 진정으로 지혜로운 동반자로 바꾸기 위한 로드맵입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →