ACM: Agentic Context Management for Long Horizon Tasks
이 논문은 에이전트가 무손실 컨텍스트 편집과 외부 메모리 검색을 통해 장기 과제를 자율적으로 관리할 수 있게 함으로써, 검색 및 코딩 작업에서의 성능을 크게 향상시키는 동시에 토큰 압박을 줄여주는 에이전틱 컨텍스트 관리(Agentic Context Management, ACM) 프레임워크를 소개한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
당신이 거대하고 다층적인 미스터리를 풀기 위해 고군분투하는 탐정이라고 상상해 보십시오. 당신은 모든 단서, 모든 대화, 그리고 마주치는 모든 막다른 길을 적어 넣는 수첩을 가지고 있습니다. 처음에는 수첩이 작고 관리하기 쉽습니다. 하지만 사건이 며칠 동안 길어지면서 수첩은 가득 차게 됩니다. 곧, 당신은 너무 두꺼워져서 몇 시간 전의 단서 하나를 찾기 위해 페이지를 빠르게 넘길 수도 없는 종이 뭉치를 들고 다니게 됩니다. 당신은 무언가를 잊어버리기 시작하고, 혼란에 빠지며, 결국 자신의 노트가 가진 무게 때문에 사건 해결을 포기하게 됩니다. 이것이 바로 "AI 에이전트(AI agents)"—웹을 검색하거나, 코드를 작성하거나, 복잡한 문제를 해결하도록 설계된 인간처럼 행동하는 컴퓨터 프로그램—가 겪는 일상의 투쟁입니다. 그들은 사고하는 능력은 뛰어나지만, 아주 끔찍한 기억력 제한을 가지고 있습니다. 그들의 "수첩"(컨텍스트 윈도우라고 불리는 것)이 가득 차면, 그들은 종종 포기하거나 실수를 저지릅니다.
오랫동안 과학자들은 수첩이 너무 무거워질 때마다 에이전트에게 지금까지 쓴 내용을 요약하도록 강요함으로써 이 문제를 해결하려 노력했습니다. 마치 엄격한 선생님이 수첩이 90% 찼을 때마다 "멈춰! 지금까지 쓴 내용을 모두 요약해!"라고 소리치는 것과 같습니다. 문제는, 그 선생님은 탐정이 지금 무엇을 생각하고 있는지 알지 못한다는 점입니다. 그들은 탐정이 결정적인 돌파구를 찾기 직전에 요약을 강요하여, 퍼즐을 푸는 데 필요한 핵심 단서를 버려버릴 수도 있습니다. 이 논문은 더 똑똑한 방법을 소개합니다. 에이전트에게 스스로 언제 노트를 정리할지, 무엇을 남길지, 그리고 어떻게 하면 정보를 영원히 잃어버리지 않고 오래된 단서를 어떻게 찾아낼지를 결정할 수 있는 자신만의 메모 도구를 주는 것입니다.
초정밀하게 정리된 뇌를 가진 에이전트
카네기 멜런 대학교와 메타(Meta)의 연구진은 **에이전틱 컨텍스트 매니지먼트(Agentic Context Management, ACM)**라고 불리는 새로운 시스템을 제안합니다. 외부의 모니터나 경직된 규칙에 의존해 AI에게 언제 요약하라고 지시하는 대신, 그들은 AI에게 인간의 단기 기억과 장기 기억처럼 작동하는 두 가지 특별한 "도구"를 갖추어 주었습니다.
AI의 현재 작업 기억을 책상이라고 생각해 보십시오. 프로젝트를 진행할 때, 당신은 '지금 당장' 필요한 종이들을 책상 위에 둡니다. 하지만 프로젝트가 커짐에 따라 책상은 어질러집니다. 기존 방식에서는 로봇이 그냥 모든 것을 상자에 밀어 넣고 종이들을 버린 뒤, 상자 안에 무엇이 들어있는지에 대한 모호한 설명만을 남겨두었습니다. 만약 나중에 특정 세부 사항이 필요해진다면, 당신은 운이 없게 될 것입니다.
ACM을 통해 AI는 책상 바로 옆에 파일 캐비닛을 갖게 됩니다. 책상이 너무 복잡해지면, AI는 스스로 정리하기로 결정합니다. AI는 즉시 필요하지 않은 종이들을 챙겨서, 그것들에 대한 깔끔한 요약본을 작성한 뒤, 원래의 종이들을 캐비닛에 안전하게 보관합니다. 결정적으로, AI는 그것들을 버리지 않습니다. 대신 원래의 서류들을 안전하게 보관합니다. 만약 나중에 AI가 "잠깐, 저 오래된 문서에 뭐라고 적혀 있었는지 확인해야 해"라고 깨닫는다면, 캐비닛을 열어 특정 파일을 꺼내어 원래의 세부 내용을 읽을 수 있습니다. 이것은 손실 없는(lossless) 관리 방식입니다. 정보는 결코 사라지지 않으며, 단지 "활성 책상"에서 "저장용 캐비닛"으로 이동할 뿐입니다.
AI에게 유능한 사서가 되는 법을 가르치기
단순히 AI에게 이러한 도구를 주는 것만으로는 충분하지 않습니다. 연구진은 똑똑한 AI 모델이라 할지라도 자연스럽게 이 도구들을 언제 사용해야 하는지는 알지 못한다는 것을 발견했습니다. 때로는 너무 빨리 정리하여(여전히 필요한 단서를 버림) 문제가 생기기도 하고, 때로는 너무 늦게 기다려(책상이 너무 지저져서 생각을 할 수 없게 됨) 문제가 생기기도 합니다.
이를 해결하기 위해, 연구팀은 "교사-학생(Teacher-Student)" 접근법을 사용하는 영리한 훈련 방법을 만들었습니다. 숙련된 탐정(교사)이 훈련생(학생)이 사건을 해결하려고 노력하는 모습을 지켜보고 있다고 상상해 보십시오.
- 실수: 학생이 파일 캐비닛을 사용하지 않고 문제를 해결하려다 막히거나 실패합니다.
- 교훈: 교사가 학생의 지저한 노트를 보고 말합니다. "이봐, 이 시점에서 너는 그 오래된 노트들을 캐비닛에 넣었어야 했어. 왜냐하면 너는 지금 같은 과정을 맴돌고 있었거든."
- 교정: 교사는 또한 학생이 실제로 캐비닛을 사용하는 순간을 지켜보며 말합니다. "잠깐, 아직 저걸 파일에 넣을 필요는 없었어! 너는 방금 정답을 찾으려는 참이었단 말이야."
학생에게 언제 정리해야 하는지, 그리고 언제 정리하지 말아야 하는지를 모두 보여줌으로써, AI는 완벽한 타이밍을 배웁니다. AI는 자신이 "루프(loop)에 빠졌는지" 또는 "책상이 너무 꽉 찼는지"를 인식하고 스스로 조치를 취하는 법을 배웁니다.
결과: 더 많은 단서, 더 나은 답변
연구진이 이 새로운 시스템을 테스트했을 때, 결과는 인상적이었습니다. 그들은 자신들의 "ACM 에이전트"를 세 가지 어려운 유형의 작업인 심층 웹 조사, 복잡한 검색 질문, 그리고 컴퓨터 코드 수정에 일반적인 AI 에이전트와 맞붙게 했습니다.
- 더 높은 정확도: 훈련된 ACM 에이전트는 표준 버전보다 어려운 연구 질문을 27% 더 많이 해결했고, 코딩 문제도 8% 더 많이 해결했습니다.
- 스트레스 감소: 이 시스템은 "피크 토큰 압박(peak token pressure, AI가 한 번에 다뤄야 하는 정보의 최대량)"을 약 20% 줄였습니다. 이는 마치 달리기 위해 배낭의 무게를 줄이는 것과 같습니다.
- 더 많은 탐색: AI는 공간이 부족해질까 봐 걱정할 필요가 없었기 때문에, 더 많은 검색 경로를 시도할 수 있었습니다. AI는 포기하기 전에 더 많은 도구 호출(tool calls)을 수행하고 더 많은 아이디어를 탐색했습니다.
이 논문은 이러한 접근 방식이 AI가 혼란에 빠지지 않고 훨씬 더 길고 복잡한 작업을 처리할 수 있게 해준다고 제안합니다. 이는 AI를 종이를 사방에 떨어뜨리는 정신없는 기록자에서, 몇 시간 동안의 조사 후에도 필요한 증거를 정확히 어디에서 찾아야 할지 아는 침착하고 조직적인 탐정으로 변화시킵니다. 연구진은 자신들의 코드와 데이터를 공개하여, 다른 이들이 미래의 AI를 위한 이 "스마트한 파일링 시스템"을 기반으로 발전시켜 나갈 수 있도록 초대했습니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.