← 최신 논문
🤖 AI

Beyond Memory: A Transactional Continuity Kernel for Long-Lived AI Agents

본 논문은 신뢰할 수 없는 상태 제안과 원자적 활성화를 분리함으로써 오래 지속되는 AI 에이전트의 안전하고 권한 있는 진화를 보장하고, 상태 변화의 끊김 없고 감사 가능한 계보를 보장하는 형식 검증된 프로토콜을 통해 오래된 덮어쓰기와 권한 상승을 방지하는 트랜잭션 제어 평면인 연속성 커널(Continuity Kernel, CK)을 소개한다.

원저자: Jun He, Deying Yu

게시일 2026-08-13
📖 4 분 읽기☕ 가벼운 읽기

원저자: Jun He, Deying Yu

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

거대한 기억의 혼돈: 왜 AI 에이전트에게는 가드(Bouncer)가 필요한가

당신이 가장 좋아하는 비디오 게임 캐릭터가 단순히 지난 5분간의 퀘스트를 기억하는 것을 넘어, 지금까지 싸워온 모든 몬스터, 구매한 모든 아이템, 그리고 알아낸 모든 비밀을 완벽한 일기로 기록한다고 상상해 보십시오. 이것이 바로 "장수하는 AI 에이전트(long-lived AI agents)"의 꿈입니다. 이들은 실제 사람처럼 학습하고 성장하며 수년간 머무르는 똑똑한 컴퓨터 프로그램입니다. 하지만 여기에 문제가 있습니다. 만약 그 캐릭터의 일기가 서로 다른 작성자들에 의해 동시에 쓰인 천 가지 버전으로 존재한다면, 어떤 것이 진짜 이야기일까요?

컴퓨터 과학의 세계에서 이것은 **저장(storage)**과 **권위(authority)**의 차이입니다. 저장은 모든 초안, 메모, 실수를 보관할 수 있는 거대한 창고에 불과합니다. 권위는 어떤 버전이 모두가 따르기로 합의한 공식적인 것인지 결정하는 것입니다. 엄격한 규칙이 없다면, AI 에이전트는 실수로 자신의 기억을 가짜 기억으로 덮어쓰거나, 결함이 있는 도구가 에이전트에게 실제로 가지고 있지 않은 초능력이 있다고 설득할 수도 있습니다. 이는 마치 혼란스러운 그룹 프로젝트와 같아서, 모두가 같은 구글 문서를 계속 편집하고 있지만 정작 누가 최종 결정권을 가졌는지는 아무도 모르는 상황과 같습니다. 이 논문은 그 혼돈을 다루며, 다음과 같은 단순하지만 매우 중요한 질문을 던집니다. "문제가 발생하더라도 AI의 '공식' 역사가 항상 진실되고, 안전하며, 끊김 없이 유지되도록 하는 시스템을 어떻게 구축할 것인가?"

컨티뉴이티 커널(Continuity Kernel): AI의 궁극적인 가드

연구자 Jun He와 Deying Yu가 고안한 **컨티뉴이티 커널(Continuity Kernel, CK)**을 소개합니다. AI 에이전트의 기억을 단 하나의 공책이 아니라, 가능성으로 뻗어 나가는 거대한 분기형 나무라고 생각하십시오. AI가 새로운 것을 배우거나, 도구가 설정을 업데이트하거나, 인간이 명령을 내릴 때마다 새로운 가지가 돋아납니다. 문제는 가드가 없다면 누구나(혹은 결함이 있는 로봇이라도) 나무 속으로 몰래 들어와 "내가 새로운 공식 줄기다!"라고 선언할 수 있다는 점입니다. 컨티뉴이티 커널은 바로 그 가드 역할을 합니다. 커널은 이야기를 쓰는 것이 아니라, 어떤 이야기가 공식적인 것이 될지를 결정합니다.

저자들은 안전을 유지하기 위해 영리한 2단계 댄스를 제안합니다. 먼저, AI의 "신뢰할 수 없는(untrusted)" 부분들(창의적인 언어 모델이나 웹 검색 도구 등)이 모든 힘든 일을 수행합니다. 이들은 증거를 수집하고, 새로운 기억의 초안을 작성한 뒤, 이를 하나의 패키지로 봉인합니다. 이 과정은 커밋 전(off-commit) 단계에서 일어나는데, 즉 이것은 아직 사실이 아니라 하나의 '제안'일 뿐이라는 뜻입니다. 그 다음, 컨티뉴이티 커널이 개입합니다. 커널은 엄격하고 결정론적인 판사 역할을 합니다. 커널은 AI의 창의적인 아이디어에는 관심이 없으며, 오직 규칙에만 집중합니다. 커널은 다음과 같은 사항을 확인합니다. "이 제안이 적절한 사람으로부터 왔는가? 이전 기억 버전이 우리가 예상했던 것과 정확히 일치하는가? 증거가 제때 도착했는가?"

만약 제안이 모든 테스트를 통과하면, 커널은 "커밋(Commit)"을 수행합니다. 이는 새로운 기억이 즉시 공식 역사가 되고 기존 버전이 잠기는 마법 같은 순간입니다. 만약 실패한다면, 제안은 거부되거나 격리되거나 보류됩니다. 이 논문은 이러한 분리가 필수적이라고 주장합니다. AI가 스스로의 업그레이드를 승인하게 해서는 안 되는데, 이는 은행원이 자신에게 백만 달러 인출을 승인하는 것과 같기 때문입니다. 커널은 검증되고 사전 승인된 변경만이 '가지의 머리(branch head)', 즉 AI 현실의 유일하고 진실한 버전이 될 수 있도록 보장합니다.

게임의 규칙

이것이 작동하게 만들기 위해, 저자들은 "활성화 계약(activation contract)"이라 불리는 엄격한 규칙 세트를 설계했습니다. 모든 움직임이 효력을 갖기 전에 반드시 심판의 검증을 거쳐야 하는 고도의 심리전이 펼쳐지는 체스를 상상해 보십시오. 커널은 모든 제안에 대해 17가지의 서로 다른 단계를 체크합니다. "작성자의 ID가 변경되었는가?", "기억이 신선한가?", 혹은 "누군가 가짜 허가증을 몰래 들여오려 했는가?"와 같은 사항들을 살핍니다.

이 논문은 단순히 데이터를 하드 드라이브에 저장하는 것만으로는 그것이 진실임을 보장할 수 없다는 점을 명시적으로 배제합니다. 데이터가 저장소에 존재한다고 해서 AI가 그것을 믿어야 한다는 뜻은 아닙니다. 또한 저자들은 AI 모델이 스스로를 승인하게 하는 것에 반대합니다. 이 시스템에서 모델은 변경을 제안할 수는 있지만, 자신의 허가증에 직접 서명할 수는 없습니다. 커널만이 "예"라고 말할 수 있는 유일한 존재입니다.

연구진은 이 아이디어를 실제 물리적 몸체를 가진 AI가 아닌 컴퓨터 시뮬레이션을 통해 테스트했습니다. 그들은 커널의 디지털 모델을 구축하고, AI가 규칙을 우회하려고 시도하거나, 데이터가 누락되거나, 두 사람이 동시에 기억을 업데이트하려고 하는 상황을 포함하여 280만 개 이상의 다양한 시나리오를 실행했습니다. 550만 개의 상태 변경 동작이 일어나는 동안, 커밀은 끝까지 라인을 지켰습니다. 커널은 단 한 건의 규칙 위반도 발견하지 못했습니다. 커널은 셀프 승인 트릭을 성공적으로 차단했고, 중복 업데이트를 방지했으며, 오직 하나의 진실만이 나무의 꼭대기에 존재할 수 있도록 보장했습니다.

결론: 안전한 길을 향하여

컨티뉴이티 커널이 AI의 모든 문제를 해결해 주는 것은 아닙니다. 이 시스템은 AI를 더 똑똑하게 만들지도 못하며, 고장 난 로봇 팔이나 나쁜 인터넷 연결을 고칠 수도 없습니다. 또한 AI가 세상에 대해 항상 옳을 것이라고 약속하지도 않습니다. 단지 AI의 기억이 일관성을 유지하고, 아무도 몰래 역사를 다시 쓸 수 없음을 보장할 뿐입니다. 저자들은 자신들의 시뮬레이션이 매우 철저하긴 하지만, 여전히 시뮬레이션일 뿐이라는 점을 주의 깊게 언급합니다. 실제 컴퓨터는 충돌할 수 있고, 저장 시스템은 모델이 예측하지 못한 방식으로 실패할 수도 있기 때문입니다.

그럼에도 불구하고, 이 논문은 AI 안전성에 대한 강력하고 새로운 사고방식을 제공합니다. AI를 완벽하게 만들려고 애쓰는 대신, 우리는 AI의 역사가 항상 깨끗하고, 승인되었으며, 끊김 없이 유지되도록 보장하는 "가드"를 구축할 수 있습니다. 제안을 만드는 번거롭고 창의적인 작업과 그것을 검증하는 엄격하고 지루한 작업을 분리함으로써, 컨티뉴이티 커널은 AI 에이전트가 천 년이 지난 후에도 자신의 정체성을 기억할 수 있도록 돕는 청사진을 제공합니다. 이는 AI가 스스로가 누구인지 기억할 수 있다는 신뢰를 쌓기 위한 작지만 필수적인 발걸음입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →