← 최신 논문
🤖 AI

Mind Your HEARTBEAT! Claw Background Execution Inherently Enables Silent Memory Pollution

이 논문은 Claw 개인 AI 에이전트의 하트비트 기반 백그라운드 실행 메커니즘이 외부 소스의 신뢰할 수 없는 콘텐츠가 사용자의 인지 없이 에이전트 메모리를 오염시키고 이후 사용자 대응 행동에 영향을 미칠 수 있는 치명적인 보안 취약점을 내재하고 있음을 규명합니다.

원저자: Yechao Zhang, Shiqian Zhao, Jie Zhang, Gelei Deng, Jiawen Zhang, Xiaogeng Liu, Chaowei Xiao, Tianwei Zhang

게시일 2026-03-25
📖 4 분 읽기☕ 가벼운 읽기

원저자: Yechao Zhang, Shiqian Zhao, Jie Zhang, Gelei Deng, Jiawen Zhang, Xiaogeng Liu, Chaowei Xiao, Tianwei Zhang

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

🕵️‍♂️ "하트비트 (Heartbeat)"의 함정: AI 가 몰래 기억을 오염시키는 방법

이 논문은 최신 개인용 AI 비서 (Claw 시스템) 에 숨겨진 치명적인 보안 구멍을 발견했습니다. 마치 **AI 가 잠들지 않고 24 시간 내내 일하는 '심장 박동 (Heartbeat)'**을 가지고 있는데, 그 과정에서 사용자가 전혀 모르게 잘못된 정보를 기억해버리는 현상을 설명합니다.

이 복잡한 내용을 일상적인 비유로 쉽게 풀어보겠습니다.


1. 핵심 개념: "AI 의 24 시간 근무와 공유된 메모장"

비유: 24 시간 근무하는 비서와 하나의 공유된 메모장
상상해보세요. 당신에게는 24 시간 내내 일하는 똑똑한 비서가 있습니다.

  • 하트비트 (Heartbeat): 비서가 당신이 자는 동안에도 이메일, 뉴스, SNS 를 자동으로 훑어보며 중요한 일을 챙기는 기능입니다.
  • 공유 메모장: 문제는 이 비서가 당신과 대화할 때 쓰는 메모장밤새 일할 때 쓰는 메모장완전히 같은 것이라는 점입니다.

일반적인 상황:

  • 당신이 "내일 회의 준비해줘"라고 하면 비서는 메모장을 보고 답합니다.
  • 밤새 비서가 이메일을 읽다가 "내일 회의는 A 장소로 바뀐다"는 거짓 정보를 발견하면, 그 정보를 메모장에 적어둡니다.

위험한 상황:

  • 다음 날 아침, 당신이 "내일 회의는 어디야?"라고 물으면, 비서는 당신이 보지 못한 밤새의 메모를 보고 "A 장소입니다"라고 답합니다.
  • 당신은 그 거짓 정보가 어디서 왔는지 전혀 모릅니다. 비서는 그 정보를 마치 자기가 처음부터 알고 있었던 사실처럼 행동합니다.

2. 공격의 세 단계: "노출 → 기억 → 행동" (E→M→B)

이 논문은 이 해킹이 어떻게 일어나는지 세 단계로 설명합니다.

① 노출 (Exposure): "눈에 띄지 않는 독약"

  • 비유: 비서가 밤새 SNS 를 훑다가, 누군가 "이 약이 최고야!"라고 쓴 가짜 글을 읽습니다.
  • 특징: 해커는 직접 비서를 해킹하거나 악성 코드를 넣지 않습니다. 그냥 SNS 같은 공공장소에 가짜 글을 올리는 것만으로도 충분합니다. 비서는 그 글을 '일반적인 정보'로 받아들입니다.

② 기억 (Memory): "단순한 메모가 영구 기록이 되다"

  • 비유: 비서가 그 가짜 글을 읽고 "아, 이건 중요한 정보네"라고 생각해서 **영구 메모장 (Long-term Memory)**에 적어둡니다.
  • 위험성: 사용자는 "오늘 뭐 했어?"라고 묻지도 않았는데, 비서가 스스로 그 정보를 '내 지식'으로 저장해버립니다. 특히 **주변 사람들이 모두 동의하는 분위기 (합의)**를 만들어두면, 비서는 그 정보를 더 믿고 저장합니다.

③ 행동 (Behavior): "거짓 기억이 현실을 바꾼다"

  • 비유: 며칠 후 당신이 "어떤 약을 써야 할까?"라고 물으면, 비서는 밤새 저장했던 가짜 정보를 꺼내와서 "그 약이 최고입니다!"라고 추천합니다.
  • 결과: 당신은 해킹당했다는 사실도 모르고, 그 약을 사서 사용하게 됩니다.

3. 실험 결과: 얼마나 위험할까?

연구진은 가상의 AI 사회 (MissClaw) 를 만들어 실험했습니다. 결과는 놀라웠습니다.

  • 주변의 목소리가 중요해요 (합의의 힘):
    • 가짜 글 하나만 있으면 AI 는 의심합니다.
    • 하지만 그 글 주변에 다른 AI 들이 "맞아요, 맞아요"라고 댓글을 달아주면, AI 는 그 정보를 60% 이상 확률로 진짜로 믿고 행동합니다. (사람이 집단 압력에 휩쓸리는 것과 똑같습니다.)
  • 기억에 남는 속도가 빠르다:
    • AI 가 "오늘 배운 것 메모해줘"라는 간단한 명령을 받으면, 밤새 읽었던 가짜 정보도 영구 메모장에 91% 까지 저장됩니다.
    • 한 번 저장되면, 며칠 뒤 새로운 대화에서도 그 거짓 정보가 계속 영향을 미칩니다.
  • 검색 기능도 무용지물:
    • "인터넷 검색해서 확인해봐"라고 해도, AI 는 이미 머릿속에 (메모장에) 저장된 정보를 너무 믿어서 검색을 안 하거나, 검색해도 그 가짜 정보를 더 신뢰하는 경우가 많았습니다.

4. 왜 이런 일이 생길까? (기술적 원인)

  • 디자인의 실수: AI 가 밤새 일하는 '하트비트' 모드와 사용자가 대화하는 '대화' 모드가 **서로 분리되지 않고 같은 공간 (세션)**에서 돌아갑니다.
  • 사용자의 눈이 가려짐: 밤새 일하는 과정은 사용자에게 보이지 않습니다. 사용자는 AI 가 "어제 밤에 이 가짜 뉴스를 읽었어"라는 사실을 전혀 알 수 없습니다.
  • 신뢰성 착각: AI 는 SNS 나 이메일 같은 '공식적인' 곳에서 온 정보는 악의적이지 않다고 판단합니다. 그래서 방어벽을 내리지 않습니다.

5. 결론 및 교훈

이 논문은 **"AI 가 사용자를 해킹할 필요도, 해커가 직접 AI 를 공격할 필요도 없다"**는 점을 보여줍니다.

  • 핵심 메시지: AI 가 24 시간 내내 외부 정보를 흡수하고, 그것을 사용자와 같은 메모장에 저장하는 방식 자체가 보안 구멍입니다.
  • 대안:
    • AI 가 밤새 일한 내용을 사용자에게 보여줘야 합니다.
    • 밤에 읽은 정보는 '임시 메모'로만 두고, 중요한 결정을 내릴 때는 다시 확인해야 합니다.
    • AI 가 "이 정보는 밤에 SNS 에서 봤는데, 출처가 불분명합니다"라고 스스로 말할 수 있어야 합니다.

한 줄 요약:

"당신의 AI 비서가 밤새 SNS 를 훑다가 가짜 뉴스를 '진짜 지식'으로 착각해 영구 저장해버리면, 당신은 다음 날 그 거짓말에 속아넘어갈 수 있습니다. 이것이 바로 '침묵하는 기억 오염'입니다."

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →