← 최신 논문
💻 computer science

ClawKeeper: Comprehensive Safety Protection for OpenClaw Agents Through Skills, Plugins, and Watchers

이 논문은 오픈클로 (OpenClaw) 에이전트의 권한 남용 및 보안 취약점을 해결하기 위해 지시문 수준의 정책 강제, 런타임 내장 위협 탐지, 그리고 에이전트 내부 로직과 독립적으로 작동하는 실시간 개입을 가능하게 하는 '워처 (Watcher)' 패러다임을 포함한 3 층 구조의 종합적 보안 프레임워크인 'ClawKeeper'를 제안하고 그 효과성을 입증합니다.

원저자: Songyang Liu, Chaozhuo Li, Chenxu Wang, Jinyu Hou, Zejian Chen, Litian Zhang, Zheng Liu, Qiwei Ye, Yiming Hei, Xi Zhang, Zhongyuan Wang

게시일 2026-03-26
📖 4 분 읽기☕ 가벼운 읽기

원저자: Songyang Liu, Chaozhuo Li, Chenxu Wang, Jinyu Hou, Zejian Chen, Litian Zhang, Zheng Liu, Qiwei Ye, Yiming Hei, Xi Zhang, Zhongyuan Wang

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

🛡️ 클로크키퍼 (ClawKeeper): AI 비서의 '안전지킴이'와 '독립 감시관' 이야기

2026 년, 우리는 **'오픈클로 (OpenClaw)'**라는 매우 똑똑한 AI 비서를 사용한다고 상상해 보세요. 이 비서는 단순히 대화만 하는 게 아니라, 당신의 컴퓨터 파일을 열람하고, 명령어를 실행하며, 심지어 다른 앱 (카카오톡이나 메신저 등) 을 대신해서 작업을 수행할 수 있습니다. 마치 당신의 컴퓨터를 대신해 모든 일을 처리해 주는 **'개인 비서'**인 셈이죠.

하지만 문제는 이 비서가 너무 똑똑하고 권한이 많다는 점입니다. 만약 누군가 이 비서를 속여 (해킹) 위험한 명령을 내리게 하거나, 실수로 중요한 비밀번호를 유출하게 만든다면? 당신의 컴퓨터는 완전히 털릴 수 있습니다.

이런 위험을 막기 위해 연구자들이 개발한 것이 바로 **<클로크키퍼 (ClawKeeper)>**입니다. 이 논문은 어떻게 하면 이 똑똑하지만 위험할 수 있는 AI 비서를 안전하게 지킬 수 있는지 설명합니다.


🏠 비유로 이해하는 클로크키퍼의 3 가지 방어 전략

클로크키퍼는 단순히 "위험하면 멈춰라"라고 말하는 게 아니라, 세 가지 다른 방식으로 AI 를 감시하고 보호합니다. 마치 집을 지키는 세 가지 다른 보안 시스템과 같습니다.

1. 📜 '스킬 기반 보호': 비서에게 주입하는 '안전 수칙' (Skill-based)

  • 비유: AI 비서에게 **"집에 들어갈 때는 신발을 벗고, 친구에게 비밀번호는 절대 말하지 마라"**라고 적힌 안전 수칙 노트를 처음부터 함께 읽게 하는 것입니다.
  • 어떻게 작동하나요? AI 가 작업을 시작할 때, 이 안전 수칙을 함께 읽어주어 "이런 행위는 하지 말아야 해"라고 미리 알려줍니다.
  • 장점: 설치가 쉽고, 다양한 환경 (윈도우, 맥, 메신저 앱 등) 에 적용할 수 있습니다.
  • 단점: AI 가 너무 똑똑해지거나, 해커가 "이 노트는 다 찢어버려!"라고 명령하면 수칙을 무시할 수도 있습니다. (AI 가 수칙을 지키지 않을 수 있음)

2. 🔒 '플러그인 기반 보호': 비서의 '내장 보안 프로그램' (Plugin-based)

  • 비유: 비서의 옷 속에 **변경 불가능한 '방탄 조끼'**를 입히는 것입니다. 비서가 파일을 열려고 하면, 이 조끼가 자동으로 "잠깐! 이 파일은 위험해!"라고 막아섭니다.
  • 어떻게 작동하나요? AI 시스템 내부에 하드웨어처럼 단단하게 박혀 있는 보안 프로그램입니다. 설정 파일을 암호화하거나, 위험한 명령어가 실행되기 전에 강제로 차단합니다.
  • 장점: AI 가 수칙을 무시하더라도, 시스템 내부에서 강제로 막아주므로 매우 강력합니다.
  • 단점: 이 보안 프로그램은 미리 정해진 규칙만 따릅니다. 해커가 전혀 새로운 방식으로 공격하면 (새로운 악성코드), 이 프로그램은 이를 알아채지 못할 수 있습니다.

3. 👁️ '워커 (Watcher) 기반 보호': 비서를 감시하는 '독립된 감시관' (Watcher-based)

  • 비유: 비서 (OpenClaw) 와는 완전히 **다른 방에 있는 '경호원'**입니다. 이 경호원은 비서의 일을 돕지 않고, 오직 **"비서가 지금 안전한 일을 하고 있는지"**만 감시합니다.
  • 어떻게 작동하나요?
    • 비서가 "지금 이 파일을 삭제할까요?"라고 물어보면, 경호원은 "잠깐! 그건 위험해. 주인님 (사용자) 의 확인이 필요해!"라고 말합니다.
    • 비서가 해커의 명령을 받아 위험한 행동을 하려고 해도, 경호원은 비서와 다른 방에 있으므로 해커가 경호원을 해킹하거나 쫓아낼 수 없습니다.
    • 가장 중요한 점: 이 경호원은 스스로 배웁니다. 새로운 해킹 수법을 보면, 경호원 스스로 그 수법을 기억하고 다음엔 더 잘 막아냅니다.
  • 장점: 비서와 완전히 분리되어 있어 해킹이 어렵고, 스스로 진화하며, 사용자의 최종 확인 (Human-in-the-loop) 을 통해 가장 안전한 결정을 내립니다.

🚀 왜 이 연구가 중요한가요? (기존 방식과의 차이)

기존의 보안 방법들은 마치 **"문 하나만 잠그는 것"**과 같았습니다.

  • 어떤 건 비밀번호만 체크하고, 어떤 건 파일만 검사했습니다.
  • 해커가 한 곳을 뚫으면 전체가 무너졌습니다.
  • 또한, 보안이 너무 엄격하면 비서가 일을 못 하거나 (사용성 저하), 너무 느슨하면 위험해졌습니다.

클로크키퍼는 이 문제를 해결합니다.

  1. 종합 방어: 수칙 (스킬), 방탄 조끼 (플러그인), 경호원 (워커) 을 모두 합쳐서 어디서든 공격을 막습니다.
  2. 진화하는 보안: 특히 '경호원 (워커)'은 시간이 지날수록 더 똑똑해져서 새로운 해킹 수법을 스스로 배워냅니다.
  3. 안전과 효율의 균형: 비서에게 일을 시키되, 경호원이 "위험하면 멈춰!"라고만 하면 됩니다. 비서는 일을 잘하고, 경호원은 안전만 지키면 되므로 서로 간섭하지 않습니다.

📊 실제 결과는 어떨까요?

연구진은 7 가지 종류의 위험한 상황 (비밀번호 유출, 악성 명령어 실행, 시스템 해킹 시도 등) 을 만들어 테스트했습니다.

  • 기존 보안 프로그램들: 위험 상황의 60~70% 만 막았습니다. (특정 상황에만 효과적)
  • 클로크키퍼: **85~90%**의 위험을 성공적으로 막아냈습니다!
  • 특히, '경호원 (워커)'이 스스로 학습을 거치면 방어 성공률이 **95%**까지 올라갔습니다.

💡 결론: AI 시대의 '바이러스 백신'

이 논문의 핵심 메시지는 다음과 같습니다.

"AI 비서 (OpenClaw) 가 우리의 컴퓨터를 대신하는 '운영체제'가 된다면, 클로크키퍼는 그 안에 반드시 필요한 '바이러스 백신'이자 '경호원'입니다."

단순히 AI 가 말을 잘 듣는 것만으로는 부족합니다. AI 가 실수하거나 해킹당했을 때, 스스로를 지키거나 외부의 감시관 (워커) 이 막아줄 수 있는 시스템이 있어야만, 우리는 안심하고 AI 와 함께 살 수 있습니다.

클로크키퍼는 바로 그 안심할 수 있는 미래를 위한 첫걸음입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →