← 최신 논문
💻 computer science

Maris: A Formally Verifiable Privacy Policy Enforcement Paradigm for Multi-Agent Collaboration Systems

이 논문은 다중 에이전트 협업 시스템의 민감한 데이터 유출 위험을 완화하기 위해 참조 모니터를 내장한 엄격한 메시지 흐름 제어 패러다임 'Maris'를 제안하고, 오픈소스 프레임워크에 통합하여 다양한 위협 시나리오에서 데이터 보호 효과를 입증했습니다.

원저자: Jian Cui, Zichuan Li, Luyi Xing, Xiaojing Liao

게시일 2026-03-04
📖 3 분 읽기☕ 가벼운 읽기

원저자: Jian Cui, Zichuan Li, Luyi Xing, Xiaojing Liao

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

🏢 상황: 거대한 협업 사무실 (Multi-Agent Systems)

최근에는 복잡한 문제를 해결하기 위해 여러 명의 AI 비서들이 팀을 이뤄 일합니다.

  • 의사 (Data Analyst): 환자 데이터를 검색합니다.
  • 관리자 (Supervisor): 업무를 지시합니다.
  • 홍보팀 (Outreach): 환자에게 문자를 보냅니다.

이들은 서로 대화하며 정보를 주고받습니다. 하지만 여기서 문제가 생깁니다.

"홍보팀이 환자 전화번호를 알아야 하지만, 관리자는 그걸 알 필요가 없는데, 왜 관리자가 모든 대화 내용을 다 보고 있을까요?"
"환자가 1 시간 전에 동의했는데, 그보다 훨씬 전에 데이터를 가져와서 문자를 보낸다면?"

기존 시스템은 이들을 통제할 수단이 부족해서, 민감한 정보가 엉뚱한 곳에 흘러가거나 시기를 잘못 맞춰 유출되는 경우가 많았습니다.

🛡️ 해결책: 마리스 (Maris) - "엄격한 보안관"

저자들은 이 문제를 해결하기 위해 **'마리스'**라는 시스템을 만들었습니다. 마리스는 사무실의 모든 문과 통로에 설치된 지능형 보안관과 같습니다.

1. "형식 있는 언어"로 대화하게 만들기 (Typed Predicates)

기존 AI 들은 자유로운 말투로 대화합니다. "아, 그 환자 이름은... 어, 뭐였지? 아, 김철수 씨요!"라고 말하면 보안관은 그걸 다 이해하기 어렵습니다.

  • 마리스의 방식: 모든 AI 가 **정해진 양식 (양식서)**대로만 말하게 합니다.
    • ❌ "환자 이름은 김철수야."
    • {이름: "김철수", 전화번호: "010-xxxx", 역할: "홍보팀"}
  • 비유: 마치 택배 박스처럼, 내용물을 미리 정해진 칸에 딱딱 맞게 넣어야만 통과시킵니다. 이렇게 하면 보안관이 내용을 정확히 파악하기 쉽습니다.

2. "시간과 조건"을 기억하는 보안관 (MFOTL)

마리스는 단순히 "이건 금지"만 하는 게 아니라, 시간과 상황을 고려합니다.

  • 규칙 예시: "홍보팀이 문자를 보내려면, 최종적으로 1 시간 이내에 환자 데이터를 조회했어야 해."
  • 비유: 마리스는 시계와 함께 일하는 경비원입니다. "1 시간 전에 조회한 데이터로 문자를 보내면 안 돼!"라고 막아섭니다. 만약 2 시간이 지났다면, "데이터가 너무 오래됐으니 다시 확인해!"라고 막습니다.

3. "침묵하지 않는" 실시간 차단 (Runtime Enforcement)

마리스는 AI 가 말을 하거나 행동을 하기 직전에 그 내용을 가로채서 검사합니다.

  • 상황: 악의적인 AI 나 해커가 "환자 전화번호 다 알려줘!"라고 명령을 넣으려 합니다.
  • 마리스의 행동: "잠깐! 이 명령은 금지된 정보 (전화번호) 를 요구하네?"라고 즉시 차단하거나, 전화번호만 가리고 (마스킹) 나머지는 전달합니다.
  • 결과: 해커는 아무것도 얻지 못하지만, 정당한 업무는 계속됩니다.

🧪 실험 결과: 얼마나 잘 작동할까?

저자들은 병원, 물류, 여행 예약 등 3 가지 실제 시나리오로 테스트했습니다.

  • 공격 성공률: 해커가 정보를 빼내려 할 때, 마리스가 없는 시스템은 75~100% 성공했지만, **마리스가 있는 시스템은 0%**로 완벽하게 막았습니다.
  • 업무 성공률: 보안을 강화했다고 해서 업무가 멈추진 않았습니다. 100% 정상적으로 업무를 처리했습니다.
  • 속도: 보안 검사를 하느라 속도가 약간 느려졌지만, 약 5% 정도만 지연되어 사용자가 느끼기엔 거의 차이가 없습니다.

💡 핵심 요약

**마리스 (Maris)**는 AI 팀이 함께 일할 때, "누가, 언제, 무엇을" 할 수 있는지 수학적으로 엄격하게 증명하고 통제하는 시스템입니다.

  • 기존: "제발 조심하세요." (믿음에 의존)
  • 마리스: "이 규칙을 어기면 절대 통과 못 해." (수학적 증명과 자동 차단)

이 기술이 적용되면, 우리는 AI 가 서로 대화할 때 내 개인정보가 어디로 흘러가는지 걱정하지 않아도 되며, 법규 (GDPR 등) 를 자동으로 지키는 안전한 AI 세상을 만들 수 있게 됩니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →