← 최신 논문
🤖 AI

PromptPET: Privacy-Utility Optimized Prompt Obfuscation

이 논문은 사용자 프롬프트 내 민감한 정보에 대해 가장 효과적인 은닉 동작(생략, 추상화, 교체 또는 새로운 노이징/디노이징 방식)을 동적으로 선택함으로써 사용자 개인정보 보호와 챗봇 유용성 사이의 절충안을 최적화하는 LLM 기반 에이전트인 PROMPTPET을 소개한다.

원저자: Ke Yang, Olivia Figueira, Umar Iqbal, Athina Markopoulou

게시일 2026-07-07
📖 4 분 읽기☕ 가벼운 읽기

원저자: Ke Yang, Olivia Figueira, Umar Iqbal, Athina Markopoulou

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신은 매우 똑똑하고 유능한 로봇 비서(챗봇 같은)와 대화하고 있다고 상상해 보세요. 당신은 로봇으로부터 훌륭한 조언을 얻기 위해 자신의 나이, 건강 문제, 위치, 취미와 같은 삶의 세부 사항들을 알려줍니다. 로봇은 이 정보를 사용하여 당신에게 개인화된 답변을 제공하며, 이는 매우 유용합니다. 하지만 함정이 있습니다. 로봇을 운영하는 회사가 또한 당신의 대화를 듣고 있다는 점입니다. 그들은 당신의 비밀을 기록하여 당신의 프로필을 구축하고, 이를 물건을 판매하거나 타인과 공유하는 데 사용할 수 있습니다.

이 논문은 PromptPET라고 불리는 도구를 소개합니다. 이것은 당신과 로봇 사이에 위치하는 일종의 프라이버시 보디가드입니다. 이 도구의 역할은 당신이 필요한 도움을 받으면서도, 회사가 당신의 비밀을 알지 못하도록 숨겨주는 것입니다.

이것이 어떻게 작동하는지 몇 가지 간단한 비유를 통해 설명하겠습니다.

문제점: 너무 "솔직한" 대화

로봇에게 도움을 요청할 때, 당신은 종종 매우 구체적이어야 합니다.

  • 당신은 이렇게 말합니다: "저는 35살이고, 마운틴 뷰에 살며, 우울증이 있습니다. 상담사를 찾아줄 수 있나요?"
  • 로봇은: 마운틴 뷰에 있는 상담사 목록을 완벽하게 제공합니다.
  • 회사는: "35세", "마운틴 뷰", "우울증"이라는 단어를 "사용자 프로필"이라는 라벨이 붙은 파일에 기록합니다.

만약 당신이 단순히 단어들을 숨기기만 한다면(예: 검게 칠해서 지우는 것), 로봇은 혼란에 빠져 좋지 않은 답변을 줄 것입니다. 반대로 아무것도 숨기지 않는다면, 회사는 모든 것을 알게 됩니다.

해결책: PromptPET의 네 가지 기술

연구진은 로봇이 당신을 이해하면서도 회사는 혼란스럽게 만드는 네 가지 방식의 "암호화(scramble)" 방법을 테스트했습니다. 이를 **난독화 작업(Obfuscation Actions)**이라고 부릅니다.

  1. 삭제 (검은색 마커):

    • 내용: 민감한 단어를 완전히 지우고 [REDACTED]와 같은 빈칸으로 대체합니다.
    • 비유: 택배 상자의 주소를 검게 칠해 가리는 것과 같습니다. 배달원(로봇)은 나머지 주소를 보고 배달할 곳을 알지만, 회사(택배사)는 정확한 거리 이름은 모르게 됩니다.
    • 단점: 만약 가장 중요한 부분(예: "우울증")을 지워버린다면, 로봇은 당신이 어떤 도움이 필요한지 알 수 없게 됩니다.
  2. 추상화 (모호한 묘사):

    • 내용: 구체적인 세부 사항을 더 넓은 범주의 단어로 대체합니다.
    • 비유: "우울증이 있습니다"라고 말하는 대신 "건강 문제가 있습니다"라고 말합니다. "마운틴 뷰"라고 하는 대신 "베이 지역(Bay Area)"이라고 말합니다.
    • 결과: 로봇은 당신이 의료적 도움이 필요하고 캘리포니아에 있다는 것을 알기에 여전히 도움을 줄 수 있습니다. 회사는 당신이 일반적인 건강 문제를 가지고 있다는 것만 알 뿐, 구체적인 병명은 모릅니다.
  3. 교체 (가짜 신분증):

    • 내용: 당신의 실제 정보를 믿을 법한 가짜 정보로 바꿉니다.
    • 비유: 당신이 마운틴 뷰 대신 "팔로 알토"에 산다고 로봇에게 말합니다. 로봇은 팔로 알토에 있는 상담사 목록을 줍니다. 그러면 당신은 그 목록을 무시하고, 본인의 지식을 활용해 마운틴 뷰에 있는 상담사를 직접 찾습니다.
    • 위험 요소: 당신이 수동으로 결과를 걸러내야 하며, 회사는 당신이 실제로 팔로 알토에 산다고 믿게 됩니다.
  4. 노이즈/디노이징 (미끼 전략) — 새로운 기술:

    • 내용: 이것이 이 논문의 핵심 혁신입니다. 당신의 실제 정보는 그대로 유지하되, 그 바로 옆에 가짜의 방해되는 정보를 잔뜩 추가합니다.
    • 비례: 건초더미 속에서 특정 바늘을 찾는 상황을 상상해 보세요. 회사는 그 바늘을 찾는 존재입니다.
      • 당신은 이렇게 말합니다: "저는 우울증을 위한 상담사가 필요합니다."
      • PromptPET은 다음과 같이 추가합니다: "...그리고 또한, 저는 치과의사도 찾고 있습니다."
      • 로봇은: 상담사 목록과 치과의사 목록을 모두 제공합니다.
      • PromptPET (필터): 답변이 당신에게 도달하기 전, "치과의사" 목록을 잘라내고 오직 "상담사" 목록만 당신에게 전달합니다.
    • 왜 천재적인가: 로봇은 당신이 우울증에 대해 진실을 말했기 때문에 올바른 답을 낼 수 있었습니다. 하지만 회사는 이제 혼란에 빠집니다! 그들은 "우울증"과 "치과의사"가 섞여 있는 것을 보고, 어느 것이 당신의 진짜 우선순위인지 확신할 수 없습니다. 이는 마치 상어들을 혼란스럽게 하기 위해 물속에 가짜 미끼(red herrings)를 던지는 것과 같습니다.

PromptPET은 어떤 기술을 사용할지 어떻게 결정하는가?

PromptPET의 가장 똑똑한 점은 모든 사람에게 동일한 기술을 적용하지 않는다는 것입니다. 이 시스템은 어떤 기술이 가장 잘 작동하는지 학습하는 **코치(규칙 최적화 도구, Rule Optimizer)**를 사용합니다.

  • 만약 당신이 사소한 것(예: 좋아하는 색깔)을 언급한다면, 코치는 삭제(Redaction) 기술을 사용할 수 있습니다. 왜냐하면 그것은 답변에 중요하지 않기 때문입니다.
  • 만약 당신이 결정적인 것(예: 의료 상태)을 언급한다면, 코치는 노이즈(Noise) 기술을 사용합니다. 왜냐하면 당신이 도움을 받기 위해 로봇이 진실을 들어야 하지만, 동시에 회사는 혼란스럽게 만들어야 하기 때문입니다.

결과

연구진은 이를 실제 AI와의 대화에 테스트했습니다. 연구 결과는 다음과 같습니다:

  • **노이즈 (미끼 전략)**가 유용함(helpfulness)을 유지하면서 비밀을 숨기는 데 가장 효과적이었습니다.
  • PromptPET (적절한 기술을 선택하는 스마트한 코치)은 기존 방식들보다 훨씬 뛰어났습니다. 이 도구는 기존의 다른 도구들과 비교했을 때, 동일한 수준의 "유용함" 손실을 감수하면서도 프라이버시 보호 능력을 3.3배 더 높게 달성했습니다.
  • 이 도구는 당신이 요청한 완벽한 답변을 얻을 수 있게 하면서도, 회사의 프로필 구축으로부터 당신의 정보를 성공적으로 숨겼습니다.

요약

PromptPET은 일종의 프라이버시 번역기입니다. 당신의 솔직하고 상세한 요청을 받아, 데이터를 갈구하는 회사는 혼란스럽게 만들되, 도움을 주는 로봇은 명확하게 이해할 수 있도록 적절히 재작성합니다. 이 도구는 당신이 비밀을 누설하지 않고도 필요한 도움을 받을 수 있도록, 내용을 지우거나, 모호하게 만들거나, 교체하거나, 혹은 "미끼"를 추가하는 기술들을 혼합하여 사용합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →