← 최신 논문
💬 NLP

ProfileFoundry: A Synthetic Person-Object Substrate for Privacy, Memory, and Tool-Use Evaluation in LLM Agent

본 논문은 실제 사용자 데이터의 한계와 일관성 없는 합성 대안을 극복하기 위해, 메모리, 프라이버시 및 도구 사용 작업에서 파운데이션 모델의 책임 있는 평가를 가능하게 하도록 설계된 100,000개의 결정론적 생성 방식 및 고정 참조 릴리스인 교차 필드 일관성을 갖춘 합성 "인물 객체(Person Objects)" 생성기인 ProfileFoundry를 소개한다.

원저자: Sriram Selvam, Anneswa Ghosh

게시일 2026-06-26
📖 3 분 읽기☕ 가벼운 읽기

원저자: Sriram Selvam, Anneswa Ghosh

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 복잡한 가족 드라마를 촬영하려는 감독이라고 상상해 보세요. 하지만 실제 사람을 사용할 수는 없습니다. 실제 배우의 개인 사진, 실제 주소, 또는 실제 가계도를 사용하는 것은 심각한 사생활 침해가 될 수 있기 때문입니다. 만약 단순히 무작위적인 이름과 숫자를 만들어낸다면, 이야기는 무너지고 말 것입니다. 예를 들어 "형제"는 다른 나라에 살고 있는데 "자매"는 다른 곳에 살거나, "남편"의 직업이 그의 나이와 맞지 않는 상황이 발생할 수 있습니다.

ProfileFoundry는 이 문제를 해결하는 첨단 디지털 인형 공장과 같습니다.

작동 방식은 다음과 같이 간단한 개념으로 나뉩니다.

1. "디지털 인형" (인물 객체)

단순히 가짜 이름과 가짜 주소를 주는 대신, ProfileFoundry는 완전하고 연결된 디지털 인물을 구축합니다. 이것을 하나의 "디지털 인형"이라고 생각하면 되며, 여기에는 다음 요소들이 포함됩니다:

  • 스냅샷: 현재 그 사람의 상태 (직업, 주소, 나이).
  • 가계도: 부모, 형제, 배우자가 누구인지.
  • 가구 구성: 누구와 함께 살고 있는지.
  • 이력: 삶의 타임라인 (이사한 시기, 결혼한 시기, 직업을 바꾼 시기 등).
  • 연결 지도: 다른 "인형"들과 어떻게 연결되는지 (예: "이 사람은 저 사람과 같은 회사에서 근무함").

핵심은 모든 것이 일관성을 갖는다는 점입니다. 만약 인형이 자신을 25살이라고 한다면, (보통 그보다 더 오래 걸리는) 박사 학위를 가질 수 없습니다. 또한 결혼을 했다면, 시스템은 배우자가 누구인지 알고 있으며 배우 much의 나이가 논리적으로 맞는지 확인합니다.

2. "마스터 청사진" (생성기)

이 논문은 **결정론적 생성기(deterministic generator)**를 설명합니다. 이것은 집을 짓기 전에 먼저 청사진을 그리는 마스터 설계자와 같습니다.

  • 1단계: 설계자는 "부모 두 명과 성인 자녀 두 명으로 구성된 4인 가족을 만들겠다"라고 결정합니다.
  • 2단계: 이 결정에 따라 시스템은 세부 사항을 채웁니다. 부모에게는 공유된 주소가 부여되고, 자녀들은 부모와 연결됩니다.
  • 3단계: 시스템은 타임라인이 논리적으로 맞도록 현재 나이로부터 과거로 거슬러 올라가며 그들의 생애를 작성합니다 (예: 태어나기도 전에 새로운 도시로 이사할 수는 없었을 것입니다).

이를 통해 시스템에 "부모와 함께 사는 사람을 모두 보여달라"고 요청하면, 수학적으로 오류가 없는 리스트를 얻을 수 있습니다.

3. "안전한 샌드박스" (필요성)

대규모 언어 모델(LLM)과 같은 AI를 연구하는 연구자들은 다음과 같은 것들을 테스트해야 합니다:

  • 기억력: AI가 100번의 대화 후에도 사용자의 이름을 기억할 수 있는가?
  • 개인정보 보호: AI가 실수로 가상의 인물의 주소를 노출할 수 있는가?
  • 도구 활용: AI가 특정 인물을 위해 캘린더 앱을 올바르게 사용할 수 있는가?

이를 테스트하기 위해 그들에게는 데이터가 필요합니다. 하지만 실제 사람의 데이터를 사용할 수는 없습니다 (이는 불법이며 비윤리적입니다). 만약 무작위의 가짜 데이터를 사용한다면, 데이터가 실제 삶처럼 보이지 않기 때문에(예: "아버지"가 "아들"보다 젊은 경우처럼 데이터가 꼬여서) 테스트는 실패하게 됩니다.

ProfileFoundry는 10만 명의 가상 인물로 구성된 안전한 샌드박스를 제공합니다. 이는 AI를 위한 훈련 체육관과 같으며, 여기서 "무게"(데이터)는 실제처럼 묵직하지만, 어떤 실제 인간도 위험에 처하지 않습니다.

4. "감사 추적" (영수증)

이 논문의 가장 멋진 부분 중 하나는 책임성입니다.
보통 가짜 데이터를 생성할 때는 "블랙박스" 형태입니다. 결과물은 얻지만 그것이 어떻게 만들어졌는지 알 수 없습니다. 하지만 ProfileFoundry는 모든 인물에 대한 영수증을 제공합니다.

  • 그들은 어떤 "시드"(무작위 숫자 시작점)가 해당 인물을 만들었는지 정확히 알려줍니다.
  • "형제"와 "자매"가 별도로 생성된 것이 아니라 함께 생성되었음을 증명합니다.
  • 두 명의 가상 인물이 우연히 똑같은 생일과 이름을 갖게 되는 "충돌"이 발생하는지 체크합니다.
  • 실제 사람에게 절대 속하지 않을 것이 보장된 특수 이메일 주소(예: name@profilefoundry.example)를 사용합니다.

이것이 아닌 것 (주의사항)

저자들은 이 도구가 무엇이 아닌지를 매우 명확히 밝히고 있습니다:

  • 이것은 실제 인간이 어떻게 행동할지 완벽하게 예측하는 수정구슬이 아닙. 이것은 센서스(인구 조사)가 아니라 시뮬레이션입니다.
  • 이것은 개인정보 보호막이 아닙. 이 가짜 이름들을 사용하여 실제 사람에게 전화를 걸거나 은행을 속이는 용도로 사용할 수 없습니다.
  • 이것은 특정 게임이나 영화를 위한 완성된 제품이 아닙. 이것은 연구자들이 자신만의 테스트를 구축하는 데 사용할 수 있는 원재료(기질/substrate)입니다.

핵심 요약

ProfileFoundry는 AI를 안전하게 테스트하도록 설계된 재사용 가능하고, 감사 가능하며, 일관성 있는 가상 인물 세트입니다. 이것은 과학자들에게 10만 개의 정교하게 연결된 마네킹 상자를 제공하여, 실제 인간을 단 한 번도 건드릴 필요 없이 수술(이 경우에는 AI 테스트)을 연습할 수 있게 해주는 것과 같습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →