← 최신 논문
💻 computer science

GLiNER Guard: Unified Encoder Family for Production LLM Safety and Privacy

GLiNER Guard(GLiGuard) 는 단일 순전파로 안전 분류와 개인 식별 정보(Pii) 감지를 동시에 수행하는 통합 인코더 계열로, 생산용 LLM 시스템의 기존 자기회귀형 중재자 대비 높은 처리량, 낮은 지연 시간, 비용 효율적인 대안을 제공합니다.

원저자: Bogdan Minko, Sabrina Sadiekh, Evgeniy Kokuykin

게시일 2026-05-08
📖 4 분 읽기☕ 가벼운 읽기

원저자: Bogdan Minko, Sabrina Sadiekh, Evgeniy Kokuykin

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

거대한 활기찬 디지털 도시를 운영한다고 상상해 보세요. 이곳에서 사람 (사용자) 들은 거대하고 초지능적인 로봇 (LLM) 과 대화하여 답변을 얻거나, 이야기를 쓰거나, 문제를 해결합니다. 이러한 대화들이 거대한 로봇에게 도달하기 전에 보안 검문소를 통과해야 합니다.

이 검문소는 두 가지 매우 중요한 역할을 수행합니다:

  1. 안전 수호자: 해킹 시도, 로봇 속임수, 또는 악의적인 발언을 시도하는 나쁜 세력을 막습니다.
  2. 개인정보 수호자: 유출되기 전에 신용카드 번호, 집 주소, 전화번호와 같은 개인 비밀을 찾아내어 숨깁니다.

문제: "느린 거인" 대 "빠른 후각견"

지금까지 도시 계획가들은 두 가지 유형의 경비원 사이에서 선택해야만 했으며, 어느 것도 완벽하지 않았습니다:

  • 느린 거인들 (자기회귀 모델): 이들은 요청의 모든 단어를 신중하게 읽고 문맥을 깊이 있게 고려하는 거대하고 고학력 경비원들과 같습니다. 나쁜 것을 포착하는 데는 놀라울 정도로 정확하지만, 고용하는 데는 느리고 비용이 많이 듭니다. 매초 수백만 명의 사람들이 도시 입구를 시도한다면, 모두를 검사할 만큼 충분한 거인들을 고용하는 것은 도시를 파산시키고 막대한 교통 체증을 초래할 것입니다.
  • 빠른 후각견들 (가벼운 인코더): 이들은 특정 냄새 (예: "유해한 단어" 또는 "이메일 주소") 를 맡아내는 빠르고 훈련된 개들과 같습니다. 빠르고 저렴하지만, 시야가 좁습니다. 그들은 깊은 사고를 하지 않기 때문에 교묘한 속임수를 놓치거나 복잡한 개인 비밀을 찾아내지 못할 수 있습니다.

해결책: "슈퍼 후각견" (GLiNER Guard)

이 논문의 저자인 HiveTraceLab 은 **GLiNER Guard (GLiGuard)**라는 새로운 종류의 경비원을 개발했습니다. 이는 한 패키지로 탐정처럼 생각할 수 있는 슈퍼 후각견이라고 생각하세요.

느린 거인과 빠른 후각견을 모두 고용하는 것 (두 가지 별도의 검사가 필요함) 대신, GLiGuard 는 단일한 번의 번개 같은 통과로 두 가지 역할을 모두 수행합니다.

그들이 이를 구축한 방법은 다음과 같습니다:

  • 두뇌: 그들은 GLiNER2 라는 모델에 기반한 스마트하고 컴팩트한 두뇌를 가져와 "이 요청이 위험한가?"와 "이것에 비밀이 포함되어 있는가?"라는 두 가지를 동시에 찾도록 가르쳤습니다.
  • 변형: 그들은 서로 다른 필요에 따라 이 경비원의 세 가지 버전을 구축했습니다:
    1. 컴팩트 경비원 (Uni/Bi-인코더): 대규모 군중을 처리하도록 설계된 작고 초고속 버전입니다. 단일 컴퓨터 칩에서 거의 지연 없이 초당 약 200 명을 검사할 정도로 효율적입니다.
    2. 오미 경비원: 약간 더 크고 더 똑똑한 버전입니다. 컴팩트 버전보다 약간 느리지만 복잡한 상황을 이해하는 데 더 뛰어나며, 처음부터 다시 학습할 필요 없이 새로운 이상한 규칙에 적응할 수 있습니다.

결과: 속도와 지능의 만남

이 논문은 시뮬레이션된 도시 (Aegis 와 StrongReject 와 같은 벤치마크 사용) 에서 이 새로운 경비원들을 테스트하여 다음과 같은 인상적인 결과들을 발견했습니다:

  • 속도: 컴팩트 경비원은 속도 괴물입니다. 강력한 컴퓨터 칩 (A100) 에서 이전의 가장 뛰어난 가벼운 경비원보다 1.6 배 더 빠르게 요청을 처리하면서도 "테일 지연" (가장 느린 요청이 걸리는 시간) 을 1 초 미만으로 유지했습니다.
  • 정확도: 작지만 놀라울 정도로 강력합니다. 안전 테스트에서 "오미" 버전은 훨씬 크고 느린 모델들보다 높은 점수를 받았습니다. 대부분의 나쁜 행위자를 잡기 위해 200 억 파라미터의 "거인"이 필요하지 않다는 것이 입증되었습니다; 2 억 파라미터의 똑똑한 "후각견"이 첫 번째 방어선으로서 충분히 일을 해냅니다.
  • 개인정보 보호: 나쁜 단어만 막은 것이 아니라, 텍스트에서 개인 비밀 (이름과 주소 등) 을 성공적으로 찾아내어 별도의 "개인정보 스캐너"의 필요성을 대체할 수 있음을 입증했습니다.

전략: "계층화"된 도시

이 논문은 이 도시를 운영하는 현명한 방법을 제안합니다: GLiGuard 를 주요 게이트로 사용하세요.

GLiGuard 는 매우 빠르고 저렴하기 때문에 모든 사람 앞에 배치할 수 있습니다. 이는 명백한 나쁜 세력을 잡고 명백한 비밀을 즉시 숨깁니다.

  • 만약 GLiGuard 가 어떤 요청에 대해 불확실하다면 (아마도 까다롭고 길거나 다국어 메시지일 수 있음), 해당 특정 요청을 더 깊은 두 번째 검토를 위해 "느린 거인" (더 큰 AI 모델) 에게 전달할 수 있습니다.
  • 이렇게 하면 어려운 사례들에 대해서만 비싼 비용을 지불하고, 빠르고 저렴한 경비원이 트래픽의 99% 를 처리하게 됩니다.

새로운 지도 (PII-Bench)

개인정보 보호 능력을 입증하기 위해 저자들은 PII-Bench라는 새로운 지도도 만들었습니다. 이는 경비원이 러시아어 대화에서 개인 비밀을 얼마나 잘 찾아낼 수 있는지 보기 위해 특별히 설계된 테스트입니다. 그들은 새로운 경비원이 특히 간단한 규칙 검사기 (전화번호를 위한 맞춤법 검사기와 같은) 와 결합되었을 때 이 분야에서 탁월함을 발견했습니다.

요약

간단히 말해, GLiNER Guard는 AI 시스템을 위한 실용적인 올인원 보안 경비원입니다. 이는 수백만 개의 요청을 처리할 만큼 빠르면서도 안전 위반과 개인 비밀을 한 번의 훑음으로 포착할 만큼 똑똑한 모델을 제공함으로써 속도와 안전 사이의 오래된 트레이드오프를 해결합니다. 이는 기업들이 사용자의 속도를 늦추거나 돈을 낭비하지 않고도 AI 시스템을 안전하고 사적으로 유지할 수 있게 합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →