← 최신 논문
🤖 machine learning

Bergson: An Open Source Library for Data Attribution

Bergson은 EleutherAI가 개발한 오픈 소스 라이브러리로, 온디스크(on-disk) 그래디언트 저장, 멀티 노드 분산 학습을 네이티브로 지원하고 MAGIC, SOURCE, TrackStar 방법론의 첫 번째 오픈 소스 구현체를 제공함으로써 대규모 언어 모델과 사전 학습 데이터셋에 대한 데이터 기여도 산출 기술을 확장합니다.

원저자: Lucia Quirke, Louis Jaburi, David Johnston, William Z. Li, Gonçalo Paulo, Guillaume Martres, Girish Gupta, Stella Biderman, Nora Belrose

게시일 2026-06-11
📖 4 분 읽기☕ 가벼운 읽기

원저자: Lucia Quirke, Louis Jaburi, David Johnston, William Z. Li, Gonçalo Paulo, Guillaume Martres, Girish Gupta, Stella Biderman, Nora Belrose

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 거대하고 믿을 수 없을 정도로 똑똑한 로봇 요리사를 만들었다고 상상해 보세요. 이 요리사는 수백만 권의 요리책을 읽으며 요리를 배웠습니다(학습 데이터). 때때로 이 요리사는 맛이 아주 없는 음식을 만들거나, 배우지 말아야 할 이상한 기술을 익히기도 합니다. 당신은 다음과 같이 알고 싶어 합니다. "도대체 어떤 요리책의 몇 페이지가 이 문제를 일으킨 것인가?"

이것이 바로 데이터 귀속(Data Attribution) 문제입니다. 이는 마치 완성된 수프의 특정 풍미를 찾기 위해 3시간 전에 넣었던 소금 한 꼬집을 추적하는 것과 같습니다.

이 논문은 연구자들이 이러한 추적 문제를 거대 AI 모델에 대해 해결할 수 있도록 설계된 새로운 오픈 소스 "주방 도구 세트"인 Bergson을 소개합니다. 다음은 쉬운 비유를 사용한 작동 원리입니다.

1. 문제점: "블랙박스" 주방

보통 AI가 학습할 때는 블랙박스와 같습니다. 데이터를 넣으면 모델이 나옵니다. 만약 모델이 이상한 행동을 하면, 그 이유를 쉽게 알 수 없습니다.

  • 과제: 현대의 AI 모델은 너무 거대해서(수십억 권의 책이 있는 도서관처럼), 학습 과정이 매우 복잡하기 때문에 어떤 "책"이 특정 행동을 유발했는지 파악하는 것은 매우 어렵습니다. 예전에는 이를 수행하기 위해 엄청난 양의 컴퓨터 메모리가 필요했기에 대규모 모델에는 불가능에 가까웠습니다. 또한, 이를 수행하는 가장 좋은 도구들 중 상당수는 폐쇄적인 환경(비공개)에 갇혀 있었습니다.

2. 해결책: Bergson 도구 세트

Bergson은 AI를 위한 초강력 탐정 키트 역할을 하는 라이브러리(소프트웨어 도구 모음)입니다. 이 도구는 연구자들이 AI의 학습 과정을 "되감기"하여 어떤 데이터 포인트가 가장 큰 영향을 미쳤는지 볼 수 있게 해줍니다.

이것은 학습 과정에 대한 타임머신 카메라라고 생각하면 됩니다. Bergson은 과거를 되돌아보는 세 가지 방법을 제공합니다.

  • "완벽한 재생" (MAGIC): 요리사의 학습 과정을 매 초마다 기록할 수 있다고 상상해 보세요. 그런 다음 "되감기"를 눌러 단계별로 정확하게 재생하여 정확히 무슨 일이 일민지 볼 수 있습니다. 이것이 가장 정확한 방법이지만, 많은 저장 공간이 필요합니다. Bergson은 공간을 절약하면서도 선명한 이미지를 유지하기 위해, 특정 순간에만 "스냅샷(체크포인트)"을 저장하고 그 사이의 간극을 수학적으로 채우는 영리한 트릭을 사용하여 거대 모델에서도 이를 가능하게 합니다.
  • "스냅샷 근사치" (SOURCE): 가끔은 매 초를 기록할 수 없습니다. 대신 한 시간마다 사진을 찍습니다. 요리사가 사진을 찍는 사이에는 크게 변하지 않았다고 가정하는 것입니다. 이 방법은 더 빠르고 메모리를 적게 사용하지만, 정확도는 조금 떨어집니다. Bergson은 이 방법도 포함하고 있습니다.
  • "지문 스캐너" (TrackStar & Influence Functions): 영화 전체를 되감는 대신, 마지막에 모델의 뇌에 남겨진 "지문"을 살펴봅니다. "만약 이 특정 재료를 제거한다면, 최종 결과물이 얼마나 변할까?"라고 묻는 방식입니다. 매우 빠르고 거대한 데이터셋에서도 잘 작동하지만, 완벽한 재생이라기보다는 추정치입니다.

3. 도구 세트의 주요 특징

논문은 이 도구 세트를 사용하기 쉽게 만드는 여러 가지 "삶의 질(quality of life)" 기능을 강조합니다.

  • "디스크 드라이브" 트릭: 모든 데이터를 컴퓨터의 작고 빠른 메모리(RAM)에 담으려고 하는 대신, Bergson은 "지문"을 하드 드라이브에 저장합니다. 덕분에 컴퓨터가 다운되지 않고도 거대한 모델을 분석할 수 있습니다.
  • "검색 엔진" (FAISS): "어떤 데이터가 이 오류를 일으켰는가?"라고 물었을 때, Bergson은 모든 책을 하나씩 다 확인하지 않습니다. 대신 초고속 검색 엔진(데이터를 위한 구글 같은 역할)을 사용하여 가장 가능성 높은 상위 10개의 범인을 즉시 찾아냅니다.
  • "어댑터" 지름길: 때로는 요리사 전체를 다시 훈련시킬 필요 없이, 레시피의 작은 부분만 수정하면 될 수도 있습니다. Bergson은 "LoRA(Low-Rank Adaptation)"를 지원하여, 모델에 추가된 작은 부분의 영향만을 추적할 수 있게 함으로써 과정을 훨씬 저렴하고 빠르게 만듭니다.
  • "판사" 기능: 만약 요리사가 왜 무례하게 구는지 알고 싶다면 어떻게 할까요? "무례함"은 단순한 수학 공식으로 측정할 수 없습니다. Bergson은 두 번째 AI(판사)를 사용하여 요리사의 행동을 평가하게 하고, 그 평가를 학습 데이터로 역추적할 수 있게 해줍니다.

4. 실제 테스트 내용 (사례 연구)

저자들은 단순히 도구를 만든 것이 아니라, 이를 사용하여 세 가지 특정 퍼즐을 해결했습니다.

  1. "생물 보안(Biosecurity)" 퍼즐: 그들은 AI에게 위험한 생물학적 지식(예: 바이러스 제조법)을 가르친 학습 데이터 내의 특정 단어들을 찾고자 했습니다. 그들은 Bergson을 사용하여 특정 단어들을 강조해 냈습니다. 그 후 해당 단어들을 무시하고 AI를 재학습시켰을 때, AI는 훨씬 더 안전해졌습니다.
  2. "무례한 로봇" 퍼즐: 그들은 "판사" 기능을 사용하여 AI가 부적절하거나 이상한 행동을 생성하게 만든 데이터를 찾았습니다. 이 데이터를 필터링함으로써, AI가 더 나은 행동을 하도록 만들었습니다.
  3. "스타일" 퍼즐: 그들은 AI가 사실(예: "앨리스는 페르미랩에서 근무한다")과 그것을 말하는 방식(예: 셰익스피어풍 영어 vs 법률 용어)을 별도로 학습했는지 알고 싶었습니다. 그들은 Bergson이 스타일을 무시하고 사실을 가르친 특정 학습 데이터를 성공적으로 찾아냈음을 발견했으며, 이는 도구가 "무엇"을 배웠는지와 "어떻게" 말하는지를 구분할 수 있음을 증명합니다.

5. 결론

논문은 Bergson이 현재 존재하는 가장 거대한 AI 모델들에 대해 이러한 "타임머신" 추적 작업을 수행할 수 있는 최초의 오픈 소스 라이브러리라고 주장합니다. 이는 가장 정확한 방법(완벽한 재생)과 가장 빠른 방법(지문 스캔)을 결합하며, 연구자들에게 AI를 디버깅하고 이해하며 데이터를 정제할 수 있는 도구를 제공합니다.

요약하자면, Bergson은 "AI가 왜 저러는 걸까?"라는 미스터리를 해결 가능한 탐정 소설로 바꿉니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →