← 최신 논문
🤖 machine learning

Latent States in Neural Networks: Recovering the Temporal Structure of Drifting Data from Model Weights

이 논문은 드리프트가 발생하는 데이터 스트림에서 훈련된 분류기들의 시간 순서대로 정렬된 가중치에 은닉 마르코프 모델을 적합시키는 것이 단순한 시간적 근접성이나 나이브한 분할보다 일반화 성능을 더 효과적으로 예측하는 잠재적 시간적 체제(latent temporal regimes)를 복구할 수 있음을 입증하며, 이를 통해 모델 가중치가 기저의 데이터 분포에 나타나는 의미 있는 구조적 변화를 인코딩하고 있음을 밝힌다.

원저자: Kevin Guan

게시일 2026-07-31
📖 4 분 읽기☕ 가벼운 읽기

원저자: Kevin Guan

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

학습하는 기계의 비밀 일기

당신이 강물을 바라보고 있다고 상상해 보세요. 육안으로는 물이 하나의 연속적이고 흐르는 줄기처럼 보입니다. 하지만 그곳에 사는 물고기라면, 흐름이 갑자기 변하는 것을 알아챌 수도 있습니다. 어떤 때는 작은 물고기들이 가득한 온화하고 따뜻한 흐름이었다가, 다음 순간에는 거대한 포식자들이 있는 차갑고 격동적인 급류로 변하기도 합니다. 인공지능의 세계에서 컴퓨터는 뉴스 기사나 고객 리뷰와 같은 데이터의 흐름을 보며 학습합니다. 보통 우리는 이 데이터가 흐르는 강물처럼 느리고 부드럽게 변한다고 가정합니다. 하지만 만약 데이터가 마치 강물이 잔잔함에서 폭풍우로 바뀌는 것처럼, 서로 다른 "레짐(regime)"이나 뚜렷한 단계 사이를 급격하게 오간다면 어떨까요?

여기서 "잠재 상태(latent states)"라는 개념이 등장합니다. 잠재 상태를 직접 볼 수는 없지만, 등장인물의 행동을 보고 추측할 수 있는 숨겨진 기분이나 이야기 속의 비밀스러운 장(chapter)이라고 생각해보세요. 과학자들은 인간의 뇌가 이와 유사한 일을 한다는 것을 오래전부터 알고 있었습니다. 우리는 삶이라는 연속적인 흐름을 경험할 때, 기억하고 이해하기 쉽도록 이를 불연속적인 "사건"이나 장면으로 자발적으로 나누어 처리합니다. 이 논문은 매혹적인 질문을 던집니다. 인공 신경망(AI의 뇌)도 이와 같은 일을 할까요? 만약 AI에게 시간이 지남에 따라 변화하는 데이터 스트림이 입력된다면, AI의 내부 "뇌"(수학적 가중치)는 우리가 명시적으로 그러한 단계를 찾으라고 말하지 않았음에도 불구하고 스스로를 뚜렷한 단계로 재구성할까요? 만약 우리가 이러한 숨겨진 단계들을 찾아낼 수 있다면, 이는 언제 옛 교훈을 신뢰하기를 멈추고 새로운 것을 배워야 하는지 정확히 아는 더 똑똑한 AI를 구축하는 데 도움이 될 것입니다.

논문의 이야기: 표류하는 AI의 마음 읽기

이 연구에서 연구진은 데이터 스트림을 시간 여행을 하는 일기처럼 다루었습니다. 그들은 한 번에 모든 것을 학습하는 하나의 거대한 AI 모델을 만든 것이 아닙니다. 대신, 두 가지 매우 다른 유형의 데이터 스트림을 가져왔습니다. 하나는 가짜 뉴스에 관한 레딧(Reddit) 게시물 모음(Fakeddit)이고, 다른 하나는 방대한 양의 Yelp 레스토랑 리뷰입니다. 그들은 이 스트림들을 각각 35개와 56개의 별도 시간 창(time window)으로 나누었는데, 이는 마치 긴 영화를 개별 장면들로 자르는 것과 같습니다. 각 장면마다 그들은 처음부터 새로운 AI 분류기를 학습시켰습니다.

이 모델들을 확보한 후, 연구진은 모델이 무엇을 말하는지(예측값)를 본 것이 아니라, 모델이 무엇인지를(내부 가중치) 살펴보았습니다. 각 모델을 수백만 개의 작은 찰흙 구슬로 만든 독특한 조각상이라고 상상해 보세요. 연구진은 이 조각상들을 긴 숫자 문자열로 펼친 다음, 특수한 수학적 도구인 은닉 마르코프 모델(Hidden Markov Model, HMM)을 사용하여 이 문자열들의 순서에서 패턴을 찾았습니다. 그들은 "찰흙"의 모양이 갑자기 변하여 모델이 새로운 "잠재 상태"에 진입했음을 알리는 순간을 찾고 있었습니다.

연구 결과
결과는 마치 찰흙 속에 숨겨진 비밀 지도를 발견한 것과 같았습니다. HMM은 타임라인에서 뚜렷한 단계들을 성공적으로 식별해 냈습니다. 레딧 데이터셋의 경우 11개의 뚜렷한 상태를 찾아냈고, Yelp 데이터셋의 경우 16개를 찾아냈습니다(단, 실제로 방문된 상태는 15개였습니다).

가장 흥리학적인 발견은 이러한 숨겨된 상태들이 단순히 무작위적인 수학적 기교가 아니라, 실제로 AI의 성능에 영향을 미친다는 점이었습니다. 연구진은 한 시간 창에서 학습된 모델을 가져와 다른 시간 창의 데이터를 예측하도록 테스트함으로써 이를 검증했습니다. 그들은 명확한 규칙을 발견했습니다. AI 모델은 훈련 데이터와 테스트 데이터가 동일한 "숨겨진 상태"에 속할 때 훨씬 더 잘 일반화된다는 것입니다.

이것을 비유하자면 이렇습니다. 당신이 햇살이 비치는 평탄한 길(상태 A)에서 자전거 타기를 배웠다면, 또 다른 햇살 비치는 평탄한 길(역시 상태 A)에서 테스트를 받는다면 아주 잘 해낼 것입니다. 하지만 곧바로 비 내리는 진흙길(상태 B)에서 시도한다면 아마 넘어질 가능성이 높습니다. 논문은 시간대가 서로 가까이 있더라도 "상태"가 성공을 예측하는 실제 요인임을 보여주었습니다. 훈련 창과 테스트 창이 동일한 상태에 있으면 AI의 성능이 현저히 좋았지만, 상태 경계에 의해 분리되어 있으면 성능이 떨어졌습니다.

"무엇" 뒤에 숨겨진 "왜"
연구진은 궁금했습니다. 이 상태들이 정확히 무엇을 추적하고 있는 것일까요? 이것이 단순히 모델의 수학적 기하학적 형태에 관한 것일까요, 아니면 데이터 자체에 관한 것일까요? 그들은 모델의 가중치 간 거리와 데이터 내용의 차이(구체적으로는 다양한 유형의 게시물이나 리뷰가 나타나는 빈도)를 비교했습니다.

놀랍게도, 숨겨진 상태들은 수학적 기하학보다 데이터의 내용을 훨씬 더 밀접하게 추적했습니다. 레딧 데이터셋의 경우, 상태들은 게시되는 가짜 뉴스의 유형 변화와 거의 완벽하게 일치했습니다. 리뷰의 유형이 더 안정적이었던 Yelp 데이터셋에서는 상태를 찾기가 더 어려웠고 그 효과도 더 약했습니다. 이는 AI의 내부 "기분"이 세상이 관찰하는 바를 바꿀 때마다 변한다는 것을 시사합니다. 비록 AI가 세상이 왜 변했는지 명시적으로 알지는 못하더라도 말입니다.

그것이 아닌 것
논문은 몇 가지 단순한 설명들을 배제하기 위해 주의를 기울였습니다. 첫째, 이것이 단순히 데이터가 "신선해서" 발생하는 현상이 아님을 증명했습니다. 두나 시간적 간격을 통제했을 때도 "동일 상태"의 이점은 여전히 유지되었습니다. 둘째, 타임라인을 단순히 동일한 크기의 조각으로 나누는 것(예: 케이크를 11개의 동일한 조각으로 자르는 것)은 그들의 스마트한 HMM 방식만큼 효과적이지 않다는 것을 보여주었습니다. HMM은 단순히 아무 경계나 찾는 것이 아니라 올바른 경계를 찾아냈습니다.

마지막으로, 그들은 "상태"가 단순히 "데이터 분포가 변했다"는 말을 멋지게 표현한 것에 불과한지 테스트했습니다. 그들은 데이터 분포의 차이를 고려했을 때 이 이점이 사라지는지 확인하기 위해 복잡한 통계적 검사를 수행했습니다. 레딧 데이터셋의 경우, 이 이점은 강력하게 지속되었으며, Yelp 데이터셋에서는 약하지만 유의미하게 지속되었습니다. 이는 상태가 단순히 "가짜" 또는 "긍정적"인 게시물이 얼마나 많은지를 세는 것을 넘어, 데이터의 구조에 대한 실질적인 무언가를 포착하고 있다는 것을 의미합니다.

핵심 요약

이 논문은 인공 신경망이 인간의 뇌와 마찬가지로, 경험의 흐르는 스트림을 일관된 장(chapter)으로 자연스럽게 분절한다는 점을 시사합니다. 서로 다른 시기에 학습된 모델들의 "가중치"(내부 찰흙 조각상)를 살펴봄으로써, 우리는 이러한 숨겨진 장들을 복원할 수 있습니다. 이 논문이 AI의 모든 문제를 해결했다고 주장하는 것은 아니지만, 데이터 스트림에 귀를 기울이는 강력하고 새로운 방법을 제시합니다. 이는 AI의 내부 구조가 변할 때, 그것이 종종 외부의 세상 또한 변했다는 신호이며, 바로 그때가 우리의 이해를 업데이트해야 할 완벽한 순간임을 알려줍니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →