← 최신 논문
💰 quantitative finance

Emergent Latent-State Computation under Stochastic Volatility

이 논문은 확률적 변동성 데이터로 학습된 시퀀스 모델이 잠재적 변동성 상태를 인코딩하고 수익률을 예측하기 위해 해석 가능한 2단계 내부 메커니즘을 발달시킨다는 점을 입증하며, 노이즈가 많은 훈련 상황에서의 성능 저하가 표현의 실패보다는 판독(readout)의 불일치에서 기인한다는 것을 밝힌다.

원저자: Xiaoyu Huang, Lulu Wang

게시일 2026-07-29
📖 3 분 읽기☕ 가벼운 읽기

원저자: Xiaoyu Huang, Lulu Wang

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

AI의 비밀스러운 삶: 보이지 않는 것을 듣는 법

당신이 날씨를 예측하려고 노력하고 있다고 상상해 보세요. 구름을 볼 수 있고, 바람을 느끼고, 비의 양을 측정할 수는 있지만, 실제로 폭풍을 일으키는 머리 위 수 마일 상공에서 소용돌이치는 보이지 않는 기압 체계는 볼 수 없습니다. 인공지능의 세계에서 과학자들은 컴퓨터 두뇌(뉴럴 네트워크라고 불리는)가 어떻게 세상을 이해하는지 파악하려고 노력하고 있습니다. 보통 그들은 수학 문제를 풀거나 문장을 완성하는 것처럼 답이 명확한 단순하고 명료한 퍼즐로 이 두뇌들을 테스트합니다. 하지만 현실 세계는 무질서합니다. 종종 가장 중요한 정보는 숨겨져 있거나, 노이즈가 섞여 있거나, 예측 불가능한 방식으로 변합니다. 바로 여기서 '기계론적 해석 가능성(mechanistic interpretability)'이라는 분야가 등장합니다. 이것은 마치 AI를 위한 탐정이 되는 것과 같습니다. 단순히 "AI가 무엇을 예측했는가?"라고 묻는 대신, "AI가 그것을 어떻게 알아냈는가?" 그리고 "그것의 두뇌 내부에서 어떤 비밀스러운 단서를 찾아냈는가?"라고 묻는 것입니다. 이 논문은 AI가 금융 데이터를 다루는 까다로운 버전의 탐정 업무를 다룹니다. 여기서 진정한 '변동성'(시장이 얼마나 거칠게 움직이는지)은 화면 위의 노이즈 섞인 숫자들을 관찰함으로써만 추측할 수 있는, 숨겨진 채 변화하는 유령과 같습니다.


논문: AI에게 보이지 않는 유령을 보는 법 가르치기

이 연구에서 연구원들인 황샤오위(Xiaoyu Huang)와 루루왕(Lulu Wang)은 작은 AI 모델들이 어떻게 숨겨진 유령을 '볼' 수 있는지 확인하기 위해 디지털 놀이터를 구축했습니다. 그들은 6개의 서로 다른 자산이 있는 주식 시장 시뮬레이션을 만들었습니다. 그들의 세계에서 실제 '변동성'(가격이 요동치는 정도)은 집 안을 돌아다니는 유령처럼 시간이 지남에 따라 변하는 숨겨진 상태입니다. AI는 오직 '수익률'(가격 변화)만을 볼 수 있는데, 이는 마치 바닥의 삐걱거리는 소리만을 듣고 유령이 어디에 있는지 추측해야 하는 것처럼 노이즈가 많고 흐릿합니다. 목표는 간단했습니다. AI가 다음 가격 변동을 예측하기 위해, 먼저 숨겨진 유령이 어디에 있는지 알아낼 수 있는가 하는 것이었습니다.

연구진은 두 가지 유형의 AI 두뇌를 훈련시켰습니다. 하나는 각 주식을 개별적으로 살펴보는 단순한 모델(MLP)이고, 다른 하나는 주식들이 서로 어떻게 소통하는지 살펴볼 수 있는 더 복잡한 모델(Transformer)입니다. 그들은 두 유형의 AI 모두 영리한 2단계 기술을 학습했다는 것을 발견했습니다. 첫째, AI의 '숨겨진 두뇌'(중간 레이어)는 보이지 않는 유령의 위치에 대한 정신적 지도를 성공적으로 구축했습니다. 둘째, AI의 '출력 입'(최종 레이어)은 그 지도를 사용하여 다음 가격 변동을 예측했습니다. 이는 마치 AI가 먼저 유령을 추적하는 법을 배우고, 그 추적을 이용해 폭풍을 예측하는 것과 같습니다.

하지만 여기서 정말 흥-미로운 점이 발생합니다. 연구진은 트랜스포머(Transformer)가 이 기술을 어떻게 학습하는지가 유령이 얼마나 빨리 움직이느냐에 따라 달라진다는 것을 발견했습니다.

  • 느린 유령 (긴 주기): 변동성이 매우 느리게(마치 느리고 나른한 파도처럼) 변할 때, 트랜스포머는 매우 단순한 지름길을 찾아냈습니다. 그것은 수학적 '필터'(선형 투영과 정규화 단계)를 사용하여 원시 데이터를 특정 형태로 변환했고, 그러면 짠—유령의 위치가 갑자기 명확해졌습니다. 마치 AI가 흐릿한 이미지를 즉각적으로 초점을 맞추는 마법 렌즈를 찾아낸 것과 같았습니다.
  • 빠른 유령 (짧은 주기): 변동성이 빠르게 변할 때, AI는 더 많은 도움이 필요했습니다. AI는 퍼즐을 맞추기 위해 자신의 '어텐션(attention)' 메커니즘(주식 간의 상호작용을 살피는 것)과 내부의 '사고' 레이어를 사용해야 했습니다.
  • '유령' 대 '번역가': 연구는 또한 재미있는 결함도 발견했습니다. 때때로 AI의 숨겨진 두뇌는 유령이 정확히 어디에 있는지 알고 있었지만, 그 지식을 숫자로 번역하는 AI의 부분(출력 헤드)이 다소 서툴렀습니다. 이는 마치 범인의 정체를 알고 있는 뛰어난 형사가 보고서를 쓸 때 버벅거리는 것과 같았습니다. 연구진이 이 서툰 보고자를 더 나은 보고자로 교체했을 때 AI의 예측은 훨씬 좋아졌으며, 이는 AI가 이미 비밀을 알고 있었음을 증명했습니다. 단지 그것을 말하는 더 나은 방법이 필요했을 뿐이었습니다.

이 논문은 이러한 금융 시뮬레이션이 AI 과학자들에게 환상적인 새로운 놀이터가 될 수 있음을 시사합니다. 답이 페이지 위에 바로 적혀 있는 단순한 퍼즐과 달리, 이 모델들은 AI가 현실 세계에서 인간이 하는 것처럼 노이즈 섞인 단서로부터 숨겨진 진실을 추측하는 '암묵적 필터링(implicit filtering)'을 수행하도록 강제합니다. AI가 이러한 숨겨진 상태를 추출하는 법을 배울 수 있고, 우리가 코드 내의 정확히 '어디서' 그리고 '어떻게' 그런 일이 일어나는지 짚어낼 수 있다는 것을 보여줌으로써, 저자들은 우리가 디지털 두뇌의 비밀스러운 삶을 진정으로 이해하는 데 더 가까워지고 있음을 시사합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →