Rapid value learning reveals generalized and context-dependent codes in frontal cortex
이 연구는 전대상피질과 안와전두피질 모두에서 가치 표현이 학습 중에 빠르게 나타나지만, 전대상피질은 훈련 이력 전반에 걸쳐 일반화된 형식을 사용하는 반면 안와전두피질은 맥락 의존적 코드를 활용함으로써 서로 구별되는 부호화 전략을 사용한다는 것을 입증한다.
원본 논문은 CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 동료 심사를 거치지 않은 프리프린트의 AI 생성 설명입니다. 의학적 조언이 아닙니다. 이 내용을 바탕으로 건강 관련 결정을 내리지 마세요. 전체 면책 조항 읽기
당신의 뇌를 최상의 보상으로 이어지는 경로가 무엇인지 끊임없이 파악하려고 노력하는 초고성능 내비게이션 시스템이라고 상상해 보세요. 이를 위해 뇌는 어떤 것이 얼마나 좋은지를 알려주는 특별한 종류의 '가치 지도(value map)'에 의존합니다. 과학자들은 수십 년 동안 이 지도를 연구해 왔지만, 두 가지 매우 다른 방식으로 접근해 왔습니다. 한쪽에서는 새로운 게임을 처음 배우고 있는 사람들의 뇌를 스캔합니다. 반면, 다른 한쪽에서는 같은 게임을 수천 번이나 플레이한 원숭이의 뇌에 아주 작은 마이크를 꽂습니다. 오랫동안 모든 이들은 이 두 가지 관점이 동일한 것을 보여준다고 가정했습니다. 즉, 당신이 완전한 초보자이든 숙련된 전문가이든 뇌의 '가치 지도'는 똑같이 보인다는 것이었습니다. 하지만 만약 이것이 틀렸다면 어떨까요? 만약 뇌가 새로운 것과 익숙한 것에 대해 완전히 다른 설계도를 사용한다면 어떨까요? 이를 이해하는 것은 우리가 새로운 직장이나 생소한 음식처럼 완전히 새로운 것을 마주할 때와, 늘 해오던 일을 할 때 어떻게 결정을 내리는지 파고드는 데 매우 중요합니다.
이 연구는 바로 그 미스터리를 깊이 파고듭니다. 연구진은 원숭이 뇌의 두 가지 특정 명령 센터인 전대상피질(ACC)과 안와전두피질(OFC)에 있는 개별 뉴런(작은 전기적 일꾼들)의 소리에 귀를 기울입니다. 이 영역들을 뇌의 '가치 관리자(Value Managers)'라고 생각하면 됩니다. 연구진은 두 마리의 원숭이에게 새롭고 기이하게 생긴 그림들을 서로 다른 양의 주스와 연관시키도록 가르쳤습니다. 이 과정은 매우 빠르게 진행되었는데, 원숭이에게 그림을 보여준 뒤 곧바로 정확히 얼마만큼의 주스가 나올지를 알려주는 '이차 신호'(색깔 막대)를 보여주었습니다. 원숭이들은 단 4~7번의 시도만으로 새로운 그림의 가치를 학습했습니다. 이는 인간이 새로운 앱을 배우는 속도만큼이나 빠릅니다.
여기서 발견된 큰 성과는 두 뇌 영역 모두 빠르게 학습했지만, 그 방식은 완전히 달랐다는 점입니다. ACC는 마치 '만능 번역기'처럼 행동했습니다. 일단 새로운 그림의 가치를 학습하고 나면, ACC는 그 새로운 그림을 오래된 익숙한 것과 똑같이 취급했습니다. ACC는 대상이 새것인지 오래된 것인지 상관하지 않고, '가치'에 대한 단일하고 일반화된 코드를 사용했습니다. 이는 마치 당신이 수년간 소유해 온 자동차를 운전하든 방금 빌린 렌터카를 운전하든, "주유를 위해 좌회전하세요"라는 동일한 안내를 제공하는 GPS와 같습니다.
하지만 OFC는 훨씬 더 까다로운 사서 같았습니다. OFC는 맥락(context)을 알아야 했습니다. OFC는 단순히 '가치'만을 보는 것이 아니라, '새로운 것의 가치'와 '오래된 것의 가치'를 구분해서 보았습니다. 실제로 OFC는 원숭이가 신선한 것을 선택하는지, 아니면 수천 번 보았던 것을 선택하는지에 따라 서로 다른 뉴런 그룹을 동원했습니다. 게다가 OFC는 보상이 얼마나 좋을지 계산하기도 전에, "이것은 새롭다!"라고 먼저 외치는 첫 번째 영역이었습니다. 이는 OFC가 선택의 참신함을 표시하여 뇌가 더 주의를 기울이도록 돕는 '맥락 관리자' 역할을 한다는 것을 시사합니다. 반면 ACC는 그저 최선의 결정을 내리는 일에만 집중합니다.
또한 이 연구는 ACC에서 학습이 어떻게 이루어지는지에 대한 고전적인 이론을 확인시켜 주었습니다. 연구는 원숭이들이 새로운 그림을 학습함에 따라 뇌의 '가치 신호'가 물리적으로 이동한다는 것을 보여주었습니다. 처음에는 뉴런들이 주스(또는 주스를 나타내는 신호)가 도착했을 때만 반응했습니다. 하지만 원숭이들이 그림이 주스를 예측한다는 것을 배우자마자, 신호는 시간상 뒤로 점프하여 그림 자체로 옮겨갔고, 주스 신호에 대한 반응은 사라졌습니다. 이는 마치 음식이 도착할 때만 흥분하던 웨이터가, 메뉴를 익히고 나면 손님이 주문을 하는 순간부터 흥분하게 되는 것과 같습니다. 이 과정은 단 몇 초 만에 일어났으며, 이는 뇌가 거의 즉각적으로 자신의 가치 지도를 재구성할 수 있음을 증명합니다.
따라서 이 논문은 뇌가 새로운 가치를 놀라울 정도로 빠르게 배울 수 있지만, 단 하나의 '만능 방식'만을 사용하는 것은 아니라고 제안합니다. ACC는 단순하고 일관성을 유지하는 '제너럴리스트(generalist)'인 반면, OFC는 맥락을 끊임없이 확인하고 새로운 것을 알리는 '스페셜리스트(specialist)'입니다. 이는 우리의 뇌가 왜 그토록 유연할 수 있는지 설명해 줍니다. 우리는 안정감을 주는 관리자와 새로운 세상을 향해 경계심을 갖게 하는 관리자가 함께 협력하는 팀을 보유하고 있기 때문입니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.