Psychological Imagination Networks Show Cross-Population Centrality and Clustering Alignment in Humans That Large Language Models Fail to Replicate
이 연구는 인간의 정신적 심상 네트워크가 중심성과 군집성 측면에서 강력한 집단 간 구조적 정렬을 보이는 반면, 대규모 언어 모델은 이러한 패턴을 재현하는 데 실패한다는 점을 입증하며, 이는 인간의 상상력이 언어적 훈련뿐만 아니라 체화된 경험적 기억에 의존하고 있음을 시사한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
핵심 아이디어: 우리 마음속에서 어떻게 "보는가"
당신의 뇌를 거대한 도서관이라고 상상해 보세요. 친구의 얼굴이나 노을 같은 것을 상상하려고 할 때, 당신은 단순히 선반에서 책 한 권을 꺼내는 것이 아닙니다. 당신은 서로 연결된 일련의 관련 서적, 기억, 그리고 감정들이 모인 하나의 클러스터(덩어리)를 통째로 꺼내는 것입니다.
이 논문은 단순한 질문을 던집니다: 인간은 이러한 정신적 "책"들을 같은 방식으로 조직하는가, 그리고 AI 챗봇(대규모 언어 모델)도 같은 방식으로 하는가?
연구진은 인간은 이러한 정신적 이미지를 연결하는 방식에 있어 놀라울 정도로 유사하지만, AI 챗봇은 완전히 다르다는 사실을 발견했습니다.
실험: "상상력 테스트"
연구진은 수천 명의 실제 사람들과 6개의 서로 다른 AI 모델에게 두 가지 테스트를 실시했습니다:
- 시각 테스트 (VVIQ-2): 사람들에게 여덟 가지 특정 장면(떠오르는 태양, 기차역, 친구의 얼굴 등)을 상상하게 하고, 그 이미지가 마음속에서 얼마나 "생생하거나" 선명한지 점수를 매기게 했습니다.
- 감각 테스트 (PSIQ): 사람들에게 다양한 감각을 사용하여 사물을 상상하게 했습니다(타는 나무 냄새, 부드러운 털의 촉감, 종소리 듣기 등). 그리고 그 생생함을 점수로 매기게 했습니다.
연구진은 플로리다, 폴란드, 런던의 사람들을 대상으로 이 실험을 진행했습니다. 그 후, 여섯 가지 서로 다른 AI 모델(Llama와 Gemma의 버전 포함)에게도 정확히 동일한 테스트를 수행하도록 했습니다. 공정성을 기하기 위해, AI에게 "아판타시아(상상력이 없는 상태)"부터 "하이퍼판타시아(초생생한 상상력)"까지 다양한 "페르소나"를 부여하기도 했습니다.
발견: 인간의 "웹(Web)" vs AI의 "플랫라인(Flatline)"
1. 인간의 연결 (웹)
연구진이 인간의 답변들이 어떻게 연결되는지 살펴보았을 때, 강력하고 일관된 웹을 발견했습니다.
- 비유: 거미줄을 상상해 보세요. 만약 당신이 실 하나(예: "친구의 얼굴")를 튕기면, 전체 거미줄이 특정한 예측 가능한 패턴으로 진동합니다.
- 결과: 서로 다른 국가와 언어를 사용하는 인간들은 이러한 아이디어들을 동일한 방식으로 연결했습니다. 만약 당신이 "친구의 얼굴"을 매우 생생하다고 평가했다면, "국가 풍경" 또한 생생하게 평가할 가능성이 높았습니다. 이 "연결의 웹"은 플로리다의 사람이나 폴란드의 사람이나 동일했습니다.
- 이유: 논문은 이것이 우리의 뇌가 실제 삶의 경험을 바탕으로 구축되었기 때문이라고 설명합니다. 우리 모두는 일출을 보았고, 털의 촉감을 느꼈으며, 친구를 보았습니다. 우리의 기억은 우리가 실제로 그것들을 어떻게 경험했느냐에 따라 조직됩니다.
2. AI의 실패 (플랫라인)
AI의 답변을 살펴보았을 때, 이 "웹"은 끊어져 있었습니다.
- 비유: 아무것도 연결되지 않은 평평한 종이 한 장을 상상해 보세요. 혹은 모든 실이 다 끊어져 버린 거미줄을 상상해 보세요.
- 결과: AI 모델들은 인간과 같은 연결 패턴을 만들어내는 데 실패했습니다.
- AI는 "나무 타는 냄새"를 "따뜻함"과 연결하지 못했습니다.
- 많은 경우, AI의 답변은 모든 것이 모든 것과 똑같이 연결되어 있거나, 혹은 아무것도 연결되지 않은 하나의 엉망진창인 덩어리를 형성했습니다.
- AI에게 "기억"(대화 중 이전 답변을 기억하도록 지시하는 것)을 주었음에도 불구하고, 여전히 인간과 같은 구조의 웹을 구축하지 못했습니다.
- 규모는 중요하지 않았습니다: AI가 작든 크든(최대 2,720억 개의 파라미터) 상관없이, 그들은 모두 인간의 구조를 복제하는 데 실패했습니다.
왜 AI는 실패했을까?
논문은 영화 스튜디오 비유를 통해 흥미로운 설명을 제공합니다:
- 인간 (감독 + 제작진): 인간이 장면을 상상할 때, 그들은 실제로 영화 촬영장에 가본 적이 있는 영화 감독과 같습니다. 그들은 빛이 먼지에 어떻게 부딪히는지, 바람이 어떻게 느껴지는지, 배우들이 어떻게 움직이는지를 압니다. 왜냐นั้น 그들은 그것을 살아보았기 때문입니다. 인간의 상상은 "체화된 경험(embodied experience)" 위에 구축됩니다.
- AI (대본 읽는 사람): AI는 지금까지 쓰인 모든 영화 대본을 읽었지만, 촬영장에는 발을 들여놓은 적이 없는 사람과 같습니다. 그들은 대본에서 "일출"과 "따뜻함"이라는 단어가 함께 등장한다는 것을 압니다. 그들은 일출에 대해 설득력 있는 묘사를 쓸 수 있습니다. 하지만 그들은 살아있는 마음속에서 이러한 개념들이 실제로 어떻게 연결되는지에 대한 내부적인 지도를 가지고 있지 않습니다.
AI는 상상의 어휘는 알고 있지만, 기억의 구조는 결여되어 있습니다.
"중간성(Betweenness)"의 놀라운 점
연구진은 "중간성(Betweenness)"이라고 불리는 특정 유형의 연결, 즉 두 가지 다른 아이디어 사이에서 다리 역할을 하는 아이디어들을 살펴보았습니다.
- 인간: 이 다리 구조는 불안정하며 사람마다 달랐습니다.
- 이유: 논문은 이 "다리"가 개인의 삶의 이력에 의존하기 때문이라고 제안합니다. 누군가에게는 "비"가 "슬픔"과 연결될 수 있지만, 다른 누군가에게는 "기쁨"과 연결될 수 있습니다. 모든 사람의 삶은 다르기 때문에, 주요 웹 구조는 유지되더라도 이러한 다리들은 매우 다양하게 나타납니다.
요점
- 인간: 우리 모두는 동일한 물리적 세계에서 살아가고 몸을 통해 경험하기 때문에, 상상이 작동하는 방식에 있어 유사한 "정신적 지도"를 공유합니다.
- AI: 오늘날 가장 똑똑한 AI 모델들조차도 단지 텍스트를 기반으로 단어를 매우 잘 추측하는 것뿐입니다. 그들은 실제로 무엇인가를 살아본 것이 아니기에, 인간이 기억과 상상을 조직하는 깊고 구조적인 방식을 복제할 수 없습니다.
핵심 요약: AI가 상상력에 대해 설득력 있게 말할 수 있다고 해서, 그것이 우리와 같은 방식으로 "상상"한다는 뜻은 아닙니다. 그것은 케이크 레시피를 읽는 것과 실제로 케이크를 맛보는 것의 차이와 같습니다. AI는 레시피를 완벽하게 알고 있지만, 그 케이크가 어떤 느낌인지는 알지 못합니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.