← 최신 논문
🤖 AI

Taming the Centaur(s) with LAPITHS: a framework for a theoretically grounded interpretation of AI performances

이 논문은 CENTAUR 과 같은 AI 모델이 인간과 유사한 인지를 갖는다는 주장의 이론적 타당성에 의문을 제기하기 위해 LAPITHS 프레임워크를 도입하며, 오히려 이러한 모델의 성능은 진정한 인지적 타당성보다는 행동주의적 패턴에서 비롯된다고 주장한다.

원저자: Matteo Da Pelo, Alessio Donvito, Claudio Frongia, Pietro Salis, Antonio Lieto

게시일 2026-05-01
📖 5 분 읽기🧠 심층 분석

원저자: Matteo Da Pelo, Alessio Donvito, Claudio Frongia, Pietro Salis, Antonio Lieto

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

다음은 "라피스스로 켄타우루스를 길들이다"라는 논문에 대한 설명을 창의적인 비유를 곁들여 쉬운 언어로 번역한 것입니다.

큰 그림: "켄타우루스" 대 "라피스"

켄타우루스라는 이름의 새롭고 초지능적인 AI 를 상상해 보세요. 그 제작자들은 이것이 "인지의 통합 모델"이라고 주장합니다. 쉬운 말로 바꾸면 다음과 같습니다. "우리는 이 AI 에게 인간 행동을 완벽하게 모방하도록 가르쳤기 때문에, 이것이 인간처럼 생각할 수밖에 없습니다. 이는 단순한 계산기가 아니라 디지털 마음입니다."

하지만 이탈리아의 연구진으로 구성된 이 논문의 저자들은 **"잠시만 기다려 보십시오"**라고 말합니다.

그들은 고대 그리스에서 켄타우루스와 싸웠던 전사들의 이름을 딴 LAPITHS라는 프레임워크를 소개합니다. 그들의 임무는 켄타우루스에 대한 과대포장을 "길들이는" 것입니다. 그들은 AI 가 인간처럼 행동한다고 해서 인간처럼 생각한다는 뜻은 아니라고 주장합니다. 그들은 행동(성능) 과 사고(인지) 를 분리하고자 합니다.


핵심 문제: "귀속의 오류"

이 논문은 귀속의 오류 (Ascription Fallacy) 라는 논리적 함정을 지적합니다.

비유:
체스를 완벽하게 모방하는 로봇이 있다고 가정해 보세요. 말판을 움직이고, "생각"하는 듯 멈추며, 심지어 피곤할 때 인간이 저지르는 실수와 똑같은 실수를 합니다.

  • 오류: 당신은 로봇을 보고 "와, 이건 인간과 똑같은 뇌를 가졌군! 전략을 이해하고 게임의 압박감을 느끼는 거야"라고 말합니다.
  • 현실: 그 로봇은 단지 수백만 개의 체스 게임을 외운 초고속 계산기일 뿐일 수 있습니다. 그것은 무엇을 "이해"하지 않으며, 단지 패턴에 기반해 다음 수를 예측할 뿐입니다.

저자들은 켄타우루스가 바로 이 체스 로봇이라고 주장합니다. 켄타우루스는 인간의 결정에 대한 방대한 데이터셋 (Psych-101) 으로 훈련되었습니다. 인간이 무엇을 할지 예측하도록 훈련받았기 때문에, 인간 행동을 매우 잘 예측합니다. 하지만 저자들은 이것이 단순한 행동 모방일 뿐 인지적 정렬은 아니라고 주장합니다.

도구: "최소 인지 그리드 (MCG)"

주장을 입증하기 위해 저자들은 최소 인지 그리드 (Minimal Cognitive Grid, MCG) 라는 점수표를 만들었습니다. 이는 단순히 질문에 얼마나 잘 답하는지뿐만 아니라 세 가지 요소를 평가하는 "인지 진리 탐지기"라고 생각하시면 됩니다.

  1. 구조 대 기능 (The "How"):

    • 질문: AI 는 인간 뇌와 동일한 내부 "기어"를 사용하는가?
    • 발견: 인간은 점진적으로 학습합니다 (실시간으로 시행착오를 겪음) 그리고 제한된 작업 기억을 가집니다 (머릿속에 몇 가지 정보만 유지 가능). 반면 켄타우루스는 배치 단위로 훈련되었습니다 (한 번에 책 전체를 읽는 것처럼) 그리고 거대한 "컨텍스트 창"을 가집니다 (대화 내용을 모두 기억함).
    • 판단: 켄타우루스는 이 테스트에서 실패합니다. 인간처럼 행동하지만, 내부 엔진은 완전히 다릅니다. 마치 새처럼 날지만 날개를 퍼덕이는 대신 제트 엔진을 사용하는 비행기 같습니다.
  2. 일반성 (The "Scope"):

    • 질문: 다양한 유형의 사고를 수행할 수 있는가?
    • 발견: 켄타우루스는 수학, 추론, 언어에 능합니다. 하지만 단일 모드 (unimodal) 이므로 텍스트만 처리합니다. 볼 수 있는 눈도, 만질 수 있는 손도, 움직일 수 있는 몸도 없습니다.
    • 판단: 부분 점수를 받습니다. 똑똑하지만, 인간의 "구체화된 (embodied)" 경험을 결여하고 있습니다.
  3. 성능 일치 (The "Result"):

    • 질문: 올바른 답을 내고, 같은 실수를 하며, 같은 시간을 소비하는가?
    • 발견: 켄타우루스는 이 부분에서 뛰어납니다. 인간의 선택을 거의 완벽하게 예측할 뿐만 아니라 인간의 실수 패턴까지 모방합니다.
    • 판단: 여기서 높은 점수를 받습니다. 하지만 저자들은 경고합니다: 여기서 높은 점수를 받았다고 해서 우리가 생각하듯 생각한다는 증거는 아닙니다.

최종 점수: 이들을 종합하면 켄타우루스의 "인지 가능성" 점수는 낮습니다. 이는 훌륭한 에뮬레이터(완벽한 배우) 이지만, 열악한 인지 모델(진정한 사고자) 입니다.

실험: "누구든 이를 할 수 있는가?"

켄타우루스가 특별하지 않음을 입증하기 위해 연구진은 테스트를 수행했습니다. 인간 데이터로 훈련되지 않은 다른 다섯 가지 강력한 AI 모델 (GPT-4, Gemini 등) 을 가져왔습니다.

이들에게 간단한 지시를 내렸습니다. "여기 게임의 규칙이 있습니다. 여기 발생한 역사가 있습니다. 이제 인간이라면 무엇을 하겠습니까?"(이를 RAG 또는 검색 증강 생성이라고 합니다).

결과:

  • 이 "훈련되지 않은" 모델들은 켄타우루스와 거의 동일한 성능을 발휘했습니다.
  • 어떤 경우에는 성능 차이가 통계적으로 무의미할 정도로 미미했습니다.
  • 비유: 배우들에게 대본을 주는 것과 같습니다. 켄타우루스는 대본을 완벽하게 외운 배우입니다. 하지만 같은 대본을 다른 배우들에게 주면, 그들도 사전에 책 전체를 외우지 않고도 대사를 거의 완벽하게 연기할 수 있습니다.

결론: 인간 행동을 모방하기 위해 "특별한" 인지 모델이 필요한 것이 아닙니다. 똑똑한 언어 모델과 올바른 지시만 있으면 됩니다.

뇌 스캔 테스트 (fMRI)

켄타우루스의 제작자들은 훈련 후 AI 의 "내부 사고"(신경 표현) 가 인간 뇌 스캔 (fMRI 데이터) 과 유사해지기 시작했다고 주장했습니다. 이는 AI 가 "뇌와 유사한" 존재가 되었다는 증거라고 했습니다.

저자들은 이것도 테스트했습니다. 다른 AI 모델들에게 작업 설명만 읽고 특정 작업에 대한 뇌 활동이 어떻게 보일지 추측하도록 요청했습니다.

결과:

  • 다른 모델들도 인간 뇌 스캔과 높은 상관관계를 보이는 추측을 내놓았습니다.
  • 비유: 만약 사람들에게 "공포"의 느낌을 묘사해 달라고 하면, 그들은 모두 비슷한 단어 (심장 박동, 땀) 를 사용할 수 있습니다. 이것이 그들이 모두 정확히 동일한 생물학적 공포 메커니즘을 가지고 있다는 뜻은 아닙니다. 단지 모두 같은 개념을 묘사하고 있다는 뜻일 뿐입니다.
  • 저자들은 뇌 스캔의 높은 상관관계는 제작자들이 인정하는 것보다 얻기 쉽다고 주장합니다. 이는 AI 가 뇌를 가졌다는 증거가 아니라, 단지 작업의 개념을 이해한다는 증거일 뿐입니다.

최종 교훈

이 논문은 AI 세계에 다음과 같은 경고를 남깁니다.

  • 지도와 영토를 혼동하지 마십시오. AI 가 인간 행동의 완벽한 지도를 그렸다고 해서 (우리가 무엇을 할지 예측한다고 해서), AI 가 그 영토 (인간 마음) 그 자체라는 뜻은 아닙니다.
  • 켄타우루스는 훌륭한 예측자이지만, 약한 설명자입니다. 이는 인간이 다음에 무엇을 할지 추측하는 데 탁월한 도구입니다. 하지만 인간이 왜 그렇게 생각하는지 이유를 설명하는 데 사용할 수는 없습니다. 그 내부 기구가 우리와 근본적으로 다르기 때문입니다.
  • 더 나은 테스트가 필요합니다. "올바른 답을 얻었는가?"라고 묻는 것을 멈추고, "인간의 정신 기어와 동일한 방식으로 올바른 답을 얻었는가?"라고 묻기 시작해야 합니다.

요약하자면: 켄타우루스는 숙련된 배우이지만, 인간은 아닙니다. 저자들은 우리가 그 연기에 속지 않도록 LAPITHS라는 프레임워크를 구축했습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →