← 최신 논문
💬 NLP

How do Humans Process AI-generated Hallucination Contents: a Neuroimaging Study

본 신경영상 연구는 EEG 를 활용하여 인간 뇌가 AI 가 생성한 환각을 처리할 때 뚜렷한 신경 역학을 보임을 입증하고, 잘못 판단된 환각은 표준 신경인지적 사실 검증 경로를 활성화하지 못함을 밝혀냈습니다.

원저자: Shuqi Zhu, Yi Zhong, Ziyi Ye, Bangde Du, Yujia Zhou, Qingyao Ai, Yiqun Liu

게시일 2026-05-19
📖 3 분 읽기☕ 가벼운 읽기

원저자: Shuqi Zhu, Yi Zhong, Ziyi Ye, Bangde Du, Yujia Zhou, Qingyao Ai, Yiqun Liu

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

상상해 보세요. 당신의 뇌는 박물관에 근무하는 매우 정교한 보안 요원입니다. 그 요원의 임무는 모든 예술 작품 (이 경우 모든 문장) 을 점검하여 그것이 표현해야 할 현실과 일치하는지 확인하는 것입니다.

이 논문은 바로 그 보안 요원의 뇌를 '비하인드 스토리' 다큐멘터리처럼 보여주는 것으로, 전기 신호를 기록하는 특수 헬멧 (EEG) 을 사용했습니다. 연구자들은 AI 가 고양이의 사진을 보여줄 때 이를 '모자를 쓴 개'라고 묘사했을 때, 보안 요원의 뇌 내부에서 어떤 일이 일어나는지 확인하고자 했습니다.

그들이 발견한 내용을 간단한 단계로 나누어 이야기해 보겠습니다.

1. 설정: "거짓말 찾아내기" 게임

연구자들은 27 명의 참가자를 한 방에 모았습니다. 그들에게 사진을 보여주고 그 사진을 설명하는 문장을 제시했습니다. 때로는 문장이 사실이었으며, 때로는 AI 가 매우 설득력 있게 들리는 거짓말인 '환각 (hallucination)'을 만들어냈습니다.

참가자들은 "이 문장이 사진과 일치합니까?"라고 말하며 버튼을 눌러야 했습니다.

  • 진실 일치: 문장이 정확합니다.
  • 잡힌 거짓말: 문장이 틀렸고, 참가자가 "아니요, 그건 틀렸어요"라고 말했습니다.
  • 놓친 거짓말: 문장이 틀렸지만, 참가자는 "네, 그건 맞는 것 같아요"라고 생각했습니다.

2. 뇌의 '경보 시스템' (거짓말을 잡았을 때 일어나는 일)

참가자들이 AI 의 거짓말을 성공적으로 잡아냈을 때, 그들의 뇌는 경보 시스템이 점검 목록을 수행하듯 매우 구체적이고 빠른 속도의 일련의 과정을 거쳤습니다.

  • 초기 섬광 (100ms): 뇌의 '센서'가 즉시 점등되었습니다. 마치 보안 요원이 즉시 무언가 '어색한' 점을 알아차린 것과 같습니다. 이는 추가적인 주의와 정신 에너지를 필요로 했습니다.
  • '잠깐만' 순간 (200ms): 뇌가 그 단어를 의심스러운 것으로 표시했습니다. 마치 보안 요원이 "그건 장면과 맞지 않는데"라고 생각한 것과 같습니다.
  • 의미 확인 (400ms): 뇌는 그 단어를 이야기 속에 끼워 맞추려 했습니다. 그 단어가 사진과 맞지 않았기 때문에, 뇌는 그 충돌을 처리하기 위해 더 열심히 일해야 했습니다. 마치 네모난 못을 둥근 구멍에 억지로 끼워 넣으려는 것과 같아, 뇌는 마찰을 느꼈습니다.
  • 최종 검토 (600ms 이상): 뇌는 최종 재검토를 수행했습니다. 기억과 논리를 끌어와 "네, 이건 분명히 거짓말이다"라고 확인했습니다.

핵심 발견: 사람들이 거짓말을 잡았을 때, 그들의 뇌는 이 모든 뚜렷하고 강력한 신호들을 보여주었습니다. 이는 완전한 보안 경보 상태였습니다.

3. '침묵하는 실패' (거짓말을 놓쳤을 때 일어나는 일)

여기가 무서운 부분입니다. AI 의 거짓말이 너무 매끄럽고 설득력 있어서 사람이 놓쳤을 때, 뇌의 경보 시스템은 작동하지 않았습니다.

  • 뇌는 '잠깐만' 신호를 보여주지 않았습니다.
  • '의미 확인'의 고군분투를 보여주지 않았습니다.
  • '최종 검토'를 보여주지 않았습니다.

뇌에게 거짓말은 진실과 정확히 똑같이 보였습니다. 연구자들은 사람이 환각을 발견하지 못했을 때, 그들의 뇌 활동이 진실된 문장을 볼 때와 거의 동일하게 나타났음을 발견했습니다. '기만적인' AI 는 성공적으로 뇌의 내부 경보 시스템을 침묵 상태로 유지하도록 속였습니다.

4. 마음을 읽어 거짓말을 잡을 수 있을까요?

연구자들은 뇌 신호를 보고 "이 문장은 거짓말인가?"라고 추측할 수 있는 컴퓨터 프로그램을 만들어 보았습니다.

  • 사람이 거짓말을 잡았을 때: 컴퓨터는 매우 잘해냈습니다 (90% 이상 정확도). 뇌 신호가 크고 명확했습니다.
  • 사람이 거짓말을 놓쳤을 때: 컴퓨터는 완전히 실패했습니다. 뇌가 잘못된 점이 있다는 신호를 보내지 않았기 때문에 거짓말과 진실을 구별할 수 없었습니다.

큰 교훈

AI 환각을 매우 숙련된 마술사와 같다고 생각해 보세요.

  • 만약 마술사가 당신이 볼 수 있는 실수를 저지르면, 당신의 뇌는 "이봐, 저건 속임수야!"라고 외칩니다.
  • 하지만 마술사가 완벽하다면, 당신의 뇌는 심지어 속임수가 일어나고 있다는 사실조차 깨닫지 못합니다. 환상을 현실로 받아들이는 것입니다.

이 연구는 우리의 뇌가 무언가 잘못되었다는 것을 의식적으로 깨달을 때만 활성화되는 특정 '사실 확인' 경로가 있음을 보여줍니다. AI 가 그 의식적 깨달음을 우회할 만큼 충분히 좋다면, 우리의 뇌는 우리가 속았다는 사실조차 모릅니다.

이 논문이 말하지 않는 것:

  • 이 기술로 지금 당장 질병을 치료하거나 사람의 생각을 읽을 수 있다고 말하지 않습니다.
  • AI 가 '사악해'질 것이라고 주장하지 않습니다.
  • 단순히 우리가 거짓말을 성공적으로 발견할 때와 거짓말에 속았을 때 뇌가 취하는 전기적 단계를 매핑했을 뿐입니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →