← 최신 논문
💻 computer science

Mitigating Hallucinations in Large Vision-Language Models via Causal Route Gating

본 논문은 시각적 증거를 유지하면서 텍스트 우세 경로를 선택적으로 억제하기 위해 어텐션 헤드를 시각 및 텍스트 경로로 분해하여 대규모 비전 - 언어 모델의 환각을 완화하는 학습 없는 개입인 인과적 경로 게이트를 제안합니다.

원저자: Zhe Cheng, Wenyu Chen, Fode Zhang, Dehuan Shen

게시일 2026-05-26
📖 3 분 읽기☕ 가벼운 읽기

원저자: Zhe Cheng, Wenyu Chen, Fode Zhang, Dehuan Shen

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

거대 시각-언어 모델 (LVLM) 을 매우 똑똑하지만 약간은 지나치게 자신감 넘치는 미술 평론가로 상상해 보세요. 이 평론가는 그림 (이미지) 을 보고 아름답고 유창한 문장으로 묘사할 수 있습니다. 하지만 때로는 일반적인 지식에 기반한 '예상'에 너무 매료되어 실제로 존재하지 않는 것까지 묘사하곤 합니다. 이를 **환각 (hallucination)**이라고 합니다.

예를 들어, 검은색 바나나 사진을 이 평론가에게 보여주면, 훈련 데이터에서 바나나는 거의 항상 노란색이기 때문에 자신 있게 "바나나는 노란색입니다"라고 말할 수 있습니다. 이는 실제 시각적 증거를 무시하고 '텍스트적 사전 지식 (textual priors)' (즉, 있어야 한다고 생각하는 것) 을 우선시하는 것입니다.

문제: 뇌 내부의 줄다리기

이 논문은 이러한 현상이 숨겨진 내부 갈등 때문에 발생한다고 주장합니다. 모델의 '뇌' (특히 주의 메커니즘 내부) 에서는 매 결정마다 두 가지 뚜렷한 경로가 작동합니다.

  1. 시각 경로 (The Visual Route): 이 경로는 이미지의 실제 픽셀을 봅니다.
  2. 텍스트 경로 (The Text Route): 이 경로는 언어 패턴과 일반 지식에 의존합니다.

보통 이 두 경로는 협력합니다. 하지만 환각이 발생할 때는 텍스트 경로가 시각 경로를 압도하며 줄다리기를 이깁니다. 모델은 검은색 바나나를 보지만, 텍스트 경로가 "바나나는 노란색이다!"라고 외치면, 모델은 눈이 아닌 그 외침에 귀를 기울입니다.

해결책: '인과적 경로 게이트 (Causal Route Gate)'

저자들은 **인과적 경로 게이트 (CRG)**라는 교묘하고 재학습이 불필요한 해결책을 제안합니다. 이는 모델이 말하는 동안 실시간으로 작동하는 스마트한 교통 관제사를 모델 내부에 설치하는 것과 같습니다.

다음은 단계별 작동 방식입니다.

1. '만약에' 테스트 (인과적 측정)
모델이 단어를 확정하기 전에 시스템은 빠르고 보이지 않는 테스트를 실행합니다. 다음과 같은 질문을 던집니다.

  • "시각 경로를 잠시 끄면 답변이 변할까요?"
  • "텍스트 경로를 잠시 끄면 답변이 변할까요?"

이를 통해 각 경로의 실제 힘을 파악할 수 있습니다. 텍스트 경로가 '노란색'을 주장하는 반면 시각 경로가 '검은색'을 주장한다면, 시스템은 갈등을 감지합니다.

2. '시각 의존도 지수 (Visual Reliance Index, VRI)'
시스템은 모델 내의 모든 내부 '채널' (헤드라고 함) 에 대해 점수를 계산합니다. 이 점수는 해당 채널이 텍스트보다 이미지에 얼마나 의존하는지를 알려줍니다.

  • 채널이 주로 이미지를 무시하고 텍스트에 집중한다면 낮은 점수를 받습니다.
  • 채널이 이미지에 집중한다면 높은 점수를 받습니다.

3. 선택적 음소거 버튼 (게이팅)
이것이 마법 같은 부분입니다. 전체 채널을 끄는 것 (이는 유용한 정보를 잃을 수 있음) 대신, 시스템은 텍스트 경로에 특화된 볼륨 조절기를 적용합니다.

  • 경미한 갈등: 텍스트가 약간만 소란스럽다면 시스템은 텍스트 볼륨을 약간 낮춥니다.
  • 강력한 갈등: 텍스트가 검은색 바나나가 노란색이라고 강하게 주장하는 것처럼 거짓말을 한다면, 시스템은 텍스트 경로를 거의 완전히 음소거합니다.
  • 중요하게도: 시각 경로는 건드리지 않고 최대 볼륨으로 유지됩니다.

결과: 더 정직한 평론가

시각적 증거와 충돌할 때만 '지나치게 자신감 넘치는' 텍스트 경로를 선택적으로 침묵시킴으로써, 모델은 실제로 보는 것에 의존하도록 강제됩니다.

  • 이전: "바나나는 노란색입니다." (환각)
  • 이후: "바나나는 검은색입니다." (정확)

이것이 특별한 이유

  • 재학습 불필요: 모델을 다시 가르칠 필요가 없습니다. 질문을 답할 때 사고 방식을 조정하기만 하면 됩니다.
  • 정밀성: 기존 방법들은 환각을 해결하기 위해 전체 '뇌'의 볼륨을 낮추거나 주의가 어디로 향하는지 대략적으로 추측했습니다. 이 방법은 외과 의사와 같습니다. 문제를 일으키는 정확한 작은 전선 (특정 갈등 상황에서의 텍스트 경로) 을 찾아 그 전선만 잘라내며, 뇌의 나머지는 건강하게 둡니다.
  • 효율성: 사고 과정에 아주 적은 시간만 추가됩니다 (일반적인 경우보다 약 2 배 느리지만, 다른 복잡한 해결책들보다는 훨씬 빠름). 이로 인해 실제 사용에 실용적입니다.

요약하자면, 이 논문은 두 가지가 불일치할 때 모델이 기억보다 눈을 신뢰하도록 가르쳐, 모델이 말하는 것이 실제로 보고 있는 이미지에 기반하도록 보장합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →