← 최신 논문
🤖 AI

VERDI: VLM-Embedded Reasoning for Autonomous Driving

이 논문은 거대한 비전 - 언어 모델 (VLM) 의 추론 능력을 실시간 추론 비용 없이 자율주행 시스템에 내재화하기 위해, VLM 의 텍스트 기반 추론 특징과 자율주행 모듈의 중간 출력을 정렬하는 'VERDI'라는 훈련 프레임워크를 제안하고, 이를 통해 기존 방법보다 우수한 주행 성능과 빠른 추론 속도를 달성했음을 보여줍니다.

원저자: Bowen Feng, Zhiting Mei, Julian Ost, Filippo Ghilotti, Baiang Li, Roger Girgis, Anirudha Majumdar, Felix Heide

게시일 2026-04-07
📖 3 분 읽기☕ 가벼운 읽기

원저자: Bowen Feng, Zhiting Mei, Julian Ost, Filippo Ghilotti, Baiang Li, Roger Girgis, Anirudha Majumdar, Felix Heide

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

VERDI: 자율주행차에 '생각하는 뇌'를 심어주다

이 논문은 VERDI라는 새로운 기술을 소개합니다. VERDI는 자율주행차가 단순히 길을 따라가는 '로봇'이 아니라, 인간처럼 **상황을 이해하고 논리적으로 판단하는 '운전자'**가 되도록 돕는 방법입니다.

이 복잡한 내용을 일상적인 비유로 쉽게 설명해 드리겠습니다.


1. 문제: 왜 지금의 자율주행차는 '머리'가 없을까?

지금까지의 자율주행 기술은 **'경험 많은 운전사'**를 모방하는 방식이었습니다.

  • 비유: 마치 무작정 따라 하는 학생과 같습니다. 선생님이 (데이터) "이렇게 핸들을 돌려"라고 하면 그대로 따라 합니다.
  • 한계: 하지만 예상치 못한 상황 (예: 갑자기 튀어나온 개, 비정상적으로 운전하는 차) 이 생기면, "왜?"라는 질문을 할 수 없어 당황하거나 사고를 냅니다.
  • 기존의 시도 (VLM): 최근에는 거대한 인공지능 (VLM) 을 차에 직접 태워 "이건 뭐야? 어떻게 해야 해?"라고 물어보게 했습니다. 하지만 이 거대 AI 는 머리가 너무 커서 (메모리 160GB 이상 필요) 차에 실을 수 없고, 생각하는 속도가 너무 느려 (초당 8 단어) 실제 도로에서는 위험합니다.

2. 해결책: VERDI의 '지식 전수' 방식

저자들은 **"거대한 AI 를 차에 싣지 말고, 그 AI 가 가진 '생각하는 법'만 차에 심자"**라고 제안합니다. 이를 VERDI라고 부릅니다.

  • 핵심 비유: '명문대 교수 (거대 AI)'와 '신입 사원 (자율주행차)'
    • 교수 (거대 AI): 차를 직접 운전하지는 않지만, 수만 번의 시뮬레이션을 통해 "왜 이 차가 멈추는지", "왜 저기서 우회전해야 하는지"에 대한 완벽한 논리와 상식을 가지고 있습니다.
    • 신입 사원 (자율주행차): 실제 운전을 담당하지만, 아직 경험이 부족합니다.
    • VERDI의 역할: 교수는 직접 운전대에 앉지 않습니다. 대신 훈련 시간에 신입 사원에게 "이런 상황에서는 이렇게 생각해야 해"라고 **논리 과정 (Reasoning)**을 가르칩니다.
    • 결과: 훈련이 끝나면 교수는 사라지고, 신입 사원만 남습니다. 하지만 신입 사원은 이제 교수의 '생각하는 법'을 완전히 체득했기 때문에, 교수 없이도 인간처럼 똑똑하게 운전할 수 있습니다.

3. VERDI가 어떻게 작동하나요? (3 단계 학습)

VERDI는 운전의 3 가지 핵심 단계를 거대 AI 와 연결하여 학습시킵니다.

  1. 지각 (Perception) - "눈으로 보는 것"

    • 상황: 차 앞의 카메라로 주변을 봅니다.
    • 교수의 조언: "저기 흰색 트럭이 있고, 왼쪽에 파란색 차단기가 있어. 그리고 사람이 건너가고 있구나."
    • 학습: 자율주행차가 이 설명을 들으며, 단순히 '물체'를 감지하는 것을 넘어 **'상황의 의미'**를 이해하도록 훈련합니다.
  2. 예측 (Prediction) - "앞으로 일어날 일"

    • 상황: 다른 차들이 어떻게 움직일지 예측합니다.
    • 교수의 조언: "흰색 트럭은 앞으로 갈 거야. 하지만 그 옆의 오픈 트럭은 멈춰 있을 거야. 사람이 길을 건너고 있으니 조심해야 해."
    • 학습: 자율주행차가 "아, 저 차는 멈추겠구나"라고 논리적으로 추론하는 능력을 배웁니다.
  3. 계획 (Planning) - "내가 할 일"

    • 상황: 최종적으로 핸들을 어떻게 돌릴지 결정합니다.
    • 교수의 조언: "사람이 건너가니까 천천히 가다가, 왼쪽으로 살짝 꺾어서 지나가자."
    • 학습: 자율주행차가 단순히 경로만 그리는 게 아니라, 그렇게 움직여야 하는지 이유를 내포한 상태로 경로를 계획합니다.

4. 왜 이것이 중요한가요? (장점)

  • ⚡ 빠른 속도: 거대한 AI 를 실시간으로 실행할 필요가 없습니다. 훈련된 '신입 사원'만 운전하므로 매우 빠릅니다. (기존 방법보다 10 배 이상 빠름)
  • 🛡️ 안전성: 단순히 데이터를 외운 것이 아니라 **상식 (Common Sense)**을 배웠기 때문에, 훈련 데이터에 없던 낯선 상황 (예: 갑자기 튀어나온 동물, 비정상적인 운전) 에서도 사고를 피할 확률이 10% 이상 높아집니다.
  • 🧠 해석 가능성: "왜 멈췄어?"라고 물으면, "사람이 길을 건널 것 같아서"라고 이유를 설명할 수 있습니다. (기존 모델은 이유를 모르고 멈췄음)

5. 결론: VERDI의 미래

이 논문은 **"거창한 AI 를 차에 싣는 것"**이 아니라, **"AI 의 지혜를 차의 뇌에 주입하는 것"**이 자율주행의 핵심이라고 말합니다.

마치 명문대 교수에게 1 년간 사사 (멘토링) 를 받은 후, 교수 없이도 독립적으로 명석한 판단을 내리는 젊은 변호사가 된 것과 같습니다. VERDI는 자율주행차가 이제부터 단순한 기계가 아니라, **상황을 이해하고 논리적으로 운전하는 진정한 '운전자'**가 될 수 있음을 증명했습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →