← 최신 논문
💻 computer science

Multimodal Driver Visual Load Assessment and Prediction under Dynamic Lighting Environments Using RaceGrid-OPTICS and WA-PSRSMformer

본 연구는 터널 환경에서 90.13%의 정확도를 달 alone 달성하며, 동적 조명 조건 하에서 운전자의 시각적 부하를 정확하게 평가하고 예측하기 위해 안구 운동, 조도 및 차량 속도 데이터를 새로운 RaceGrid-OPTICS 클러스터링 알고리즘 및 WA-PSRSMformer 딥러닝 모델과 결합한 다중 모달 프레임워크를 제안한다.

원저자: Noman Iqbal, Yishui Zhu, Fenjiao Wang, Luyang Wang

게시일 2026-09-25
📖 4 분 읽기☕ 가벼운 읽기

원저자: Noman Iqbal, Yishui Zhu, Fenjiao Wang, Luyang Wang

원본 논문은 CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. ✨ 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

운전은 인간의 정신과 도로 사이에서 끊임없이 벌어지는 협상 행위입니다. 우리 대부분에게 이 협상은 의식적인 생각 없이 이루어지지만, 이는 시각이라는 하나의 감각에 크게 의존합니다. 빛이 갑자기 변할 때—햇빛이 내리쬐는 밝은 고속도로에서 어두운 터널 내부로 들어서거나, 나무 그림자가 앞 유리에 빠르게 깜빡이며 지나가는 구간을 주행할 때—눈과 뇌는 적응하기 위해 과도하게 작동해야 합니다. 이러한 갑작스러운 시각적 정보의 요구는 '시각적 부하(visual load)'라고 알려진 상태를 만들어냅니다. 이는 눈이 보는 것을 처리하기 위해 필요한 정신적 노력입니다. 이 부하가 너무 무거워지면, 위험을 인지하고 형상을 식별하며 위험에 반응하는 운전자의 능력이 떨어질 수 있으며, 이는 일상적인 주행을 잠재적인 위험으로 바꿀 수 있습니다. 우리는 이러한 조명 변화가 위험하다는 것을 알고 있지만, 이것이 운전자에게 실시간으로 정확히 어느 정도의 정신적 스트레스를 주는지 측정하는 것은 그동안 어려움이 있었습니다.

창안대학교(Chang'an University)의 연구팀은 이 보이지 않는 정신적 노력을 들여다볼 수 있는 새로운 방법을 개발했습니다. 그들은 단순히 발생하는 시각적 부하를 측정할 뿐만 아니라, 복잡하고 변화하는 빛 속에서 주행하는 동안 부하가 언제 급증할지를 예측할 수 있는 시스템을 구축하고자 했습니다. 이를 위해 그들은 통제된 인공 환경인 드라이빙 시뮬레이터를 넘어 실제 도로로 실험을 옮겼습니다. 연구진은 10명의 운전자를 모집하고 표준 세단에 일련의 센서를 장착했습니다. 운전자가 어디를 보고 있고 동공이 어떻게 반응하는지를 추적하는 웨어러블 카메라, 전방의 도로를 기록하는 대시보드 카메라, 그리고 주변의 정확한 밝기를 측정하는 조도계를 사용했습니다. 운전자들은 세 가지 뚜렷한 시나리오를 주행했습니다: 일정한 빛이 유지되는 길고 곧은 도로, 햇빛이 나무 사이로 깜빡이며 지나가는 그늘진 구간, 그리고 밝은 낮에서 어둠으로, 다시 밝음으로 빛이 급격하게 변하는 터널입니다.

연구진은 운전자의 눈 움직임을 변화하는 빛 및 차량 속도와 동기화하여 방대한 양의 데이터를 수집했습니다. 그들은 동공의 크기와 변화 속도를 비롯하여, 시선이 어디에 고정되었는지, 그리고 얼마나 자주 새로운 지점으로 이동했는지와 같은 특정 생체 신호에 집중했습니다. 이러한 신호들은 뇌의 작업량에 대한 신체의 정직한 반응입니다. 눈이 갑작스러운 빛의 변화에 적응하려고 애쓸 때, 동공과 시선 패턴은 예측 가능한 방식으로 변화합니다. 그러나 이 가공되지 않은 숫자들의 흐름을 '높은 부하' 또는 '낮은 부하'라는 명확한 그림으로 바꾸는 것은 복잡한 퍼즐입니다. 연구팀은 먼저 정교한 방법을 사용하여 유사한 패턴들을 그룹화함으로써, 사전에 설정된 규칙에 의존하지 않고도 컴퓨터가 편안한 주행과 스트레스가 많은 주행의 차이를 인식하도록 학습시켰습니다. 그 결과, 이 접근 방식이 데이터를 평온함에서 매우 높은 긴장 상태에 이르기까지 다섯 가지의 뚜렷한 단계로 성공적으로 분류할 수 있음을 발견했습니다.

시스템이 이러한 상태를 식별할 수 있게 되자, 연구진은 더 어려운 과제인 '예측'으로 눈을 돌렸습니다. 그들은 시스템이 현재의 데이터를 보고 몇 순간 뒤의 운전자 시각적 부하를 추측할 수 있는지 알고 싶었습니다. 그들은 이미지의 패턴을 포착하는 데 뛰어난 모델들과 시간의 흐름에 따른 사건의 순서를 기억하도록 설계된 모델들을 포함하여 여러 가지 서로 다른 컴퓨터 모델을 테스트했습니다. 가장 성공적인 접근 방식은 '트랜스포머(Transformer)'라고 불리는 일종의 인공지능 모델이었는데, 이는 하나의 사건이 긴 시퀀스 속에서 어떻게 다음 사건으로 이어지는지를 이해하는 데 특히 탁월합니다. 이 모델을 특정 주행 과제에 맞춰 더욱 개선하기 위해 연구팀은 세 가지 핵심적인 개선 사항을 추가했습니다. 첫째, 흔하게 발생하는 평온한 주행보다 드물게 발생하지만 포착하는 것이 가장 중요한 고도의 스트레스 상황에 더 집중하도록 가르쳤습니다. 둘째, 불필요한 계산으로 인해 데이터 처리가 지연되지 않도록 내부 프로세스를 간소화했습니다. 마지막으로, 실제 자동차에서 발견될 수 있는 하드웨어에서도 효율적으로 실행될 수 있도록 메모리 사용량을 최적화했습니다.

실제 도로 테스트 결과는 놀라웠습니다. 빛이 급격히 변하는 가장 도전적인 환경인 터널에서, 이 새로운 시스템은 운전자의 시각적 부하를 90% 이상의 정확도로 예측했습니다. 이는 급격한 변화를 따라잡는 데 어려움을 겪었던 다른 모델들보다 현저히 우수한 성적이었습니다. 또한 이 시스템은 매우 효율적이어서, 기존 모델들이 필요로 했던 시간의 아주 일부분만으로 데이터를 처리할 수 있었는데, 이는 움직이는 차량 내에서 즉각적으로 작동해야 하는 기술에 있어 매우 중요한 요소입니다. 연구는 안구 추적 데이터, 조도 측정, 그리고 차량 속도의 조합이 운전자의 스트레스에 대한 완전한 그림을 제공한다는 것을 확인해 주었습니다. 또한 직선 도로는 일반적으로 예측하기 쉽지만, 터널에 진입하거나 터널에서 나오는 순간이 가장 복잡한 시각적 요구를 만들어내며, 종종 운전자를 시스템이 감지하고 예측할 수 있는 높은 부하 상태로 몰아넣는다는 것을 보여주었습니다.

이 연구는 단순히 스트레스를 측정하는 방법을 제시하는 것에 그치지 않고, 더 안전한 미래를 위한 청사진을 제공합니다. 조명 조건이 운전자의 시각을 어떻게 압박하는지 정확히 이해함으로써, 엔지니어들은 운전자가 압도당하기 전에 경고를 보내는 더 나은 경고 시스템을 설계할 수 있습니다. 이 시스템은 인간의 눈이 보이는 자연스러운 반응을 통해 실시간으로 운전의 보이지 않는 정신적 작업량을 모니터링하는 것이 가능하다는 것을 입증했습니다. 도로가 점점 더 복잡해지고 자율 주행 시스템이 더 많은 책임을 맡게 됨에 따라, 인간이라는 요소의 시각 및 반응 능력을 측정하는 신뢰할 수 있는 방법을 갖추는 것은 필수적일 것입니다. 연구진은 적절한 도구가 있다면 우리가 도로의 보이지 않는 부담을 볼 수 있으며, 이를 통해 그 부담이 너무 무거워져 발생하는 사고를 예방할 수 있다는 것을 보여주었습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →