Linking Modality Isolation in Heterogeneous Collaborative Perception

이 논문은 이질적인 협업 지각에서 모달리티 격리를 해결하기 위해 공간적 중첩 없이도 다양한 모달리티 간의 특징을 정렬하는 새로운 프레임워크인 CodeAlign 을 제안하며, OPV2V 와 DAIR-V2X 데이터셋에서 기존 방법보다 훨씬 적은 파라미터와 통신 부하로 최첨단 성능을 달성함을 보여줍니다.

Changxing Liu, Zichen Chao, Siheng Chen2026-03-03💻 cs

Exploring Spatiotemporal Feature Propagation for Video-Level Compressive Spectral Reconstruction: Dataset, Model and Benchmark

이 논문은 동적 초분광 영상 재구성을 위해 최초의 고화질 동적 데이터셋 (DynaSpec) 과 시공간 특징 전파를 활용한 효율적인 트랜스포머 모델 (PG-SVRT) 을 제안하고, 이를 통해 기존 이미지 기반 방법의 한계를 극복하여 재구성 품질과 시간적 일관성을 동시에 향상시켰음을 보여줍니다.

Lijing Cai, Zhan Shi, Chenglong Huang + 6 more2026-03-03💻 cs

Stateful Cross-layer Vision Modulation

이 논문은 기존 멀티모달 모델의 시각적 특징 융합 한계를 극복하기 위해, 재귀적 메모리 상태와 피드백 조절 메커니즘을 통해 시각 표현의 진화 경로를 구조적으로 제어하는 'SCVM' 프레임워크를 제안하며, 언어 모델을 수정하거나 추가 학습 없이도 다양한 벤치마크에서 일관된 성능 향상을 달성함을 보여줍니다.

Ying Liu, Yudong Han, Kean Shi + 1 more2026-03-03💻 cs

Act Like a Pathologist: Tissue-Aware Whole Slide Image Reasoning

이 논문은 병리학자가 슬라이드를 분석할 때 보이는 조직을 먼저 파악한 후 세부 영역을 선택적으로 확대하는 인간의 방식을 모방하여, 질문 기반의 조직 인식 및 coarse-to-fine 검색 프레임워크인 HistoSelect 를 제안함으로써 전체 슬라이드 이미지 기반의 병리학 질문 응답 정확도를 높이고 시각 토큰 사용량을 대폭 줄인다고 요약할 수 있습니다.

Wentao Huang, Weimin Lyu, Peiliang Lou + 8 more2026-03-03💻 cs

Specializing Foundation Models via Mixture of Low-Rank Experts for Comprehensive Head CT Analysis

이 논문은 다양한 의료 영상 기반 모델에서 종합적인 두부 CT 진단 성능을 향상시키기 위해 단일 LoRA 적응을 넘어 여러 전문화된 저랭크 어댑터와 비지도 소프트 라우팅을 결합한 '혼합 저랭크 전문가 (MoLRE)' 프레임워크를 제안하고, 7 만 건 이상의 두부 CT 데이터를 활용한 광범위한 벤치마킹을 통해 그 유효성을 입증합니다.

Youngjin Yoo, Han Liu, Bogdan Georgescu + 14 more2026-03-03💻 cs

Stroke outcome and evolution prediction from CT brain using a spatiotemporal diffusion autoencoder

이 논문은 확산 확률 모델을 활용하여 CT 뇌 영상을 기반으로 뇌졸중의 진행과 결과를 예측하는 자기지도식 시공간 표현을 개발하고, 5,824 개의 CT 영상을 포함한 대규모 데이터셋에서 내일 중증도 및 퇴원 시 기능적 결과를 예측하는 데 있어 기존 방법보다 뛰어난 성능을 입증했습니다.

Adam Marcus, Paul Bentley, Daniel Rueckert2026-03-03🤖 cs.AI