Zero-Shot and Supervised Bird Image Segmentation Using Foundation Models: A Dual-Pipeline Approach with Grounding DINO~1.5, YOLOv11, and SAM~2.1
이 논문은 Grounding DINO 1.5 와 YOLOv11 을 탐지기로 활용하여 SAM 2.1 을 기반으로 한 제로샷 및 지도 학습 이중 파이프라인을 제안함으로써, 기존 종단간 학습 모델보다 우수한 성능을 보이는 새 이미지 분할 방법을 제시합니다.