GRASP: Granularity-Aware Region Alignment and Semantic Prototype Learning for Fine-Grained Cross-Modal Understanding in Drone Views
تقترح الورقة البحثية إطار عمل GRASP، وهو إطار عمل مبتكر يعالج تحديات الفوضى في الخلفية والتماثل البصري في الفهم عبر الوسائط متعددة الأنماط دقيق التفاصيل من منظور الطائرات بدون طيار، وذلك من خلال المحاذاة المرتكزة على المناطق من أجل المطابقة المتمحورة حول الأشياء، والمطابقة المعززة بالاضطراب الدلالي من أجل التعلم الدلالي التمييزي، محققاً أداءً تنافسياً في الاختبارات المرجعية الجوية.