RoiMAM: Region-of-Interest Medical Attention Model for Efficient Vision-Language Understanding
تقدم الورقة البحثية RoiMAM، وهو نموذج رؤية-لغة فعال ولا يتطلب تدريباً، يستفيد من توليد منطقة الاهتمام والكبح الدلالي الانتقائي لتحقيق دقة فائقة في مهام MedVQA على معايير SLAKE وPMC-VQA مع تقليل حجم النموذج بنسبة تزيد عن 80% مقارنة بـ MedVInT-TD.