Towards Calibrating Prompt Tuning of Vision-Language Models
تقترح هذه الورقة إطار عمل للمعايرة لنماذج الرؤية واللغة المضبطة عبر التلقين (prompt-tuned)، والتي تعزز موثوقية التنبؤ من خلال إدخال منظمات هامش متوسط التباين ومطابقة عزم النص لاستقرار هوامش اللوجيت والحفاظ على هندسة فضاء التضمين مسبق التدريب، مما يقلل بشكل كبير من خطأ المعايرة المتوقع عبر مجموعات بيانات متنوعة.