Finetune Like You Pretrain: Boosting Zero-shot Adversarial Robustness in Vision-language Models
تقترح هذه الورقة البحثية AdvFLYP، وهو نموذج جديد للضبط الدقيق الخصمي لنماذج الرؤية واللغة يحاكي وصفة التدريب المسبق الأصلية باستخدام أزواج الصور والنصوص المجموعة من الويب مع فقد التباين وتنظيم الميزات، مما يعزز بشكل كبير المتانة الخصمية في حالة الصفر والقدرة على النقل عبر مجالات متنوعة دون المساس بالدقة في الحالات الطبيعية.