Understanding Pruning Regimes in Vision-Language Models Through Domain-Aware Layer Selection
تقدم هذه الورقة طريقة لاختيار الطبقات مدركة للمجال لتقليم نماذج الرؤية واللغة تستفيد من تشابه التنشيط لتحديد طبقات فك التشفير الحرجة، مما يكشف عن بنية تقليم ثلاثية الأنماط حيث تضمن التصنيفات الخاصة بالمجال الاستقرار عند الميزانيات المنخفضة بينما تطابق الخطوط المرجعية الهيكلية عند الميزانيات الأعلى.