Rethinking Bottlenecks in Safety Fine-Tuning of Vision Language Models
تعالج هذه الورقة فجوة الاستدلال المتعلقة بالسلامة في النماذج اللغوية البصرية من خلال تقديم مجموعة بيانات السلامة متعددة الصور (MIS)، التي تدمج مدخلات متعددة الصور مع تسميات "سلسلة الأفكار" الخاصة بالسلامة لتعزيز قدرات الاستدلال البصري وأداء السلامة بشكل كبير مع الحفاظ على القدرات العامة للنموذج.