Toward Autonomous Laboratory Safety Monitoring with Vision Language Models: Learning to See Hazards Through Scene Structure
تعالج هذه الورقة نقص بيانات التقييم البصري لمراقبة سلامة المختبرات ذاتية القيما عبر تقديم مسار لتوليد مجموعات البيانات الاصطناعية واقتراح طريقة محاذاة موجهة بمخطط المشهد، مما يحسن بشكل كبير قدرة النماذج اللغوية البصرية على اكتشاف المخاطر في الإعدادات البصرية فقط.