Sign Language Recognition in the Age of LLMs
تستقصي هذه الورقة قدرة نماذج الرؤية واللغة (VLMs) على التعرف من الصفر (zero-shot) في مجال التعرف المنفصل على لغة الإشارة، كاشفةً أنه بينما تعاني النماذج مفتوحة المصدر الحالية من ضعف كبير مقارنة بالمصنفات المتخصصة، تُظهر النماذج المملوكة الأكبر حجماً توافقاً بصرياً-دلالياً واعداً يتحسن مع زيادة الحجم وتنوع البيانات.