'Ghaib in Translation' aka Unseen Harm: Measuring Cross-Script Safety Inconsistency with 'Missed-in-Urdu' Scores in LLM Hate Speech Detection
تكشف هذه الورقة أن النماذج اللغوية الكبيرة تظهر عدم اتساق ملحوظ في السلامة ومعدلات "فشل في الرصد باللغة الأردية" عند اكتشاف خطاب الكراهية بالأردية عبر مختلف النصوص، مما يسلط الضوء على فجوة حرجة في موثوقية الإشراف على المحتوى ناتجة عن الغياب التام للغة الأردية في وقائع أبحاث سلامة الذكاء الاصطناي في تسع سنوات من الأبحىث الرئيسية.