Are LLMs Safe Beyond Text: Do Emojis Expose Gaps in Safety Evaluation
تُظهر هذه الدراسة أن الاعتماد حصرياً على تقييمات السلامة القائمة على النصوص للنماذج اللغوية الكبيرة يغفل ثغرات أمنية كبيرة تكشفها المطالبات المعززة بالرموز التعبيرية، كما يتضح من تباين القابلية للتأثر بهذه المدخلات عبر مختلف النماذج مفتوحة المصدر.