Benchmarking and Improving LLM Robustness for Personalized Generation
يقدم هذا البحث إطار عمل PERG ومجموعة بياناته لتقييم التوازن الذي غالباً ما يتم تجاهله بين الواقعية وتفضيلات المستخدم في النماذج اللغوية الكبيرة المخصصة، كاشفاً عن فجوات متسعة في المتانة عبر النماذج ومقترحاً طريقة Pref-Aligner لتحسين الأداء بشكل كبير.