Understanding and Mitigating Dataset Corruption in LLM Steering
تتقصى هذه الورقة مدى متانة التوجيه التبايني للنماذج اللغوية الكبيرة ضد فساد البيانات، كاشفةً أنه في حين تتحمل هذه الطريقة الضجيج المتوسط، إلا أن التعديلات الخبيثة في البيانات يمكن أن تسبب آثاراً جانبية ضارة يتم التخفيف من حدتها بفعالية عبر استبدال حساب المتوسط القياسي بمقدرات المتوسط المتينة.