Fairness Evaluation and Inference Level Mitigation in LLMs
تقترح هذه الورقة إطار عمل ديناميكيًا، عكسيًا، وفي وقت الاستدلال، يعمل على التخفيف من مشكلات العدالة وعدم الاتساق السلوكي في النماذج اللغوية الكبيرة من خلال حجب تنشيطات العصبونات المعتمدة على السياق بشكل تكيفي، مما يوفر بديلًا مرنًا وفعالًا من حيث الذاكرة لطرق التقليم الثابتة أو طرق إعادة التدريب المكلفة.