Peer Identity Bias in Multi-Agent LLM Evaluation: An Empirical Study Using the TRUST Democratic Discourse Analysis Pipeline
تُثبت هذه الورقة أن إخفاء الهوية الجزئي في مسارات تقييم النماذج اللغوية الكبيرة متعددة الوكلاء يمكن أن يحجب تملقاً كبيراً مدفوعاً بالهوية، وتخلص إلى أن إخفاء هوية المسار بالكامل واستخدام مجموعات نماذج غير متجانسة هما السبيلان الوحيدان لتقليل وكشف انحياز هوية الأقران بشكل موثوق.