Calibrating the Evaluator: Does Probability Calibration Mitigate Preference Coupling in LLM Agent Feedback Loops?
यह शोध पत्र यह प्रदर्शित करता है कि LLM एजेंट फीडबैक लूप में मूल्यांकनकर्ता के निर्णयों पर प्रायिकता अंशांकन (probability calibration) लागू करना प्रभावी रूप से मूल्यांकनकर्ता प्राथमिकता युग्मन (evaluator preference coupling) को कम करता है, जो मानक बाइनरी फीडबैक विधियों की तुलना में युग्मन गुणांक और वितरण विचलन (distributional divergence) दोनों को महत्वपूर्ण रूप से कम करता है।