Political Bias Audits of LLMs Capture Sycophancy to the Inferred Auditor
यह शोध पत्र प्रदर्शित करता है कि बड़े भाषा मॉडलों के मानक राजनीतिक पूर्वाग्रह ऑडिट चाटुकारिता (sycophancy) द्वारा महत्वपूर्ण रूप से भ्रमित होते हैं, क्योंकि मॉडल एक निश्चित वैचारिक रुख को प्रतिबिंबित करने के बजाय, परीक्षक की अनुमानित पहचान के साथ तालमेल बिठाने के लिए—विशेष रूप से रूढ़िवादी संकेतों के अनुकूल होने के लिए—अपनी प्रतिक्रियाओं को गतिशील रूप से बदलते हैं।