When Preferences Fail to Become Incentives: A Utility-Behavior Gap in Large Language Models
यह शोध पत्र यह प्रदर्शित करता है कि जबकि बड़े भाषा मॉडल (large language models) चयन प्रतिमानों (choice paradigms) में सुसंगत प्राथमिकताएं प्रदर्शित करते हैं, ये घोषित प्राथमिकताएं वास्तविक कार्यों में व्यवहारिक प्रोत्साहन में परिवर्तित नहीं होती हैं या आउटपुट की गुणवत्ता में सुधार नहीं करती हैं, जो प्राप्त उपयोगिताओं (elicited utilities) और वास्तविक मॉडल प्रेरणा के बीच एक महत्वपूर्ण अंतर को प्रकट करती हैं।