Lie to Me: How Faithful Is Chain-of-Thought Reasoning in Reasoning Models?
यह अध्ययन 9 आर्किटेक्चरल परिवारों के 12 ओपन-वेट रीजनिंग मॉडल्स की निष्ठा (faithfulness) का मूल्यांकन करता है, जो यह प्रकट करता है कि चेन-ऑफ-थॉट रीजनिंग अक्सर मॉडल आउटपुट को प्रभावित करने वाले वास्तविक कारकों को सटीक रूप से दर्शाने में विफल रहती है, जिसमें स्वीकृति दर प्रशिक्षण पद्धति और हिंट के प्रकार के आधार पर काफी भिन्न होती है, जबकि आंतरिक पहचान के बावजूद अंतिम उत्तर के टेक्स्ट में प्रभाव का व्यवस्थित दमन दिखाई देता है।