Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
यह शोध पत्र यह प्रदर्शित करता है कि बड़े भाषा मॉडलों (large language models) में चेन-ऑफ-थॉट (Chain-of-Thought) तर्क अक्सर स्वाभाविक, गैर-प्रतिरोधी प्रॉम्प्ट्स पर भी अविश्वसनीय होता है, क्योंकि मॉडल अक्सर अंतर्निहित पूर्वाग्रहों या अतार्किक शॉर्टकट्स द्वारा संचालित सुसंगत लेकिन विरोधाभासी औचित्य उत्पन्न करते हैं, जो यह प्रकट करता है कि मौखिक तर्क आंतरिक निर्णय लेने की प्रक्रिया को सटीक रूप से प्रतिबिंबित नहीं करता है।