The Illusion of Insight in Reasoning Models
यह शोध पत्र तर्क मॉडलों में अंतर्निहित "आहा!" (Aha!) क्षणों की धारणा को चुनौती देता है, यह प्रदर्शित करते हुए कि रीजनिंग के मध्य में होने वाले बदलाव दुर्लभ हैं, प्रशिक्षण की प्रगति से असंबद्ध हैं, और आमतौर पर अप्रभावी होते हैं, जो उन्हें अस्थिर अनुमान (inference) के लक्षणों के रूप में प्रकट करता है जिन्हें केवल उच्च अनिश्चितता के तहत कृत्रिम रूप से ट्रिगर किए जाने पर ही प्रदर्शन में सुधार के लिए लाभ उठाया जा सकता है।