How Language Models Fail: Token-Level Signatures of Committed and Persistent Reasoning Failures
यह शोध पत्र भाषा मॉडलों में दो विशिष्ट टोकन-स्तरीय तर्क विफलता मोड की पहचान और लक्षण वर्णन करता है—कमिटेड फेलियर (committed failure), जो प्रारंभिक पथ-लॉकिंग (path-locking) द्वारा चिह्नित है, और पर्सिस्टेंट अनसर्टेन्टी (persistent uncertainty), जो संचित संदेह द्वारा लक्षित है—यह प्रदर्शित करते हुए कि ये हस्ताक्षर विविध कॉन्फ़िगरेशनों में पुनरुत्पादित किए जा सकते हैं और सेल्फ-कंसिस्टेंसी (self-consistency) जैसी विफलता पहचान रणनीतियों के अनुकूलन में मार्गदर्शन कर सकते हैं।