How Long Reasoning Chains Influence LLMs' Judgment of Answer Factuality
यह शोध पत्र व्यवस्थित रूप से इस बात की जांच करता है कि कैसे LLMs उत्तर की तथ्यात्मकता का निर्णय लगाने के लिए रीजनिंग चेन्स (तर्क श्रृंखलाओं) का उपयोग करते हैं, यह प्रकट करते हुए कि जहाँ तर्कीकरण सक्षम जजों की सहायता कर सकता है, वहीं कमजोर और मजबूत दोनों ही मॉडल सुव्यवस्थित लेकिन गलत तर्क द्वारा गुमराह होने के प्रति संवेदनशील बने रहते हैं, जो वास्तविक तर्क की गुणवत्ता और सतही प्रवाह के बीच अंतर करने वाले अधिक सुदृढ़ मूल्यांकन मेट्रिक्स की महत्वपूर्ण आवश्यकता को रेखांकित करता है।