Can We Trust LLM's Logic? Quantifying Uncertainty, Coherence, and Robustness via a Graph-Based Framework
यह शोध पत्र GRAPHEVAL को प्रस्तुत करता है, जो एक ग्राफ-आधारित ढांचा है जो एक नवीन ग्राफ रीजनिंग कोहेरेंस स्कोर (GRCS) के माध्यम से तर्क अनिश्चितता को परिमाणित करता है और सरल उत्तर सहमति के बजाय तार्किक वैधता को प्राथमिकता देकर तर्क निष्ठा में सुधार करने के लिए ग्राफ सेल्फ-कंसिस्टेंसी (GSC) का उपयोग करता है, जिससे मानक डिकोडिंग रणनीतियों की सीमाओं का पता चलता है और प्रमुख तर्क पथों की सुदृढ़ता उजागर होती है।