Detecting Hallucinations in Large Language Models via Internal Attention Divergence Signals
यह शोध पत्र अटेंशन मैट्रिसेस (attention matrices) में कुलबैक-लीब्लर डाइवर्जेंस (Kullback-Leibler divergence) का उपयोग करके LLM मतिभ्रम (hallucinations) का पता लगाने के लिए एक हल्का, सिंगल-पास विधि प्रस्तावित करता है, जो अनिश्चितता के एक भविष्य कहने योग्य, व्याख्या योग्य संकेत के रूप में कार्य करता है, और जो बार-बार सैंपलिंग या बाहरी मॉडलों की आवश्यकता के बिना मौजूदा विधियों के साथ प्रतिस्पर्धी प्रदर्शन करता है।