Analyzing the Correlation Between Hallucinations and Knowledge Conflicts in Large Language Models
यह शोध पत्र विभिन्न परतों (layers) में आंतरिक निरूपणों (internal representations) का विश्लेषण करके लार्ज लैंग्वेज मॉडल्स (LLMs) में ज्ञान संघर्ष (knowledge conflicts) और मतिभ्रम (hallucinations) के बीच सहसंबंध की जांच करता है, यह पाते हुए कि हालांकि ये दोनों घटनाएं वैचारिक रूप से संबंधित हैं, मतिभ्रम के पैटर्न को ज्ञान संघर्ष निरूपणों द्वारा पूरी तरह से समझाया नहीं जा सकता है, जिससे LLM व्यवहार को समझने के लिए सूक्ष्म व्याख्यात्मकता उपकरणों (fine-grained interpretability tools) के महत्व पर प्रकाश पड़ता है।