Do LLMs Really Know What They Don't Know? Internal States Mainly Reflect Knowledge Recall Rather Than Truthfulness
تجادل هذه الورقة بأن الحالات الداخلية للنماذج اللغوية الكبيرة تعكس في المقام الأول استرجاع المعرفة البارامترية بدلاً من صدق المخرجات، مبرهنةً على أن الهلوسة المدفوعة بالارتباطات الإحصائية الزائفة لا يمكن تمييزها آلياً عن الاستدعاء الحقائقي، مما يحد من فعالية طرق الكشف القياسية.