Can LLMs Introspect? A Reality Check
यह शोध पत्र तर्क देता है कि एलएलएम (LLM) आत्मनिरीक्षण के लिए वर्तमान साक्ष्य समयपूर्व हैं और संभवतः वास्तविक मेटाकॉग्निटिव मॉनिटरिंग के बजाय सतही संकेतों पर पैटर्न मिलान को दर्शाते हैं, क्योंकि मॉडल इनपुट हेरफेर से आंतरिक अवस्था के साथ छेड़छाड़ के बीच विश्वसनीय रूप से अंतर करने में विफल रहते हैं और छिपी हुई अवस्थाओं की भविष्यवाणी करने में इनपुट-ओनली क्लासिफायर से बेहतर प्रदर्शन नहीं करते हैं।