A Shared Geometry of Difficulty in Multilingual Language Models
यह शोध पत्र प्रकट करता है कि लार्ज लैंग्वेज मॉडल्स समस्या की कठिनाई को एक द्वि-चरणीय प्रतिनिधित्व पदानुक्रम (two-stage representational hierarchy) के माध्यम से संसाधित करते हैं, जहाँ उथले स्तरों (shallow layers) में भाषा-निरपेक्ष संकेत उभरते हैं ताकि क्रॉस-लिंगुअल सामान्यीकरण सक्षम हो सके, जबकि गहरे स्तरों (deeper layers) में भाषा-विशिष्ट संकेत एक ही भाषा के भीतर सटीकता को अनुकूलित करते हैं।