Multilingual Large Language Models do not comprehend all natural languages to equal degrees
यह अध्ययन इस धारणा को चुनौती देता है कि लार्ज लैंग्वेज मॉडल्स (LLMs) के लिए अंग्रेजी इष्टतम भाषा है, यह प्रदर्शित करते हुए कि हालांकि ये मॉडल परीक्षण की गई सभी भाषाओं में मानव बेसलाइन से कम बेहतर प्रदर्शन करते हैं, लेकिन वे टोकनाइज़ेशन, प्रशिक्षण डेटा संरचना और भाषाई दूरी जैसे कारकों के कारण अंग्रेजी की तुलना में कुछ रोमांस भाषाओं में उच्च बोध सटीकता प्राप्त करते हैं।