Bridging the Gap: Transfer Learning from English PLMs to Malaysian English
यह शोध पत्र MENmBERT और MENBERT को प्रस्तुत करता है, जो मलेशियाई अंग्रेजी के लिए विशेष रूप से तैयार किए गए पूर्व-प्रशिक्षित भाषा मॉडल हैं, जो इस कम-संसाधन वाले, कोड-स्विचिंग वातावरण की चुनौतियों का समाधान करने के लिए भाषा-विशिष्ट कॉर्पोरा का लाभ उठाकर नामबद्ध इकाई पहचान (Named Entity Recognition) और संबंध निष्कर्षण (Relation Extraction) कार्यों में महत्वपूर्ण सुधार प्रदर्शित करते हैं।