Developing an English-Efik Corpus and Machine Translation System for Digitization Inclusion
تتناول هذه الدراسة نقص التمثيل للغة الإفيكك (Efik) ذات الموارد المنخفضة في مجال معالجة اللغات الطبيعية من خلال تطوير متن موازٍ مُعدّ بواسطة المجتمع، وإثبات أن ضبط نموذج NLLB-200 بدقة على هذه المجموعة من البيانات يؤدي إلى أداء متفوق في الترجمة الآلية من الإنجليزية إلى الإفيكك مقارنة بنموذج mT5، مما يساهم في تعزيز الحفظ الرقمي الشامل والعادل للغات.