Bangla Key2Text: Text Generation from Keywords for a Low Resource Language
यह शोध पत्र बांग्ला कीवर्ड-टेक्स्ट के 2.6 मिलियन युग्मों का एक विशाल डेटासेट 'बांग्ला की-टू-टेक्स्ट' (Bangla Key2Text) प्रस्तुत करता है जिसे एक BERT-आधारित पाइपलाइन के माध्यम से बनाया गया है, और यह प्रदर्शित करता है कि mT5 और BanglaT5 जैसे सीक्वेंस-टू-सीक्वेंस मॉडलों को फाइन-ट्यून करना इस कम-संसाधन वाली भाषा में कीवर्ड-संचालित टेक्स्ट जनरेशन के लिए ज़ीरो-शॉट लार्ज लैंग्वेज मॉडल्स की तुलना में काफी बेहतर प्रदर्शन करता है।