Tagarela - A Portuguese speech dataset from podcasts
यह शोध पत्र TAGARELA को प्रस्तुत करता है, जो कि 8,972 घंटों से अधिक के पॉडकास्ट ऑडियो वाला एक सार्वजनिक रूप से जारी किया गया, बड़े पैमाने का पुर्तगाली भाषण डेटासेट है, जिसे संसाधनों की कमी को दूर करने और इस भाषा के लिए अत्याधुनिक स्वचालित भाषण पहचान (automatic speech recognition) और टेक्स्ट-टू-स्पीच मॉडल को सक्षम करने के लिए डिज़ाइन किया गया है।