Scaling Conversational Hungarian ASR: The BEA-Dialogue+ Corpus
यह शोध पत्र BEA-Dialogue+ को प्रस्तुत करता है, जो एक विस्तारित 200-घंटे का हंगेरियन संवादात्मक भाषण संग्रह (corpus) है जो स्पीकर ओवरलैप पर नियंत्रित अध्ययन सक्षम करने के लिए स्प्लिट मानदंडों को शिथिल करता है, और यह प्रदर्शित करता है कि सीरियलाइज्ड आउटपुट ट्रेनिंग (SOT) फाइन-ट्यूनिंग विभिन्न मॉडलों में संवाद ट्रांसक्रिप्शन प्रदर्शन में महत्वपूर्ण सुधार करती है।