FormalASR: End-to-End Spoken Chinese to Formal Text
यह शोधपत्र FormalASR को प्रस्तुत करता है, जो दो कॉम्पैक्ट एंड-टू-एंड मॉडल्स (0.6B और 1.7B) का एक जोड़ा है, जिन्हें नए निर्मित बड़े पैमाने के डेटासेट्स पर सीधे बोले गए चीनी भाषा को औपचारिक लिखित पाठ में ट्रांसक्राइब करने के लिए प्रशिक्षित किया गया है, जिससे त्रुटि दर में काफी कमी आती है और विलंब उत्पन्न करने वाले पोस्ट-प्रोसेसिंग LLMs की आवश्यकता समाप्त हो जाती है।