CALM: Joint Contextual Acoustic-Linguistic Modeling for Personalization of Multi-Speaker ASR
यह शोध पत्र CALM प्रस्तुत करता है, जो एक संयुक्त कॉन्टेक्स्टुअल अकॉस्टिक-लिंग्विस्टिक मॉडलिंग फ्रेमवर्क है जो अंग्रेजी और जापानी डेटासेट में व्यक्तिगत मल्टी-स्पीकर ऑटोमैटिक स्पीच रिकग्निशन में त्रुटि दरों को महत्वपूर्ण रूप से कम करने के लिए स्पीकर एम्बेडिंग-संचालित टारगेट-स्पीकर एक्सट्रैक्शन को डायनेमिक वोकैबुलरी-आधारित कॉन्टेक्स्टुअल बायसिंग के साथ एकीकृत करता है।