Survey of End-to-End Multi-Speaker Automatic Speech Recognition for Monaural Audio
यह सर्वेक्षण एकल-चैनल बहु-वक्ता स्वचालित भाषण पहचान (मोनोरल मल्टी-स्पीकर एएसआर) के लिए एंड-टू-एंड न्यूरल दृष्टिकोणों की एक व्यापक समीक्षा और व्यवस्थित वर्गीकरण प्रदान करता है, जो वास्तुशिल्प प्रतिमानों, हालिया एल्गोरिदम सुधारों, दीर्घ-रूप भाषण विस्तारों और बेंचमार्क प्रदर्शन का विश्लेषण करते हुए भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।