Improving multichannel speech enhancement through accurate room-acoustic simulations
यह शोध पत्र प्रदर्शित करता है कि उच्च-निष्ठा वाले वेव-आधारित रूम-अकॉस्टिक सिमुलेशन के साथ संवर्धित डेटासेट्स पर डीप-लर्निंग-आधारित मल्टीचैनल स्पीच एन्हांसमेंट मॉडल्स को प्रशिक्षित करने से प्रदर्शन में महत्वपूर्ण सुधार होता है, जो लोअर-फिडेलिटी ज्योमेट्रिकल अकॉस्टिक्स डेटा पर प्रशिक्षित मॉडल्स की तुलना में मीडियन वर्ड एरर रेट में 38% तक की सापेक्ष कमी प्राप्त करता है।