[b]=[d]-[t]+[p]: Self-supervised Speech Models Discover Phonological Vector Arithmetic
यह शोध पत्र प्रदर्शित करता है कि स्व-पर्यवेक्षित (self-supervised) स्पीच मॉडल भाषण को संरचनात्मक, ध्वन्यात्मक रूप से व्याख्या योग्य वेक्टर्स का उपयोग करके एनकोड करते हैं जो रैखिक अंकगणितीय संचालन की अनुमति देते हैं, जहाँ विशिष्ट फीचर वेक्टर्स (जैसे कि वॉइसिंग) को जोड़ने या स्केल करने से 96 भाषाओं में एक फोनम को दूसरे में व्यवस्थित रूप से परिवर्तित किया जा सकता है।