Interpreting and Steering State-Space Models via Activation Subspace Bottlenecks
यह शोध पत्र एक्टिवेशन सबस्पेस बॉटलनैक्स (activation subspace bottlenecks) की पहचान करके स्टेट-स्पेस मॉडल्स की व्याख्यात्मकता (interpretability) और स्टीयरेबिलिटी (steerability) को आगे बढ़ाता है, जिन्हें टेस्ट टाइम पर स्केल करने से बिना किसी टास्क-विशिष्ट ट्यूनिंग के विविध बेंचमार्क पर प्रदर्शन में महत्वपूर्ण वृद्धि होती है, साथ ही यह बेहतर लॉन्ग-कॉन्टेक्स्ट क्षमताओं वाले एक पुन: प्रशिक्षित "स्टेबल-मैम्बा" (Stable-Mamba) आर्किटेक्चर के निर्माण को भी सक्षम बनाता है।