The Sparse Frontier: Sparse Attention Trade-offs in Transformer LLMs
यह शोध पत्र ट्रांसफॉर्मर एलएलएम (LLM) में ट्रेनिंग-फ्री स्पार्स अटेंशन (training-free sparse attention) का सबसे बड़े पैमाने पर अनुभवजन्य विश्लेषण प्रस्तुत करता है, जो एक पद्धति वर्गीकरण स्थापित करता है और यह प्रकट करता है कि स्पार्स मॉडल समान लागत पर छोटे डेंस (dense) मॉडलों से बेहतर प्रदर्शन करते हैं, जबकि अनुक्रम चरण (sequence phase) और लंबाई के आधार पर भिन्न होने वाली स्पर्सिटी चयन रणनीतियों पर व्यावहारिक अंतर्दृष्टि प्रदान करते हैं।