CAVEWOMAN: How Large Language Models Behave Under Linguistic Input and Output Compression
"केववुमन" (Cavewoman) अध्ययन यह प्रकट करता है कि जबकि मॉडल के आउटपुट को कंप्रेस करना इन्फरेंस लागत को काफी कम कर सकता है, उपयोगकर्ता के इनपुट को कंप्रेस करना प्रतिगामी है, क्योंकि यह मॉडल को लंबे उत्तर उत्पन्न करने के लिए मजबूर करता है जो शुद्ध लागत को बढ़ाते हैं और सटीकता को कम करते हैं।