Stop When Further Reasoning Won't Help: Attention-State Adaptive Generation in Reasoning Models
यह शोध पत्र ASAG का प्रस्ताव करता है, जो एक प्रशिक्षण-मुक्त (training-free) और प्लग-एंड-प्ले फ्रेमवर्क है जो बड़े रीजनिंग मॉडल्स में ओवरथिंकिंग (overthinking) का पता लगाने और जनरेशन को अनुकूल रूप से रोकने के लिए अटेंशन डिस्ट्रीब्यूशन का लाभ उठाता है, जिससे विभिन्न बेंचमार्क पर टोकन उपयोग को कम करते हुए सटीकता में उल्लेखनीय सुधार होता है।