← नवीनतम पेपर
💬 NLP

CRISP: Compressing Redundancy in Chain-of-Thought via Intrinsic Saliency Pruning

यह शोध पत्र CRISP को प्रस्तुत करता है, जो एक ऐसा फ्रेमवर्क है जो रीजनिंग मॉडल्स के अंतर्निहित अटेंशन पैटर्न्स का लाभ उठाता है—विशेष रूप से टर्मिनेशन टोकन को एक सूचना एंकर के रूप में उपयोग करके—ताकि अनावश्यक चेन-ऑफ-थॉट स्टेप्स को कम किया जा सके, जिससे तार्किक सुसंगतता और सटीकता को बनाए रखते हुए टोकन काउंट में 50-60% की कमी आती है।

मूल लेखक: Yangsong Lan, Hongliang Dai, Piji Li

प्रकाशित 2026-04-21
📖 3 मिनट में पढ़ें☕ कॉफ़ी ब्रेक में पढ़ें

मूल लेखक: Yangsong Lan, Hongliang Dai, Piji Li

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

) टोकन) जब रॉब सोचना समाप्त करता है और अंतिम उत्तर देने वाला होता है, तो वह एक विशेष मानसिक "एंकर" टोकन (कोड में एक विशिष्ट संकेत जिसे ` कहा जाता है) का उपयोग करता है।

  • खोज: शोधकर्ताओं ने कुछ बेहद दिलचस्प देखा। जैसे-जैसे रॉब अंत के करीब पहुँचता है, उसका ध्यान बदल जाता है। वह अपने निबंध के लंबे, भ्रामक मध्य भाग को देखना बंद कर देता है और इस "एंकर" पर तीव्रता से ध्यान केंद्रित करता है।
  • रूपक: एक लंबे, धुंधले घाट के अंत में स्थित लाइटहाउस (प्रकाश स्तंभ) की कल्पना करें। प्रकाश ( </think> टोकन) पीछे की ओर चमकता है। घाट के वे हिस्से जिन पर प्रकाश चमकता है, वे वे महत्वपूर्ण चरण हैं जिनकी वास्तव में रॉब को आवश्यकता थी। वे हिस्से जो छाया में हैं, वे केवल अनावश्यक बातें हैं जिनकी उसे वास्तव में आवश्यकता नहीं थी।

2. "सैलियंसी प्रूनिंग" (स्मार्ट कैंची)

इस "लाइटहाउस" संकेत का उपयोग करके, CRISP केवल अनुमान नहीं लगाता कि क्या काटना है। यह ठीक जानता है कि क्या महत्वपूर्ण है।

  • प्रक्रिया: यह रॉब द्वारा लिखे गए प्रत्येक वाक्य को देखता है। यदि "लाइटहाउस" किसी वाक्य पर चमक रहा है, तो यह उसे रखता है। यदि प्रकाश मंद है, तो यह जान जाता है कि वह वाक्य केवल फालतू बातें (filler) थीं।
  • कार्यवाही: यह निबंध को संपादित करने के लिए चार स्मार्ट उपकरणों का उपयोग करता है:
    1. KEEP (रखें): "यह अत्यंत महत्वपूर्ण है! इसे रखें।"
    2. PRUNE (छंटनी करें): "यह केवल फालतू बातें हैं। इसे काट दें।"
    3. REWRITE (पुनर्लेखन): "यह महत्वपूर्ण है, लेकिन आपने इसे बहुत विस्तार से कहा है। आइए इसे 50 शब्दों के बजाय 5 शब्दों में कहें।"
    4. FUSE (विलय करें): "आपने यह बात चरण 1 और चरण 2 में कही थी। आइए इन्हें एक 'सुपर-स्टेप' में मिला दें।"

3. "पॉलिशिंग" (अंतिम स्पर्श)

कभी-कभी, जब आप किसी कहानी के बीच के हिस्से को काट देते हैं, तो शुरुआत और अंत आपस में अच्छी तरह से नहीं जुड़ पाते। यह रोबोटिक या टूटा हुआ लग सकता है।

  • समाधान: CRISP किनारों को सुचारू बनाने के लिए एक "रिफाइनर" (एक दूसरा AI) का उपयोग करता है। यह कटे हुए, उच्च-घनत्व वाले संस्करण को लेता है और इसे इस तरह से फिर से लिखता है कि यह स्वाभाविक रूप से प्रवाहित हो सके, जैसे कोई मनुष्य बोल रहा हो, लेकिन बिना लंबे ठहराव और दोहराव के।

परिणाम: "हाई-ऑक्टेन" रीजनिंग

CRISP का उपयोग करने के बाद, मॉडल एक भारी ट्रक के बजाय एक फॉर्मूला 1 कार की तरह होता है।

  • पहले: गणित की समस्या हल करने के लिए इसे 3,000 शब्दों की आवश्यकता थी।
  • बाद में: इसे केवल 1,200 शब्दों की आवश्यकता होती है (60% की कमी!) लेकिन इसे वही सटीकता प्राप्त होती है।

यह क्यों महत्वपूर्ण है
इसे एक वीडियो फ़ाइल को कंप्रेस करने जैसा समझें। पुराने तरीके केवल गुणवत्ता कम कर देंगे, जिससे चित्र धुंधला हो जाएगा। CRISP एक स्मार्ट कम्प्रेशन एल्गोरिदम की तरह है जो शोर और ठहराव को हटा देता है, और हाई-डेफिनिशन एक्शन दृश्यों को पूरी तरह से स्पष्ट रखता है।

इसका अर्थ है:

  1. तेज़ उत्तर: आपको समाधान बहुत जल्दी मिल जाता है।
  2. सस्ता AI: इन मॉडल्स को चलाना कम पैसा खर्च करता है क्योंकि वे कम कंप्यूटर शक्ति का उपयोग करते हैं।
  3. स्मार्ट AI: "ओवरथिंकिंग" और शोर को हटाकर, AI वास्तव में अधिक केंद्रित और विश्वसनीय हो जाता है।

संक्षेप में, CRISP AI को खुद से इतनी बातें करना बंद करना सिखाता है, जिससे उसे "शोर" में से "सिग्नल" खोजने और आपको बिना अपनी शानदार तर्क क्षमता खोए, तेज़ी से उत्तर देने में मदद मिलती है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →