← नवीनतम पेपर
💬 NLP

Tethered Reasoning: Decoupling Entropy from Hallucination in Quantized LLMs via Manifold Steering

यह शोध पत्र HELIX को प्रस्तुत करता है, जो एक ज्यामितीय ढांचा (geometric framework) है जो क्वांटाइज्ड LLMs में हिडन-स्टेट प्रक्षेपवक्रों (hidden-state trajectories) को एक सत्यता मैनिफोल्ड (truthfulness manifold) से बांधकर एंट्रॉपी को मतिभ्रम (hallucination) से अलग करता है, जिससे उच्च-तापमान अनुमान (high-temperature inference) सक्षम होता है जो तार्किक सुसंगतता और सटीकता बनाए रखते हुए रचनात्मक विविधता को महत्वपूर्ण रूप से बढ़ाता है।

मूल लेखक: Craig Atkinson

प्रकाशित 2026-02-23
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Craig Atkinson

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

द बिग प्रॉब्लम: "क्रेजी" बनाम "बोरिंग" की दुविधा

कल्पना कीजिए कि आपके पास एक बहुत ही बुद्धिमान, लेकिन थोड़ी क्षतिग्रस्त विश्वकोश (एक क्वांटाइज्ड एआई मॉडल) है। क्योंकि इसे एक छोटे कंप्यूटर (जैसे लैपटॉप या फोन) पर फिट होने के लिए कंप्रेस किया गया है, इसलिए यह थोड़ा "नॉइज़ी" (शोर भरा) है।

जब आप इस एआई से कोई कहानी सुनाने या गणित की समस्या हल करने के लिए कहते हैं, तो आपके पास एक डायल होता है जिसे टेम्परेचर (Temperature) कहते हैं, जो यह नियंत्रित करता है कि वह कितना रचनात्मक या रैंडम है:

  • लो टेम्परेचर (द रोबोट): यदि आप डायल को कम करते हैं, तो एआई बहुत सुरक्षित और दोहराव वाला हो जाता है। यह एक ऐसे रोबोट की तरह है जो बार-बार वही तीन वाक्य बोलता रहता है। यह सटीक है, लेकिन उबाऊ है।
  • हाई टेम्परेचर (द ड्रंक पोएट): यदि आप रचनात्मकता पाने के लिए डायल को ऊपर बढ़ाते हैं, तो एआई पटरी से उतरने लगता है। यह मनगढ़ंत तथ्य बनाने लगता है, अपना तर्क खो देता है, और ऐसी बातें कहने लगता है जिनका कोई अर्थ नहीं निकलता। इसे हैलुसिनेशन (Hallucination) कहा जाता है।

पुरानी धारणा: वर्षों तक, विशेषज्ञों का मानना था कि आपको चुनाव करना होगा। आप या तो एक उबाऊ, सटीक रोबोट रख सकते हैं या एक रचनात्मक, पागल कवि। आप दोनों को एक साथ नहीं रख सकते थे।

द सॉल्यूशन: द "हेलिक्स" टेदर

लेखक, क्रेग एटकिंसन, एक नया सिस्टम पेश करते हैं जिसे हेलिक्स (Helix) कहा जाता है। हेलिक्स को एक सेफ्टी टेदर (सुरक्षा रस्सी) या एआई के लिए एक पट्टे (Leash) के रूप में सोचें।

यह कैसे काम करता है, इसके कुछ उदाहरण यहाँ दिए गए हैं:

1. "ट्रुथ मैनिफोल्ड" (द इनविजिबल ट्रैम्पोलिन)

कल्पना कीजिए कि एआई का मस्तिष्क एक विशाल, बहु-आयामी ट्रैम्पोलिन है।

  • "ट्रुथ" एरिया: ट्रैम्पोलिन के बीच में एक विशिष्ट, बाउन्सी ज़ोन है जहाँ सभी सही तथ्य और तार्किक वाक्य रहते हैं।
  • "हैलुसिनेशन" एरिया: यदि एआई बहुत दूर कूद जाता है, तो वह ट्रैम्पोलिन से बाहर गिरकर कीचड़ में जा गिरता है (निरर्थकता)।

आमतौर पर, जब एआई "हॉट" (हाई टेम्परेचर) होता है, तो वह बेतहाशा कूदता है और बाहर गिर जाता है। हेलिक्स ट्रैम्पोलिन के केंद्र से जुड़ा एक अदृश्य इलास्टिक टेदर (लचीली रस्सी) बनाता है।

2. "यूनिफाइड ट्रुथ स्कोर" (द जीपीएस)

एआई द्वारा हर एक शब्द बोलने से पहले, हेलिक्स उसके आंतरिक जीपीएस की जांच करता है। यह दो सवाल पूछता है:

  1. "इस शब्द के बारे में तुम कितने अनिश्चित हो?" (एन्ट्रॉपी)
  2. "क्या तुम सच्चाई के केंद्र से बहुत दूर कूद रहे हो?" (ट्रुथ से दूरी)

यदि एआई ट्रैम्पोलिन से बाहर कूदने वाला होता है, तो हेलिक्स एक हल्के खिंचाव के साथ उसे वापस खींच लेता है।

3. द मैजिक: "ग्रेजुएटेड स्टीयरिंग"

सबसे अच्छी बात यह है: हेलिक्स केवल 0.2% से 2.5% समय ही एआई को छूता है।

  • यह एक डांस पार्टनर की तरह है जो केवल तब हस्तक्षेप करता है जब आप अपने कदमों की गलती करने वाले होते हैं ताकि आप लड़खड़ा न जाएं।
  • बाकी 97% समय के लिए, एआई स्वतंत्र रूप से नाचने, कूदने और रचनात्मक होने के लिए स्वतंत्र है।

आश्चर्यजनक परिणाम

जब लेखक ने इस परीक्षण को एक कंप्रेस्ड एआई मॉडल (ग्रैनाइट 4.0) पर किया, तो कुछ अद्भुत हुआ:

  • इसने नुकसान को ठीक कर दिया: कंप्रेस्ड एआई, जिसे फुल-साइज़ वर्जन से बदतर होना चाहिए था, हेलिक्स चालू होने पर फुल-साइज़ वर्जन से भी बेहतर हो गया। इसने गणित की समस्याओं को मूल मॉडल की तुलना में अधिक सटीकता से हल किया।
  • इसने टेम्परेचर लिमिट को तोड़ दिया: आमतौर पर, एआई टेम्परेचर डायल को 2.0 से ऊपर ले जाने पर टूट जाता है। हेलिक्स के साथ, लेखक ने डायल को 3.0 तक घुमाया, और एआई फिर भी तार्किक और सटीक बना रहा।
  • "क्रिएटिव रिज़र्वोइर" (रचनात्मक भंडार): यह सबसे बड़ी खोज है। जब एआई को "हॉट" (रचनात्मक) होने की अनुमति दी गई लेकिन उसे टेदर (रस्सी) से बांध कर रखा गया, तो उसने केवल निरर्थक बातें नहीं कीं। उसने नए विचारों का एक छिपा हुआ खजाना खोज निकाला।
    • उदाहरण: कल्पना कीजिए कि एक लेखक है जो आमतौर पर अजीब कहानियाँ लिखने से डरता है। हेलिक्स एक सुरक्षा जाल की तरह है जो कहता है, "जाओ जितनी अजीब कहानी लिख सकते हो लिखो! अगर तुम बहुत ज्यादा पागल हुए, तो मैं तुम्हें पकड़ लूँगा।"
    • क्योंकि एआई गिरने से नहीं डर रहा था, इसलिए उसने पहले की तुलना में 200% अधिक अद्वितीय विचार खोजे। उसने उन अवधारणाओं को खोज निकाला जो एक "सुरक्षित" एआई कभी नहीं सोच पाता, जैसे कि "ChronoVerse Symphonies" या "Quantum Soulscapes"।

यह आपके लिए क्यों मायने रखता है

  1. सस्ता एआई: आप बिना बुद्धिमत्ता खोए शक्तिशाली एआई को छोटे, सस्ते उपकरणों (जैसे आपके फोन) पर चला सकते हैं।
  2. अधिक रचनात्मकता: आप मंथन (brainstorming) सत्रों के लिए एआई को बेहद रचनात्मक होने के लिए कह सकते हैं, यह जानते हुए कि वह अपना मानसिक संतुलन नहीं खोएगा।
  3. सुरक्षा: यह एआई को झूठ बोलने या तथ्य बनाने से रोकता है, भले ही वह रचनात्मक होने की कोशिश कर रहा हो।

बॉटम लाइन (निष्कर्ष)

यह पेपर साबित करता है कि "हैलुसिनेशन" (एआई का झूठ बोलना) इसलिए नहीं होता क्योंकि एआई मूर्ख या टूटा हुआ है। ऐसा इसलिए होता है क्योंकि एआई बिना किसी सुरक्षा जाल के बहुत दूर कूद रहा होता है। हेलिक्स वह सुरक्षा जाल प्रदान करता है, जिससे एआई एक ही समय में एक जीनियस गणितज्ञ और एक जंगली रचनात्मक कलाकार दोनों हो सकता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →