← नवीनतम पेपर
🤖 AI

A Unified Definition of Hallucination: It's The World Model, Stupid!

यह शोध पत्र मतिभ्रम (hallucination) की एक एकीकृत परिभाषा प्रस्तावित करता है जो उपयोगकर्ता के लिए दृश्यमान आंतरिक विश्व मॉडलिंग की अशुद्धि है, और यह तर्क देता है कि यह ढांचा पूर्व परिभाषाओं को समाहित करता है, संदर्भ जगतों को निर्दिष्ट करके मूल्यांकन मानकों को स्पष्ट करता है, और बेहतर बेंचमार्किंग एवं शमन रणनीतियों को सुगम बनाने के लिए मतिभ्रम को अन्य त्रुटि प्रकारों से अलग करता है।

मूल लेखक: Emmy Liu, Varun Gangal, Chelsea Zou, Michael Yu, Xiaoqi Huang, Alex Chang, Zhuofu Tao, Karan Singh, Sachin Kumar, Steven Y. Feng

प्रकाशित 2026-06-16
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Emmy Liu, Varun Gangal, Chelsea Zou, Michael Yu, Xiaoqi Huang, Alex Chang, Zhuofu Tao, Karan Singh, Sachin Kumar, Steven Y. Feng

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक बहुत ही बुद्धिमान, लेकिन थोड़े भ्रमित रोबोट के साथ "टेलीफोन" (Telephone) गेम खेल रहे हैं। आप रोबोट को एक कहानी, एक चित्र या नियमों का एक समूह देते हैं और उससे पूछते हैं कि क्या हुआ। कभी-कभी, रोबोट आपको कुछ ऐसा बताता है जो सुनने में बहुत आत्मविश्वासी और सुसंगत लगता है, लेकिन वह पूरी तरह से मनगढ़ंत होता है। तकनीकी दुनिया में, हम इसे हैलुसिनेशन (hallucination) कहते हैं।

लेकिन यहाँ एक समस्या है, हर कोई इस बात पर बहस करता है कि वास्तव में क्या "हैलुसिनेशन" की श्रेणी में आता है।

  • यदि एक रोबोट किसी समाचार लेख का सारांश देता है और उसमें कोई तथ्य गलत बताता है, तो क्या वह हैलुसिनेशन कर रहा है?
  • यदि एक रोबोट अपनी याददाश्त से सामान्य ज्ञान (trivia) के प्रश्न का उत्तर देता है और गलत हो जाता है, तो क्या वह हैलुसिनेशन कर रहा है?
  • यदि एक रोबोट वेबसाइट पर ऐसे बटन को क्लिक करने की कोशिश करता है जो मौजूद ही नहीं है, तो क्या वह हैलुसिनेशन कर रहा है?

कुछ शोधकर्ता इन सभी के लिए "हाँ" कहते हैं। अन्य लोग कहते "नहीं, यह तो बस एक गलती है।" यह भ्रम इस समस्या को ठीक करना कठिन बना देता है।

यह पेपर तर्क देता है कि हमें परिभाषा पर बहस करना बंद करना चाहिए और मूल कारण (root cause) पर ध्यान देना चाहिए। लेखक एक सरल, एकीकृत विचार प्रस्तावित करते हैं: हैलुसिनेशन केवल एक टूटा हुआ "वर्ल्ड मॉडल" (World Model) है।

मुख्य विचार: रोबोट का आंतरिक मानचित्र

रोबोट को एक खोजकर्ता के रूप में सोचें जो एक शहर में रास्ता खोजने की कोशिश कर रहा है। ऐसा करने के लिए, उसे एक मानचित्र (एक वर्ल्ड मॉडल) की आवश्यकता होती है।

  • संदर्भ जगत (The Reference World): यह वास्तविक मानचित्र है। यह सत्य (ground truth) है। यह वह समाचार लेख हो सकता है जो आपने उसे दिया है, शतरंज के वास्तविक नियम हो सकते हैं, किसी कंपनी का वास्तविक डेटाबेस हो सकता है, या किसी वेबसाइट का लाइव कोड हो सकता है।
  • रोबोट का दृष्टिकोण (The Robot's View): यह वह है जिसे देखने की अनुमति वास्तव में रोबोट को है। हो सकता है कि वह पूरा लेख देख सके, या शायद वह केवल एक छोटा सा हिस्सा देख पाता है।
  • संघर्ष नियम (The Conflict Rule): यह एक रेफरी है। यदि रोबोट की याददाश्त कहती है "आसमान हरा है" लेकिन लेख कहता है "आसमान नीला है," तो कौन जीतेगा? आमतौर पर, लेख (संदर्भ जगत) जीतता है।

पेपर की परिभाषा:
हैलुसिनेशन केवल तभी होता है जब रोबोट का आउटपुट संघर्ष नियम के आधार पर संदर्भ जगत के विपरीत होता है।

यदि रोबोट कहता है, "आसमान हरा है," और संदर्भ जगत (लेख) कहता है "आसमान नीला है," तो रोबोट के पास एक टूटा हुआ मानचित्र है। वह हैलुसिनेशन कर रहा है।

यह सब कुछ कैसे एकीकृत करता है

लेखक दिखाते हैं कि "हैलुसिनेशन" के प्रकार जिन्हें लोग चर्चा करते हैं, वे वास्तव में अलग-अलग कमरों में होने वाली एक ही चीज़ हैं:

  1. सारांशीकरण (Summarization): "संदर्भ जगत" मूल दस्तावेज़ है। यदि सारांश दस्तावेज़ के विपरीत है, तो उस दस्तावेज़ के प्रति रोबोट का मानचित्र गलत है।
  2. सामान्य ज्ञान (Trivia/Open QA): "संदर्भ जगत" ब्रह्मांड के वास्तविक तथ्य हैं (जैसे, किसने नोबेल पुरस्कार जीता)। यदि रोबोट अपने प्रशिक्षण के आधार पर गलत अनुमान लगाता है, तो वास्तविकता का उसका आंतरिक मानचित्र गलत है।
  3. वेब ब्राउज़िंग (Agents): "संदर्भ जगत" वास्तविक वेबसाइट कोड (DOM) है। यदि रोबोट कहता है "मैंने सबमिट बटन पर क्लिक किया" लेकिन कोड दिखाता है कि ऐसा कोई बटन मौजूद ही नहीं है, तो रोबोट एक ऐसी वस्तु का हैलुसिनेशन कर रहा है जो वहाँ है ही नहीं।

"मूर्खतापूर्ण" भाग: यह मानचित्र है, रोबोट नहीं

शीर्षक कहता है, "यह वर्ल्ड मॉडल है, मूर्ख!" (It's The World Model, Stupid!) यह एक प्रसिद्ध राजनीतिक नारे का रूपांतरण है। लेखक कह रहे हैं: रोबोट को "भ्रमित" होने के लिए दोष देना बंद करें। समस्या यह है कि दुनिया का उसका आंतरिक मानचित्र सटीक नहीं है।

कभी-कभी रोबलेट "झूठ" नहीं बोल रहा होता; वह बस गलत मानचित्र देख रहा होता है।

  • योजना संबंधी त्रुटि (Planning Error): रोबोट जानता है कि मानचित्र सही है, लेकिन वह एक बुरा रास्ता चुनता है। (यह हैलुसिनेशन नहीं है)।
  • हैलुसिनेशन (Hallucination): रोबोट को लगता है कि मानचित्र कहता है "यहाँ पुल है," लेकिन मानचित्र वास्तव में कहता है "यहाँ खाई है।" (यह एक हैलुसिनेशन है)।

इसे कैसे ठीक करें (पेपर के अनुसार)

पेपर सुझाव देता है कि हमें एक "परफेक्ट रोबोट" बनाने के बजाय बेहतर परीक्षण स्थल (testing grounds) बनाने पर ध्यान देना चाहिए।

वे रोबोटों का परीक्षण करने के लिए सिंथेटिक दुनिया (जैसे वीडियो गेम या शतरंज) का उपयोग करने का प्रस्ताव देते हैं।

  • शतरंज का उदाहरण: कल्पना कीजिए कि शतरंज का एक खेल है जहाँ नियम 100% स्पष्ट हैं और बोर्ड की स्थिति 100% ज्ञात है। हम रोबोट से पूछ सकते हैं, "क्या सफेद घोड़ा इस खाने पर कूद सकता है?"
  • यदि रोबोट कहता है "हाँ" लेकिन नियम कहते हैं "नहीं," तो हम बिल्कुल जानते हैं कि शतरंज के बोर्ड का उसका आंतरिक मानचित्र टूटा हुआ है।
  • क्योंकि "संदर्भ जगत" (शतरंज के नियम) कंप्यूटर द्वारा पूरी तरह से परिभाषित है, इसलिए हमें यह अनुमान लगाने के लिए मनुष्यों की आवश्यकता नहीं है कि रोबोट झूठ बोल रहा है या नहीं। कंप्यूटर इसे तुरंत जान लेता है।

यह क्यों महत्वपूर्ण है

इस परिभाषा पर सहमत होकर, शोधकर्ता अंततः:

  1. तुलना कर सकते हैं: हम यह बता सकते हैं कि क्या कोई नई तकनीक वास्तव में हैलुसिनेशन को कम करती है या उसने केवल खेल के नियम बदल दिए हैं।
  2. जान सकते हैं कि क्या ठीक करना है: यदि रोबोट हैलुसिनेशन कर रहा है क्योंकि वह पूरे दस्तावेज़ को नहीं देख पा रहा है, तो हम "दृष्टिकोण" (View) को ठीक करते हैं। यदि वह अपनी याददाश्त को प्राथमिकता देने के कारण दस्तावेज़ को अनदेखा कर रहा है, तो हम "संघर्ष नियम" (Conflict Rule) को ठीक करते हैं।
  3. बड़े परीक्षण बना सकते हैं: हम हजारों परीक्षण परिदृश्य (जैसे लाखों शतरंज की पहेलियाँ) बना सकते हैं जहाँ हम 100% समय उत्तर जानते हैं, बिना हर एक के लिए मनुष्यों द्वारा ग्रेडिंग किए।

संक्षेप में: पेपर कहता है, "यह बहस करना बंद करें कि हैलुसिनेशन क्या है। यह केवल तब होता है जब रोबोट की कहानी उस वास्तविकता से मेल नहीं खाती जिसके विरुद्ध हमने परीक्षण करने का निर्णय लिया था। आइए बेहतर मानचित्र और बेहतर परीक्षण बनाएँ ताकि हम रोबोट के टूटे हुए दिशा-सूचक यंत्र (compass) को ठीक कर सकें।"

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →