← नवीनतम पेपर
💬 NLP

WorldDB: A Vector Graph-of-Worlds Memory Engine with Ontology-Aware Write-Time Reconciliation

WorldDB एक नवीन वेक्टर ग्राफ-ऑफ-वर्ल्ड्स मेमोरी इंजन है जो पुनरावर्ती, कंटेंट-एड्रेसड नोड्स और प्रोग्रामेटिक, राइट-टाइम एज हैंडलर्स का उपयोग करता है ताकि विरोधाभासों को सुलझाया जा सके और ऑडिट ट्रेल्स बनाए रखे जा सकें, जिससे पारंपरिक रिट्रीवल-ऑगमेंटेड जनरेशन सिस्टम की विखंडन और पहचान संबंधी सीमाओं को पार करते हुए लॉन्ग-टर्म एजेंटिक मेमोरी बेंचमार्क पर अत्याधुनिक सटीकता (96.40%) प्राप्त की जा सके।

मूल लेखक: Harish Santhanalakshmi Ganesan

प्रकाशित 2026-04-21
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Harish Santhanalakshmi Ganesan

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप पिछले छह महीनों में अपने एक दोस्त के साथ हुई बातचीत को याद करने की कोशिश कर रहे हैं।

पुराना तरीका (वर्तमान AI मेमोरी):
अभी, अधिकांश AI चैटबॉट्स की मेमोरी एक ढेर सारे बिखरे हुए स्टिकी नोट्स (sticky notes) की तरह काम करती है।

  • यदि आप जनवरी में AI को बताते हैं "मैं ऑस्टिन में रहता हूँ" और जून में "मैं शिकागो चला गया", तो AI केवल दो नोट्स देखता है। उसे यह नहीं पता कि अभी कौन सा सच है।
  • यदि आप एक नोट में "सारा" का उल्लेख करते हैं और दूसरे में "प्रोजेक्ट मैनेजर" का, तो AI उन्हें दो अलग-अलग लोग समझता है।
  • उत्तर खोजने के लिए, AI को इन हजारों नोट्स को पढ़ना पड़ता है, जिससे वह अक्सर भ्रमित हो जाता है या सबसे महत्वपूर्ण नोट को बीच में कहीं खो देता है। इसे "कॉन्टेक्स्ट रॉट" (context rot) कहा जाता है।

नया तरीका (WorldDB):
यह पेपर WorldDB पेश करता है, जो AI के याद रखने का एक नया तरीका है। स्टिकी नोट्स के ढेर के बजाय, एक विशाल, जीवित रूसी गुड़ियों (Russian dolls) के नेस्टेड लाइब्रेरी की कल्पना करें, जहाँ हर गुड़िया के अपने नियम और एक जादुई लाइब्रेरियन हैं।

यहाँ बताया गया है कि WorldDB कैसे काम करता है, जिसे तीन सरल विचारों में विभाजित किया गया है:

1. "द वर्ल्ड" (नेस्टेड डॉल्स/गुड़िया)

WorldDB में, जानकारी का हर टुकड़ा केवल टेक्स्ट की एक लाइन नहीं है; वह एक वर्ल्ड (World) है।

  • एक "वर्ल्ड" को एक घर के अंदर एक छोटे कमरे के रूप में सोचें। उस कमरे के अंदर, आप अन्य कमरे (सब-वर्ल्ड्स) रख सकते हैं।
  • यदि आप "किचन वर्ल्ड" में हैं, तो आप केवल किचन से जुड़े तथ्यों को देखते हैं। यदि आप "गार्डन वर्ल्ड" के बारे में जानना चाहते हैं, तो आपको एक विशिष्ट दरवाजे (एक एज/edge) के माध्यम से वहां जाना होगा।
  • यह क्यों मदद करता है: यह AI को भ्रमित होने से रोकता है। वह जानता है कि कौन सा तथ्य किस "कमरे" का है, ताकि वह आपकी बचपन की यादों को आपके वर्तमान काम के विवरणों के साथ न मिला दे।

2. "इम्यूटेबल लेजर" (अपरिवर्तनीय पत्थर की पट्टिका)

पुराने तरीके में, यदि आप किसी तथ्य को अपडेट करना चाहते थे, तो AI बस पुराने नोट पर कुछ लिख देता था। यह इस बारे में भ्रम पैदा करता है कि कल क्या सच था बनाम आज क्या सच है।

  • WorldDB में, हर तथ्य को पत्थर पर उकेरा जाता है। एक बार पत्थर पर उकेरने के बाद आप उसे बदल नहीं सकते।
  • यदि आप किसी तथ्य को अपडेट करना चाहते हैं (जैसे, "मैं शिकागो चला गया"), तो आप पुराने पत्थर को मिटाते नहीं हैं। आप एक नया पत्थर उकेरते हैं जिसमें लिखा होता है "मैं शिकागो चला गया" और पुराने पत्थर के साथ एक नोट जोड़ देते हैं कि "यह अब समाप्त (expired) हो गया है।"
  • जादू: क्योंकि हर पत्थर अद्वितीय है और पिछले वाले से जुड़ा हुआ है, यह सिस्टम इतिहास की एक पूर्ण, अटूट श्रृंखला बनाता है। यदि कोई चतुराई से किसी तथ्य को बदलने की कोशिश करता है, तो पूरी श्रृंखला टूट जाती है, और सिस्टम को तुरंत पता चल जाता है। यह एक मर्कल ट्री (Merkle tree) (एक क्रिप्टोग्राफिक ऑडिट ट्रेल) की तरह है जो स्वचालित रूप से होता है।

3. "स्मार्ट लाइब्रेरियन" (एजेस एज प्रोग्राम्स/कनेक्शन एक प्रोग्राम के रूप में)

पुराने सिस्टम में, दो तथ्यों के बीच का संबंध (जैसे "सारा" और "मैनेजर") केवल एक लेबल है। यह एक स्थिर स्ट्रिंग है।

  • WorldDB में, कनेक्शन (एज/edge) एक छोटा रोबोट या स्मार्ट कॉन्ट्रैक्ट है।
  • जब आप एक नया तथ्य जोड़ने का प्रयास करते हैं, तो रोबोट उसे अंदर आने देने से पहले नियमों की जांच करता है।
    • "सुपरसीड" (Supersede) रोबोट: यदि आप कहते हैं "मैं शिकागो में रहता हूँ," तो यह रोबोट स्वचालित रूप से "मैं ऑस्टिन में रहता हूँ" वाले तथ्य को जाकर बंद कर देता है, उसे इतिहास के रूप में चिह्नित करता है। यह उसे हटाता नहीं है; यह बस कहता है, "यह अब वर्तमान सत्य नहीं है।"
    • "कॉन्ट्राडिक्ट" (Contradict) रोबोट: यदि आप कहते हैं "मुझे पिज्जा नापसंद है" और बाद में कहते हैं "मुझे पिज्जा पसंद है," तो यह रोबोट दोनों को हटाता नहीं है। यह उन्हें अगल-बगल रखता है और एक संघर्ष (conflict) के रूप में फ्लैग करता है, जो आपके निर्णय का इंतज़ार करता है कि कौन सा सच है।
    • "सेम एज़" (Same As) रोबोट: यदि आप "सारा" कहते हैं और बाद में "मैनेजर," तो यह रोबोट तुरंत उन्हें मर्ज नहीं करता है। यह आपके अनुमोदन के लिए एक "विलय प्रस्ताव" (Merge Proposal) मेज पर रखता है, ताकि AI गलती से दो अलग-अलग 'सारा' नाम के लोगों को न मिला दे।

परिणाम: यह एक बड़ी बात क्यों है?

शोधकर्ताओं ने इस प्रणाली का परीक्षण LongMemEval नामक एक बहुत कठिन मेमोरी टेस्ट पर किया (जिसमें लंबी बातचीत के 500 प्रश्न शामिल हैं)।

  • पुराने सिस्टम (जैसे Hydra DB): लगभग 90% सही थे। वे अच्छे थे, लेकिन वे कुछ हफ्तों के बाद भूल जाते थे कि "सारा" कौन थी, या तारीखों के बारे में भ्रमित हो जाते थे।
  • WorldDB: 96.4% सही था।

"परफेक्ट मेमोरी" का रूपक:
कल्पना कीजिए कि आप 10 वर्षों तक चलने वाले एक केस को सुलझाने वाले जासूस हैं।

  • पुराना AI: आपको 10,000 ढीली तस्वीरों का एक बॉक्स थमाता है। कुछ धुंधली हैं, कुछ डुप्लिकेट हैं, और कुछ अलग-अलग समय की हैं। आपको अनुमान लगाना पड़ता है कि कौन सी महत्वपूर्ण हैं।
  • WorldDB: आपको एक पूरी तरह से व्यवस्थित फाइलिंग कैबिनेट थमाता है।
    • यह जानता है कि "फोटो A" आपके संदिग्ध की वर्तमान फोटो है, और "फोटो B" उसकी पुरानी फोटो (संग्रहित) है।
    • यह जानता है कि फोटो A में "सारा" ही वही व्यक्ति है जो फोटो B में "मैनेजर" थी।
    • यह जानता है कि यदि आप पूछते हैं "सारा 2022 में कहाँ रहती थी?", तो यह उसे 2024 का पता नहीं दिखाएगा।

सारांश में

WorldDB एक मेमोरी इंजन है जो तथ्यों को केवल खोजे जाने वाले टेक्स्ट के बजाय जीवित, सांस लेते हुए अस्तित्वों की तरह मानता है जिनका अपना इतिहास है।

  1. रिकर्सिव (Recursive): यह तथ्यों को नेस्टेड "वर्ल्ड्स" में व्यवस्थित करता है ताकि कुछ भी आपस में न मिले।
  2. इम्यूटेबल (Immutable): यह कभी मिटाता नहीं है; यह केवल आर्काइव करता है, जिससे एक पूर्ण इतिहास बनता है।
  3. एक्टिव (Active): तथ्यों के बीच के संबंध "स्मार्ट प्रोग्राम" हैं जो स्वचालित रूप से अपडेट, विरोधाभास और विलय (merge) को संभालते हैं।

यह AI एजेंटों को महीनों या वर्षों तक बिना "भ्रमित" हुए या "भूलने" के चलने की अनुमति देता है, जिससे वे केवल चैटबॉट्स के बजाय वास्तविक साथी बन जाते हैं जो विंडो बंद करते ही रीसेट नहीं होते।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →