← नवीनतम पेपर
💻 computer science

MutMem: Cryptographically Authorized Mutation in Persistent Agent Memory

MutMem एक क्रिप्टोग्राफिक रूप से अधिकृत उत्परिवर्तन प्रोटोकॉल (mutation protocol) है जो निरंतर एजेंट मेमोरी के लिए है, जो वेट ट्रांज़िशन और साक्ष्य को साइन करके अखंडता और ट्रैसेबिलिटी सुनिश्चित करता है, जिससे ऐतिहासिक निरंतरता से समझौता किए बिना उच्च रिट्रीवल सटीकता और पॉइज़निंग हमलों के विरुद्ध मजबूत प्रतिरोध प्राप्त होता है।

मूल लेखक: Walid Saidi

प्रकाशित 2026-08-05
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Walid Saidi

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक रोबोटिक दोस्त बना रहे हैं जो कभी कुछ नहीं भूलता। उसे याद है कि आपको पिज्जा में कौन सा टॉपिंग पसंद है, आपके तीसरी कक्षा के शिक्षक का नाम क्या था, और वह समय जब आपने कुत्ते को घुमाने का वादा किया था। लेकिन यहाँ एक पेचीदा बात है: लोग बदलते हैं। शायद अब आप पिज्जा पर अनानास (पाइनएप्पल) से नफरत करने लगे हैं, या आपको एहसास हुआ कि आपकी तीसरी कक्षा की शिक्षिका का नाम वास्तव में "मिसेज स्मिथ" था, न कि "मिस जोन्स"। यदि आपका रोबोटिक दोस्त नई जानकारी आने पर पुरानी यादों को बस मिटा देता है, तो आपको कैसे पता चलेगा कि उसे हैक नहीं किया गया है? आप यह कैसे साबित करेंगे कि बदलाव आपसे आया एक वास्तविक अपडेट था, न कि कोई चालाक वायरस जो आपका रूप धरकर बैठा है? यह आर्टिफिशियल इंटेलिजेंस में "परसिस्टेंट मेमोरी" (स्थिर स्मृति) की समस्या है। वैज्ञानिक ऐसे AI बनाने की कोशिश कर रहे हैं जो वर्षों तक सीख सके और अनुकूलित हो सके, लेकिन उन्हें एक ऐसे तरीके की आवश्यकता है जिससे यह सुनिश्चित हो सके कि वे परिवर्तन अधिकृत और ट्रैक करने योग्य हैं, जैसे कि एक डिजिटल डायरी जिसे बिना किसी निशान छोड़े गुप्त रूप से संपादित नहीं किया जा सकता।

यह शोध पत्र MutMem (शॉर्ट फॉर "म्यूटेबल मेमोरी") नामक एक चतुर प्रणाली पेश करता है जो HOM-AIMOS नामक एक रोबोट ब्रेन इंजन के लिए डिज़ाइन की गई है। MutMem को एक AI के मस्तिष्क के लिए एक अत्यंत सुरक्षित, जादुई बहीखाते (लेजर) के रूप में सोचें। जब नई जानकारी आती है, तो MutMem पुरानी यादों को मिटाने के बजाय, पुरानी याद को सुरक्षित रखता है लेकिन उसके बगल में एक "हस्ताक्षरित नोट" जोड़ देता है। यह नोट कहता है, "हे, हमने इस नए इवेंट के कारण इस स्मृति के महत्व को अपडेट किया है, और यहाँ वह क्रिप्टोग्राफिक प्रमाण है कि यह अपडेट अधिकृत था।" यह बिल्कुल वैसा ही है जैसे आपने लाइब्रेरी की किसी किताब के हाशिए में सुधार लिखा हो, लेकिन वह सुधार एक अद्वितीय, अटूट मोहर (वैक्स सील) के साथ हस्ताक्षरित हो जो यह साबित करे कि यह आपने किया है, किसी चोर ने नहीं। इस प्रणाली में "जहरीली" (पोइज़न्ड) जानकारी को संभालने का भी एक विशेष तरीका है—हैकर द्वारा बोए गए नकली तथ्य। उन नकली तथ्यों को हटाने के बजाय (जो हमले के सबूत को छिपा देगा), MutMem उन्हें रखता है लेकिन उन पर एक बड़े, हस्ताक्षरित "संदिग्ध" (SUSPICIOUS) लेबल के साथ मुहर लगा देता है। इस तरह, AI उस नकली जानकारी को अनदेखा करना जानता है, लेकिन शोधकर्ता बाद में हमले का अध्ययन भी कर सकते हैं।

शोधकर्ताओं ने इस प्रणाली का परीक्षण तीन मुख्य तरीकों से किया। पहला, उन्होंने यह जांचा कि क्या रोबोट अपनी स्मृति का उपयोग करके प्रश्नों के सही उत्तर दे सकता है। LongMemEval नामक एक कठिन परीक्षण पर, रोबोट ने 91.8% उत्तर सही दिए। एक अन्य दीर्घकालिक स्मृति परीक्षण, LoCoMo पर, उसने 74.12% सही उत्तर दिए। ये संख्याएँ दिखाती हैं कि सामान्य कार्यों के लिए स्मृति प्रणाली अच्छी तरह काम करती है।

दूसंतु, उन्होंने सुरक्षा का परीक्षण किया। उन्होंने एक विशेष परीक्षण सूट चलाया जहाँ उन्होंने सिस्टम को अनधिकृत परिवर्तन करने या स्मृतियों को हटाने के लिए छलने की कोशिश की। इस विशिष्ट परिदृश्य में सिस्टम ने हर छेड़छाड़ के प्रयास का सफलतापूर्वक पता लगा लिया, जैसे कि विभिन्न स्मृतियों के बीच हस्ताक्षरों का पुन: उपयोग करने या डिजिटल सील को बदलने की कोशिश करना। हर बार जब कोई बदलाव किया गया, तो उसे एक डिजिटल हस्ताक्षर के साथ लॉक कर दिया गया। यदि कोई भी इन परीक्षणों में स्मृति के साथ छेड़छाड़ करने की कोशिश करता, तो सिस्टम तुरंत टूटी हुई सील को पकड़ लेता। सुरक्षित अपडेट करने की प्रक्रिया भी बहुत तेज़ थी, जिसमें औसतन केवल लगभग 4.865 मिलीसेकंड का समय लगा—जो एक मानव पलक झपकने से भी तेज़ है।

तीसरा, उन्होंने परीक्षण किया कि यह प्रणाली "जहरीले" डेटा को कितनी अच्छी तरह संभालती है। उन्होंने एक हमले का अनुकरण किया जहाँ हैकरों ने रोबोट की स्मृति में 500 नकली, भ्रामक अनुच्छेद इंजेक्ट किए। सिस्टम ने इन नकली अनुच्छेदों को हटाया नहीं; इसके बजाय, इसने उन्हें रखा लेकिन उन्हें हस्ताक्षरित लेबल के साथ "poison_likely" के रूप में चिह्नित किया। जब रोबोट से उन सवालों के बारे में पूछा गया जिनसे हैकर उसे गुमराह करने की कोशिश कर रहे थे, तो सिस्टम ने 97% बार सफलतापूर्वक नकली जानकारी को अनदेखा कर दिया (केवल 3% बार ही रोबစွာ ने गलती से जहरीली जानकारी का उपयोग किया)। महत्वपूर्ण रूप से, सिस्टम हमले के दौरान भी भ्रमित नहीं हुआ या सामान्य प्रश्नों के सही उत्तर देने की अपनी क्षमता नहीं खोई; इसकी सटीकता उच्च बनी रही।

शोध पत्र ने यह देखने के लिए एक विशेष प्रयोग भी चलाया कि यह प्रणाली जहर (पॉइजन) के खिलाफ इतनी अच्छी तरह क्यों काम करती है। उन्होंने पाया कि "हस्ताक्षरित लेबल" ही असली नायक थे। जब रोबोट ने नकली जानकारी को अनदेखा करने के लिए इन लेबलों का उपयोग किया, तो ट्रिकी (चालाकी भरे) सवालों पर इसकी सटीकता 40% से बढ़कर 65% हो गई। बिना लेबलों के, रोबोट आसानी से मूर्ख बन जाता था।

हालाँकि, लेखक बहुत सावधानी से यह कहते हैं कि यह प्रणाली क्या नहीं करती है। यह यह साबित नहीं करती कि स्मृति वास्तव में वास्तविक दुनिया में "सत्य" है। एक रोबोट के पास पूरी तरह से हस्ताक्षरित, अधिकृत स्मृति हो सकती है जो तथ्यात्मक रूप से गलत हो (जैसे यह याद रखना कि आपको अनानास पसंद नहीं है जबकि वास्तव में आपको वह बहुत पसंद है)। यह प्रणाली केवल यह प्रमाणित करती है कि स्मृति को सही व्यक्ति द्वारा अपडेट किया गया था और परिवर्तनों का इतिहास ईमानदार है। यह विश्वास और ट्रैकिंग के लिए एक प्रणाली है, न कि पूर्ण सत्य खोजने के लिए।

अंत में, MutMem दिखाता है कि हम ऐसे AI मेमरी बना सकते हैं जो सीखने और बदलने के लिए पर्याप्त लचीली है, लेकिन यह साबित करने के लिए पर्याप्त सुरक्षित भी है कि बदलाव किसने किए और क्या बदला गया। यह प्रत्येक अपडेट, प्रत्येक संदेह और प्रत्येक सुधार के इतिहास को रखता है, जो सभी अटूट डिजिटल सील के साथ सुरक्षित है, यह सुनिश्चित करते हुए कि भले ही एक AI का मस्तिष्क विशाल और जटिल हो, हम हमेशा उसके विचारों के मार्ग को ट्रैक कर सकते हैं।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →