ClawVM: Harness-Managed Virtual Memory for Stateful Tool-Using LLM Agents
यह शोध पत्र ClawVM को प्रस्तुत करता है, जो एक हार्नेस-प्रबंधित वर्चुअल मेमोरी लेयर है जो टाइप किया गया पेज रेजिडेंसी (typed page residency) और वैलिडेटेड राइटबैक (validated writeback) को लागू करके LLM एजेंटों के लिए नियत और ऑडिट करने योग्य स्टेट ड्यूरेबिलिटी (state durability) सुनिश्चित करता है, जिससे नगण्य ओवरहेड के साथ पॉलिसी-नियंत्रित विफलताओं को समाप्त किया जा सके।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आप एक अत्यंत बुद्धिमान व्यक्तिगत सहायक (एक AI एजेंट) हैं जो अपने पूरे जीवन को प्रबंधित करने की कोशिश कर रहे हैं: अपने ईमेल, अपना कैलेंडर, अपना स्मार्ट होम और अपने कार्य प्रोजेक्ट्स। आप इस सहायक से एक जटिल सप्ताह की योजना बनाने के लिए कहते हैं, और वह काम करना शुरू कर देता है।
लेकिन यहाँ एक समस्या है: सहायक के पास एक बहुत छोटा "वर्किंग डेस्क" (कंटेक्स्ट विंडो/context window) है। वह एक बार में केवल कुछ ही पन्नों के नोट्स रख सकता है। जैसे-जैसे बातचीत लंबी होती जाती है, उसे नए नोट्स के लिए जगह बनाने के लिए पुराने नोट्स फेंकने पड़ते हैं।
वर्तमान AI सिस्टम में, यह "फेंकने" की प्रक्रिया अव्यवस्थित और अविश्वसनीय है। यह एक अराजक इंटर्न की तरह है जो:
- महत्वपूर्ण नियम भूल जाता है: वे आपके उस निर्देश को भी फेंक सकते हैं कि "मंगलवार को कभी मीटिंग शेड्यूल न करें" ताकि जगह बचाई जा सके।
- प्रगति खो देता है: यदि आप बातचीत को रीसेट करने के लिए कहते हैं, तो वे अपनी पूरी टू-डू लिस्ट को नोटबुक में सहेजने के बजाय उसे मिटा सकते हैं।
- चीजों को ओवरराइट कर देता है: वे अनजाने में एक महत्वपूर्ण नोट के ऊपर दूसरा नोट लिख सकते हैं, जिससे मूल डेटा नष्ट हो जाता है।
इससे AI भ्रमित हो जाता है, एक ही कार्य को दोहराता है, या वह भूल जाता है कि उसे क्या करना था।
पेश है ClawVM: एक "स्मार्ट फाइलिंग सिस्टम"
यह शोध पत्र ClawVM को पेश करता है, जो इन AI सहायकों के लिए एक अत्यंत व्यवस्थित, नियमों का पालन करने वाला वर्चुअल मेमोरी मैनेजर है। AI को यादृच्छिक रूप से यह तय करने देने के बजाय कि उसे क्या रखना है और क्या फेंकना है, ClawVM, AI और उसकी मेमोरी के बीच एक सख्त लेकिन सहायक लाइब्रेरियन या प्रोजेक्ट मैनेजर की तरह बैठता है।
यह कैसे काम करता है, इसके लिए सरल उपमाओं का उपयोग किया गया है:
1. "टाइप्ड पेजेस" (व्यवस्थित फोल्डर)
बिखरे हुए कागजों के ढेर के बजाय, ClawVM सूचना के प्रत्येक टुकड़े को एक लेबल वाले फोल्डर (एक "पेज") के रूप में मानता है।
- नियम: कुछ फोल्डर "क्रिटिकल" (महत्वपूर्ण) होते हैं (जैसे आपके "डू नॉट डिस्टर्ब" नियम)। ये अनिवार्य रूप से डेस्क पर रहने चाहिए, भले ही डेस्क भर गया हो।
- जादू: यदि डेस्क बहुत अधिक भीड़भाड़ वाला हो जाता है, तो लाइब्रेरियन उस फोल्डर को बस फेंक नहीं देता। वे उसे छोटा कर देते हैं!
- पूर्ण संस्करण: "दोपहर 2 बजे जॉन के साथ Q3 बजट पर चर्चा करने के लिए मीटिंग।"
- संकुचित (Compressed) संस्करण: "2 PM: जॉन, Q3 बजट।"
- पॉइंटर संस्करण: बस एक स्टिकी नोट जिस पर लिखा हो "कैबिनेट में फाइल #402 देखें।"
- मुख्य बिंदु: AI जरूरत पड़ने पर हमेशा पूर्ण विवरण वापस प्राप्त कर सकता है, लेकिन वह संभव होने पर छोटे संस्करण का उपयोग करके जगह बचाता है।
2. "मिनिमम फिडेलिटी" (सुरक्षा जाल)
प्रत्येक फोल्डर की एक न्यूनतम गुणवत्ता सेटिंग होती है।
- कन्स्ट्रेंट (Constraint) फोल्डर्स: "मंगलवार को कभी शेड्यूल न करें।" लाइब्रेरियन कहता है, "इसे एक विशिष्ट आकार से कम नहीं किया जा सकता। इसे हमेशा पठनीय होना चाहिए।"
- एविडेंस (Evidence) फोल्डर्स: "बॉस का ईमेल।" यदि डेस्क भर जाता है, तो इसे एक पॉइंटर में छोटा किया जा सकता है, लेकिन सिस्टम गारंटी देता है कि इसे तुरंत पुनः प्राप्त किया जा सकता है।
- परिणाम: AI दबाव में होने पर भी महत्वपूर्ण निर्देशों का सार कभी नहीं खोता है।
3. "वैलिडेटेड राइटबैक" (डबल-चेक सेव)
पुराने सिस्टम में, जब AI कोई कार्य पूरा करता है, तो वह अपने नोट्स को हार्ड ड्राइव पर सहेजने की कोशिश कर सकता है। कभी-कभी, AI बाधित हो जाता है, या "सेव" बटन छोड़ दिया जाता है, और सारा काम खो जाता है।
- ClawVM का दृष्टिकोण: AI के अगले चरण पर जाने से पहले (या रीसेट होने से पहले), लाइब्रेरियन एक सख्त जांच करता है।
- "क्या आपने इसे सही ढंग से लिखा है?"
- "क्या आप किसी महत्वपूर्ण चीज़ को ओवरराइट करने की कोशिश कर रहे हैं?"
- "क्या यह एक विनाशकारी परिवर्तन है?"
- यदि उत्तर "नहीं" या "खतरनाक" है, तो लाइब्रेरियन सेव को अस्वीकार कर देता है और एक त्रुटि (error) दर्ज करता है। यह सुनिश्चित करता है कि जब AI कल वापस आता है, तो कुछ भी गायब या दूषित नहीं होता है।
4. "फॉल्ट ऑब्जर्वर" (अलार्म सिस्टम)
यदि AI कुछ भूल जाता है या यदि सिस्टम में जगह समाप्त हो जाती है, तो ClawVM इसे चुपचाप नहीं होने देता। यह एक अलार्म बजाता है।
- AI के चुपचाप विफल होने के बजाय, सिस्टम कहता है: "हे! हमने 'ट्यूजडे रूल' खो दिया क्योंकि डेस्क बहुत भरा हुआ था। हमें नीति को ठीक करने की आवश्यकता है।"
- यह डेवलपर्स के लिए यह समझना आसान बनाता है कि AI क्यों विफल हुआ और नियमों को ठीक करना आसान बनाता है, बजाय इसके कि वे केवल अनुमान लगाएं।
यह क्यों मायने रखता है?
शोधकर्ताओं ने वास्तविक दुनिया के परिदृश्यों (जैसे कोडिंग, डिबगिंग और प्लानिंग) के साथ इस प्रणाली का परीक्षण किया।
- ClawVM के बिना: AI ने औसतन प्रति सत्र 68 बार गलतियाँ कीं, कार्यों को दोहराया और निर्देशों को भूल गया।
- ClawVM के साथ: AI ने इनमें से एक भी विशिष्ट मेमोरी संबंधी गलती नहीं की। इसने सब कुछ याद रखा जो उसे याद रखना चाहिए था, भले ही "डेस्क" बहुत छोटा था।
निष्कर्ष
ClawVM को एक परीक्षा के लिए रट्टा मार रहे अराजक छात्र (जो अपने आधे नोट्स भूल जाता है) और एक रंग-कोडित, बैकअप युक्त और नियम-लक्षित फाइलिंग सिस्टम वाले पेशेवर प्रोजेक्ट मैनेजर के बीच के अंतर के रूप में देखें।
यह AI को बुद्धिमत्ता के मामले में "अधिक स्मार्ट" नहीं बनाता है; यह बस AI को विश्वसनीय बनाता है। यह सुनिश्चित करता है कि AI की मेमोरी टिकाऊ, ऑडिट योग्य और सुरक्षित है, ताकि आप इस पर भरोसा कर सकें कि वह अपना मानसिक संतुलन खोए बिना जटिल, दीर्घकालिक कार्यों को संभाल सकता है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।