← नवीनतम पेपर
🤖 AI

SkillLens: Adaptive Multi-Granularity Skill Reuse for Cost-Efficient LLM Agents

SkillLens एक पदानुक्रमित ढांचा (hierarchical framework) है जो अनुकूलन योग्य पुनर्प्राप्ति (adaptive retrieval) और चयनात्मक परिशोधन (selective refinement) के लिए कौशल को बहु-स्तर के ग्राफ में व्यवस्थित करके LLM एजेंट के प्रदर्शन और लागत-दक्षता को अनुकूलित करता है, जिससे यह MuLocbench और ALFWorld जैसे बेंचमार्क पर मौजूदा फ्लैट स्किल-आधारित बेसलाइन से बेहतर प्रदर्शन करता है।

मूल लेखक: Yongliang Miao, Ziyang Yu, Liang Zhao, Bowen Zhu, Hasibul Haque

प्रकाशित 2026-05-12
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Yongliang Miao, Ziyang Yu, Liang Zhao, Bowen Zhu, Hasibul Haque

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक जटिल समस्या को हल करने की कोशिश कर रहे हैं, जैसे कि एक खराब टोस्टर को ठीक करना या एक अस्त-व्यस्त अलमारी को व्यवस्थित करना। आपके पास पुराने निर्देश मैनुअल (कौशल/skills) का एक विशाल पुस्तकालय है जो अन्य लोगों द्वारा लिखे गए हैं।

पुराना तरीका (समस्या):
वर्तमान AI एजेंट इन मैनुअल को पूरे 'किताबों' की तरह देखते हैं। यदि आपको एक टोस्टर ठीक करने की आवश्यकता है, तो AI "उपकरण मरम्मत" (Appliance Repair) की पूरी किताब उठा लेता है और उसे अपने दिमाग में डाल देता है।

  • समस्या: यह अव्यवस्थित है। उस किताब में टोस्टर ठीक करने के बारे में बेहतरीन सलाह हो सकती है, लेकिन उसमें ब्लेंडर और टोस्टर ओवन को ठीक करने के बारे में भी 50 पन्ने हो सकते हैं। AI अप्रासंगिक जानकारी से भ्रमित हो जाता है, उसे पढ़ने में समय बर्बाद करता है, और यहाँ तक कि गलतियाँ (hallucinations) भी कर सकता है क्योंकि वह उन निर्देशों का पालन करने की कोशिश कर रहा होता है जो उसके काम के नहीं हैं।
  • विकल्प: यदि AI को लगता है कि पूरी किताब ज्यादातर गलत है, तो वह पूरी किताब को फेंक देता है और सब कुछ शून्य से शुरू करके खुद समझने की कोशिश करता है। यह धीमा और महंगा है।

नया तरीका (SkillLens):
यह शोध पत्र SkillLens पेश करता है, जो इन निर्देश मैनुअल का उपयोग करने का एक स्मार्ट तरीका है। एक कौशल (skill) को एक बड़े, अपरिवर्तनीय ब्लॉक के रूप में देखने के बजाय, SkillLens हर कौशल को एक चार-स्तरीय पदानुक्रम (four-layer hierarchy) में तोड़ देता है, जैसे कि गुड़िया के सेट (nesting dolls) या एक कॉर्पोरेट संगठनात्मक चार्ट:

  1. पॉलिसी (बॉस): "हमें टोस्टर ठीक करने की आवश्यकता है।" (उच्च-स्तरीय लक्ष्य)
  2. रणनीति (मैनेजर): "पहले इसे अनप्लग करें, फिर हीटिंग एलिमेंट की जाँच करें।" (योजना)
  3. प्रक्रिया (सुपरवाइजर): "पीछे का पैनल हटाने के लिए पेचकस (screwdriver) का उपयोग करें। यदि यह फंसा हुआ है, तो इसे धीरे से हिलाएं।" (चरण-दर-चरण नियम)
  4. प्रिमिटिव (वर्कर): "पेचकस को घड़ी की दिशा में घुमाएं।" (छोटा, परमाणु स्तर का कार्य)

SkillLens कैसे काम करता है:
जब AI के सामने कोई नया कार्य आता है, तो वह केवल पूरी किताब नहीं उठाता। वह एक आवर्धक लेंस (magnifying glass) के साथ एक स्मार्ट लाइब्रेरियन की तरह कार्य करता है:

  1. बीज (Seed) खोजें: यह एक प्रासंगिक मैनुअल ढूंढता है (जैसे, "उपकरण मरम्मत")।
  2. ज़ूम इन और ज़ूम आउट: पूरी चीज़ पढ़ने के बजाय, यह "विषय सूची" (पदानुक्रम) को देखता है।
  3. वेरिफायर (न्यायाधीश): एक विशेष AI न्यायाधीश प्रत्येक मैनुअल के हिस्से को देखता है और निर्णय लेता है कि क्या करना है:
    • स्वीकार करें (Accept): "यह हिस्सा एकदम सही है। इसे वैसा ही रहने दें।"
    • विघटित करें (Decompose): "यह अनुभाग बहुत अस्पष्ट है। आइए अगले स्तर को देखने के लिए इसे खोलें।"
    • पुनर्लेखन करें (Rewrite): "यह हिस्सा काफी हद तक सही है, लेकिन हमारे देश के लिए वोल्टेज गलत है। आइए बस इस वाक्य में थोड़ा बदलाव करें।"
    • छोड़ दें (Skip): "यह ब्लेंडर के बारे में है। इसे पूरी तरह से अनदेखा करें।"

परिणाम:
AI एक अनुकूलित, संक्षिप्त निर्देश पत्र बनाता है जिसमें केवल पुराने मैनुअल के बेहतरीन हिस्से होते हैं, और साथ ही छोटे, स्थानीय सुधार भी शामिल होते हैं। वह ब्लेंडर के निर्देशों को पढ़ने में समय बर्बाद नहीं करता, और न ही उसे पूरी किताब को फिर से लिखने की आवश्यकता होती है।

"विकास" (समय के साथ स्मार्ट बनना):
शोध पत्र एक ऐसी प्रणाली का भी वर्णन करता है जहाँ AI अपनी गलतियों से सीखता है। यदि AI किसी कार्य में विफल रहता है, तो वह केवल दोबारा प्रयास नहीं करता; वह एक "गैप रिपोर्ट" (gap report) लिखता है।

  • क्या वह इसलिए विफल हुआ क्योंकि उसके पास सही मैनुअल नहीं था? (एजेंट के पुस्तकालय को अपडेट करें)।
  • क्या वह इसलिए विफल हुआ क्योंकि उसने गलत मैनुअल उठाया या उसे उसे संपादित (edit) करना नहीं पता था? (जज/न्यायाधीश के नियमों को अपडेट करें)।

वास्तविक दुनिया का प्रमाण:
लेखकों ने दो प्रकार के कार्यों पर इसका परीक्षण किया:

  1. कोड में बग ढूंढना (MuLocbench): जैसे कि एक विशाल सॉफ्टवेयर प्रोजेक्ट में टाइपो (typo) ढूंढना। SkillLens अन्य तरीकों की तुलना में सटीक फ़ाइल और फंक्शन को पिनपॉइंट करने में बहुत बेहतर था, खासकर जब कार्य के लिए बहुत विशिष्ट, विस्तृत ज्ञान की आवश्यकता थी।
  2. आभासी घरेलू काम (ALFWorld): जैसे कि एक रोबोट जो वीडियो गेम में एक अस्त-व्यस्त कमरे को साफ करने की कोशिश कर रहा है। SkillLens ने सफलता दर को 45% से बढ़ाकर 51% से अधिक कर दिया, जिससे पता चलता है कि यह जटिल, बहु-चरणीय कार्यों को बेहतर ढंग से संभाल सकता है।

संक्षेप में:
SkillLens AI को केवल निर्देश मैनुअल की नकल करने या उन्हें फेंक देने से रोकता है। इसके बजाय, यह एक मास्टर एडिटर की तरह कार्य करता है, जो अच्छे हिस्सों को काटता है, खराब हिस्सों को सुधारता है, और अप्रासंगिक हिस्सों को हटा देता है ताकि काम के लिए एक आदर्श, लागत-कुशल मार्गदर्शिका बनाई जा सके।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →