← नवीनतम पेपर
💻 computer science

SolAgent: A Specialized Multi-Agent Framework for Solidity Code Generation

SolAgent एक विशिष्ट मल्टी-एजेंट फ्रेमवर्क है जो Forge कंपाइलर और Slither स्टैटिक एनालाइज़र को संयोजित करने वाले एक ड्यूल-लूप रिफाइनमेंट मैकेनिज्म का लाभ उठाता है, जो सुरक्षित, कार्यात्मक सॉलिडिटी स्मार्ट कॉन्ट्रैक्ट्स उत्पन्न करने में मौजूदा LLMs और AI टूल्स से काफी बेहतर प्रदर्शन करता है, जबकि उच्च गुणवत्ता वाले ट्रेजेक्टरीज को छोटे ओपन-सोर्स मॉडल्स में डिस्टिल करने में भी सक्षम बनाता है।

मूल लेखक: Wei Chen, Zhiyuan Peng, Xin Yin, Chao Ni, Chenhao Ying, Bang Xie, Yuan Luo

प्रकाशित 2026-02-02
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Wei Chen, Zhiyuan Peng, Xin Yin, Chao Ni, Chenhao Ying, Bang Xie, Yuan Luo

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

यहाँ SolAgent पेपर का स्पष्टीकरण दिया गया है, जिसे सरल अवधारणाओं और रचनात्मक उपमाओं (analogies) के साथ विभाजित किया गया है।

बड़ी समस्या: एक "जादुई पेन" के साथ डिजिटल किले बनाना

कल्पना कीजिए कि आप एक डिजिटल किला (एक स्मार्ट कॉन्ट्रैक्ट) बना रहे हैं जिसमें लाखों डॉलर रखे हैं। एक बार जब आप इसे बना लेते हैं और दरवाजा बंद कर देते हैं, तो आप एक भी ईंट बदल नहीं सकते। यदि आप एक छोटी सी गलती करते हैं, तो चोर अंदर घुसकर सब कुछ चुरा सकते हैं।

हाल ही में, हमें एक "जादुई पेन" (लार्ज लैंग्वेज मॉडल्स या LLMs) मिला है जो हमारे लिए तुरंत कोड लिख सकता है। लेकिन यह पेन एक बहुत ही आत्मविश्वासी लेकिन अनुभवहीन प्रशिक्षु (apprentice) की तरह है। यह सुंदर दिखने वाला कोड लिखता है जो दिखने में सही लगता है, लेकिन अक्सर:

  1. यह काम नहीं करता: कोड में छिपी हुई त्रुटियाँ होती हैं जिसके कारण यह तुरंत क्रैश हो जाता है (कंपाइलेशन विफलता)।
  2. यह असुरक्षित है: यह गुप्त बैकडोर खोल देता है जिनका हैकर्स फायदा उठा सकते हैं।
  3. यह अटक जाता है: यह एक बार में पूरा किला लिखने की कोशिश करता है, घबरा जाता है, और हार मान लेता है।

पेपर का तर्क है कि केवल जादुई पेन से "एक सुरक्षित कॉन्ट्रैक्ट लिखें" कहना पर्याप्त नहीं है। हमें एक बेहतर प्रणाली की आवश्यकता है।


समाधान: SolAgent (मास्टर बिल्डर टीम)

लेखकों ने SolAgent बनाया है, जो केवल एक AI नहीं है, बल्कि मिलकर काम करने वाले विशेषज्ञ AI एजेंटों की एक टीम है। कोड को एक बार लिखने और फिर उम्मीद करने के बजाय, SolAgent इस तरह काम करता है जैसे मानव विशेषज्ञ सॉफ्टवेयर बनाते हैं: लिखें, जाँचें, सुधारें, दोहराएँ।

SolAgent को एक निर्माण स्थल (construction site) के रूप में सोचें जहाँ दो मुख्य कर्मचारी और उच्च-तकनीकी उपकरणों का एक सेट है:

1. दो कर्मचारी

  • कोडिंग एजेंट (बिल्डर): यह AI आपके अनुरोध (जैसे, "एक ऐसा वॉल्ट बनाएँ जो केवल तभी खुले जब आपके पास चाबी हो") को लेता है और कोड का प्रारंभिक ड्राफ्ट लिखता है।
  • रिफाइनिंग एजेंट (इंस्पेक्टर): यह AI केवल कोड को पढ़ता नहीं है; यह सक्रिय रूप से इसका परीक्षण करता है। यह बिल्डर के काम को देखता है, गलतियाँ ढूँढता है, और बिल्डर को बताता है कि उन्हें ठीक करने के लिए क्या करना चाहिए।

2. उच्च-तकनीकी उपकरण (एक "Dual-Loop" सिस्टम)

SolAgent की प्रतिभा यह है कि यह काम की जाँच करने के लिए दो विशिष्ट उपकरणों का उपयोग करता है, जिससे गुणवत्ता नियंत्रण का एक "dual-loop" बनता है:

  • इनर लूप (द "फोर्ज" टेस्ट):

    • उपमा: कल्पना कीजिए कि एक स्ट्रेस-टेस्ट मशीन आपके वॉल्ट के दरवाजे को तोड़ने की कोशिश कर रही है।
    • यह क्या करता है: यह कोड को एक कंपाइलर (Forge) के माध्यम से चलाता है ताकि यह देखा जा सके कि क्या यह वास्तव में काम करता है। यदि कोड क्रैश होता है या गणित के टेस्ट में फेल हो जाता है, तो रिफाइनिंग एजेंट को एक रिपोर्ट मिलती है कि "यह लाइन टूटी हुई है," और वह इसे ठीक करने के लिए बिल्डर के पास वापस भेज देता है।
    • परिणाम: यह सुनिश्चित करता है कि कोड कार्यात्मक (functional) है।
  • आउटर लूप (द "स्लिथर" सुरक्षा स्कैन):

    • उपमा: कल्पना कीजिए कि एक सुरक्षा विशेषज्ञ मेटल डिटेक्टर लेकर वॉल्ट के चारों ओर घूम रहा है और छिपे हुए जाल या ढीली ईंटों की तलाश कर रहा है।
    • यह क्या करता है: यह ज्ञात सुरक्षा खामियों (जैसे "रीएंट्रेंसी" बग जहाँ एक चोर वॉल्ट को दो बार भुगतान करने के लिए धोखा दे सकता है) को स्कैन करने के लिए एक स्टैटिक एनालाइज़र (Slither) का उपयोग करता है। यदि इसे कोई छेद मिलता है, तो यह रिफाइनिंग एजेंट को उसे तुरंत पैच करने के लिए कहता है।
    • परिणाम: यह सुनिश्चित करता है कि कोड सुरक्षित (secure) है।

3. फ़ाइल सिस्टम (द "लाइब्रेरी कार्ड")

सामान्य AI अक्सर भ्रमित हो जाता है क्योंकि उसे नहीं पता होता कि प्रोजेक्ट में अन्य कौन सी फाइलें मौजूद हैं। SolAgent एक फ़ाइल सिस्टम टूल से लैस है।

  • उपमा: यह अनुमान लगाने के बजाय कि शेड (shed) में कौन से औज़ार हैं, AI वास्तव में शेड का दरवाज़ा खोल सकता है, बक्सों पर लगे लेबल पढ़ सकता है, और काम पूरा करने के लिए सही औज़ार उठा सकता है। यह इसे कई अलग-अलग हिस्सों वाले जटिल प्रोजेक्ट्स को समझने में मदद करता है।

यह कैसे काम करता है: "स्टॉप" बटन

आप सोच सकते हैं, "क्या वे कोड को हमेशा के लिए ठीक करते रहेंगे?"
पेपर एक डायनेमिक स्टॉपिंग मैकेनिज्म पेश करता है। यह एक स्मार्ट टाइमर की तरह है जो जानता है कि कब रुकना है:

  • सफलता: यदि कोड सभी परीक्षणों को पास कर लेता है और इसमें कोई सुरक्षा खामी नहीं है, तो रुक जाएँ।
  • अटक जाना (Stuck): यदि AI बार-बार एक ही गलती करता रहता है (लूपिंग), तो समय बचाने के लिए रुक जाएँ।
  • ठहराव (Stagnation): यदि कुछ प्रयासों के बाद भी कोड में कोई सुधार नहीं हो रहा है, तो रुक जाएँ।

परिणाम: यह क्यों मायने रखता है

शोधकर्ताओं ने SolEval+ (वास्तविक दुनिया के स्मार्ट कॉन्ट्रैक्ट चुनौतियों का एक संग्रह) नामक एक कठिन बेंचमार्क पर SolAgent का परीक्षण किया।

  1. यह बहुत बेहतर काम करता है:

    • मानक AI (केवल "जादुई पेन") पहली बार में लगभग 25% कॉन्ट्रैक्ट सही कर पाता है।
    • SolAgent पहली बार में 64.39% सही कर पाता है। यह सफलता दर से दोगुने से भी अधिक है।
    • उपमा: यदि आप 100 यादृच्छिक लोगों से एक तिजोरी बनाने के लिए कहते हैं, तो 25 ऐसी तिजोरी बना सकते हैं जो काम करती है। SolAgent 100 में से 64 काम करने वाली तिजोरियाँ बनाने वाले मास्टर आर्किटेक्ट की तरह है।
  2. यह अधिक सुरक्षित है:

    • मानव द्वारा लिखे गए कोड की तुलना में, SolAgent ने सुरक्षा संबंधी कमजोरियों को लगभग 40% तक कम कर दिया।
    • उपमा: इसने उन छिपे हुए जालों को ढूँढा और ठीक किया जिन्हें अनुभवी मानव निर्माता भी कभी-कभी छोड़ देते हैं।
  3. यह सस्ता है (द "डिस्टिलेशन" ट्रिक):

    • AI एजेंटों की टीम चलाना महंगा है। इसलिए, लेखकों ने बिल्डर और इंस्पेक्टर के बीच "उच्च-गुणवत्ता वाली बातचीत" (trajectory) ली और उसका उपयोग एक छोटे, सस्ते AI मॉडल (Qwen3-8B) को सिखाने के लिए किया।
    • उपमा: उन्होंने एक मास्टर शेफ की रसोई से नोट्स लिए और एक जूनियर कुक को उसी परफेक्ट डिश को बनाना सिखाया। जूनियर कुक (छोटा मॉडल) बड़े टीम की तरह लगभग उतना ही अच्छा खाना बनाना सीख गया, लेकिन बहुत तेज़ी से और कम खर्च में।

सारांश

SolAgent ब्लॉकचेन कोड लिखने के लिए AI का उपयोग करने का एक नया तरीका है। एक एकल AI पर भरोसा करने के बजाय कि वह पहली बार में सही हो जाए, यह एक टीम स्थापित करता है जो कोड लिखती है, कंपाइलर के साथ उसका परीक्षण करती है, सुरक्षा खामियों के लिए उसे स्कैन करती है, और तब तक गलतियों को सुधारती है जब तक कि वह परफेक्ट न हो जाए। परिणाम यह है कि कोड वर्तमान AI या यहाँ तक कि मानव विशेषज्ञों की तुलना में काफी अधिक विश्वसनीय और सुरक्षित है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →