Detecting Malicious Intents in Smart Contracts with Pre-trained Programming Language Models
यह शोध पत्र SmartIntentV2 को प्रस्तुत करता है, जो एक अत्याधुनिक मॉडल है जो एक डोमेन-अनुकूलित रूप से प्री-ट्रेंड BERT-आधारित प्रोग्रामिंग लैंग्वेज मॉडल को BiLSTM क्लासिफिकेशन नेटवर्क के साथ एकीकृत करके स्मार्ट कॉन्ट्रैक्ट्स में दुर्भावनापूर्ण डेवलपर इरादों का पता लगाने में अपने पूर्ववर्ती और GPT-4.1 से काफी बेहतर प्रदर्शन करता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
ब्लॉकचेन की दुनिया की कल्पना एक विशाल, हलचल भरे डिजिटल शहर के रूप में करें जहाँ लोग स्मार्ट कॉन्ट्रैक्ट्स (Smart Contracts) नामक स्वचालित वेंडिंग मशीनें बनाते हैं। ये मशीनें अपने आप चलती हैं, पैसा रखती हैं और बिना किसी मानव प्रबंधक के व्यापार करती हैं। आमतौर पर, ये पूरी तरह से काम करती हैं। लेकिन कभी-कभी, एक चालाक डेवलपर मशीन के कोड में एक "बैकडोर" या एक छिपा हुआ जाल बना सकता है। वे इसे इस तरह प्रोग्राम कर सकते हैं कि यह अचानक सारा पैसा चुरा ले, मशीन को फ्रीज कर दे ताकि कोई कुछ भी न खरीद सके, या कीमतें अनुचित तरीके से बदल दे।
इन छिपे हुए जालों का पता लगाना घास के ढेर में सुई खोजने जैसा है, लेकिन यह घास का ढेर जटिल कंप्यूटर कोड की लाखों लाइनों से बना है।
यह शोध पत्र एक नए, अत्यंत बुद्धिमान सुरक्षा गार्ड SmartIntentV2 को प्रस्तुत करता है। यह कैसे काम करता है, यहाँ सरल भाषा में समझाया गया है:
1. समस्या: "बुरे इरादे" का जासूस
अतीत में, सुरक्षा विशेषज्ञों ने एक जासूस बनाया था जिसे SmartIntentNN कहा जाता था। यह बुरे लोगों को पकड़ने में काफी अच्छा था। यह एक कॉन्ट्रैक्ट को देख सकता था और कह सकता था, "हे, यह एक 'फी' (Fee) वाला जाल लग रहा है" या "यह उपयोगकर्ताओं को 'ब्लैकलिस्ट' करने की कोशिश कर रहा है।"
हालाँकि, इसकी कुछ कमजोरियाँ थीं:
- यह थोड़ा धीमा और कम समझ वाला था: यह कोड को एक इंसान द्वारा किताब पढ़ने की तरह, शब्द दर शब्द पढ़ता था, बिना गहरे अर्थ या संदर्भ को समझे।
- यह दुर्लभ बुरे लोगों को छोड़ देता था: यदि किसी विशिष्ट प्रकार का घोटाला बहुत दुर्लभ था, तो जासूस अक्सर उसे अनदेखा कर देता था क्योंकि उसने उसके पर्याप्त उदाहरण नहीं देखे थे।
- इसे बारीकियों को समझने में कठिनाई होती थी: यह कभी-कभी एक हानिरहित विशेषता को एक दुर्भावनापूर्ण जाल समझ लेता था।
2. समाधान: SmartIntentV2 (द "सुपर-रीडर")
लेखकों ने जासूस को अपग्रेड करके SmartIntentV2 बना दिया। इस अपग्रेड को एक विशाल अनुभव और एक विशेष प्रशिक्षण नियमावली के साथ जासूस को अपग्रेड करने के रूप में समझें।
A. विशेष प्रशिक्षण (SmartBERT)
सबसे बड़ा अपग्रेड एक नया मस्तिष्क घटक है जिसे SmartBERT कहा जाता है।
- पुराना तरीका: कल्पना करें कि आप एक सामान्य "कार कैसे ठीक करें" मैनुअल पढ़कर एक विशिष्ट ब्रांड की फेरारी को ठीक करना सीखने की कोशिश कर रहे हैं। आप बुनियादी बातें जान जाएंगे, लेकिन आप उस विशिष्ट फेरारी की खासियतों को मिस कर देंगे।
- नया तरीका: लेखकों ने एक सामान्य AI मॉडल (CodeBERT) लिया और उसे विशेष रूप से अध्ययन करने के लिए 16,000 वास्तविक स्मार्ट कॉन्ट्रैक्ट्स खिलाए। यह जासूस को एक विशेष "फेरारी स्कूल" भेजने जैसा है जहाँ वह हजारों कॉन्ट्रैक्ट्स को पढ़ता है, ब्लॉकचेन कोड की अनूठी शब्दावली, चालों और पैटर्न को सीखता है।
- परिणाम: यह नया मॉडल, SmartBERT, स्मार्ट कॉन्ट्रैक्ट्स की "बोली" को पूरी तरह से समझता है। यह जानता है कि जब कोई दुर्भावनापूर्ण डेवलपर जाल छिपाने की कोशिश कर रहा होता है, तो वह कैसा दिखता है।
B. "क्लास-बैलेंस्ड" प्रशिक्षण (निष्पक्षता का समाधान)
वास्तविक दुनिया में, कुछ घोटाले (जैसे "हनीपॉट्स") बहुत दुर्लभ होते हैं, जबकि अन्य (जैसे "फी") आम होते हैं। पुराना जासूस सामान्य घोटालों को पकड़ने में बहुत अच्छा था लेकिन दुर्लभ घोटालों को पकड़ने में बहुत खराब था क्योंकि प्रशिक्षण के दौरान उसने उन्हें बहुत कम देखा था।
नया सिस्टम एक Class-Balanced Training रणनीति का उपयोग करता है।
- उपमा: कल्पना करें कि एक शिक्षक छात्र को ग्रेड दे रहा है। यदि छात्र को केवल "सेब" के बारे में प्रश्न मिलते हैं, तो वह सेब के टेस्ट में तो पास हो जाएगा लेकिन "संतरे" के टेस्ट में फेल हो जाएगा।
- समाधान: नया प्रशिक्षण तरीका जासूस को हर प्रकार के घोटाले पर समान रूप से अभ्यास करने के लिए मजबूर करता है, भले ही वे दुर्लभ क्यों न हों। यह सुनिश्चित करता है कि जासूस "संतरे" को इसलिए अनदेखा न करे क्योंकि वे दुर्लभ हैं।
C. "फोकल लॉस" (कठिन चीजों पर ध्यान केंद्रित करना)
सिस्टम एक तकनीक का भी उपयोग करता है जिसे Binary Focal Loss कहा जाता है।
- उपमा: जब आप जगलिंग (juggling) सीख रहे होते हैं, तो जब आप इसमें अच्छे होते हैं तो आप ऊब जाते हैं। लेकिन जब आप गेंद गिरा देते हैं, तो आप इस बात पर अतिरिक्त ध्यान देते हैं कि आपने गेंद क्यों गिराई।
- समाधान: AI को उन "आसान" कॉन्ट्रैक्ट्स को अनदेखा करने के लिए प्रोग्राम किया गया है जिन्हें वह पहले से ही सुरक्षित जानता है। इसके बजाय, यह अपनी सारी ऊर्जा उन "कठिन" कॉन्ट्रैक्ट्स पर केंद्रित करता है जो भ्रमित करने वाले हैं या संदिग्ध दिखते हैं। यह इसे ट्रिकी जालों को पकड़ने में बहुत अधिक तेज बनाता है।
3. परिणाम: दिग्गजों को हराना
लेखकों ने 10,000 वास्तविक स्मार्ट कॉन्ट्रैक्ट्स पर SmartIntentV2 का परीक्षण किया। परिणाम प्रभावशाली थे:
- सटीकता (Accuracy): इसने 97.89% बार सही उत्तर दिया।
- गति और लागत: यह चलाने में अविश्वसनीय रूप से तेज़ और सस्ता है।
- दिग्गजों को हराना: उन्होंने इसकी तुलना GPT-4 से की, जो प्रसिद्ध AI है जो कविता और कोड लिख सकता है।
- GPT-4 ने केवल लगभग 56% बार सही उत्तर दिया।
- GPT-4 ने केवल 100 कॉन्ट्रैक्ट्स को चेक करने के लिए 11 सेकंड लिए और $2.88 खर्च किए।
- SmartIntentV2 ने वही काम 2.6 सेकंड में और मुफ्त (केवल बिजली के खर्च पर) में कर दिया।
विशाल AI क्यों हार गया? GPT-4 एक "जनरलिस्ट" (सामान्यज्ञ) है। वह सब कुछ (खाना बनाना, इतिहास, कोडिंग) के बारे में थोड़ा-थोड़ा जानता है। लेकिन SmartIntentV2 एक "स्पेशलिस्ट" (विशेषज्ञ) है। यह केवल स्मार्ट कॉन्ट्रैक्ट्स को जानता है, लेकिन यह उन्हें किसी और की तुलना में बेहतर जानता है।
4. यह क्यों मायने रखता है
यह केवल बेहतर गणित के बारे में नहीं है; यह लोगों के पैसे की सुरक्षा के बारे में है।
- उपयोगकर्ताओं के लिए: इसका अर्थ है कम घोटाले और सुरक्षित ऐप्स।
- डेवलपर्स के लिए: यह उन्हें हैकर्स से पहले बग खोजने में मदद करता है।
- उद्योग के लिए: यह साबित करता है कि आपको विशिष्ट समस्याओं को हल करने के लिए एक विशाल, महंगे AI की आवश्यकता नहीं है। सही डेटा पर प्रशिक्षित एक छोटा, विशिष्ट AI अक्सर बहुत बेहतर होता है।
सारांश
SmartIntentV2 को एक अत्यधिक प्रशिक्षित सुरक्षा गार्ड के रूप में समझें जिसने डिजिटल बैंक वॉल्ट के विशिष्ट ब्लूप्रिंट का अध्ययन करने में कई साल बिताए हैं। एक सामान्य सुरक्षा गार्ड के विपरीत जो दरवाजा लॉक करना जानता है लेकिन इस विशिष्ट बैंक के अलार्म कोड नहीं जानता, SmartIntentV2 हर छिपे हुए जाल, हर बैकडोर और हर चाल को जानता है जो एक चोर इस्तेमाल कर सकता है। यह अपने विशिष्ट काम के लिए दुनिया के सबसे बड़े AI मॉडलों की तुलना में बहुत तेज़, सस्ता और बहुत अधिक स्मार्ट है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।