A Multi-Agent Framework for Automated Exploit Generation with Constraint-Guided Comprehension and Reflection
यह शोध पत्र Vulnsage प्रस्तुत करता है, जो एक मल्टी-एजेंट फ्रेमवर्क है जो कोड विश्लेषण, एक्सप्लॉयट जनरेशन और पुनरावृत्ति प्रतिबिंब (iterative reflection) के लिए विशिष्ट एजेंटों को व्यवस्थित करके मानव सुरक्षा शोधकर्ताओं का अनुकरण करता है ताकि प्रभावी ढंग से कमजोरियों को सत्यापित किया जा सके और एक्सप्लॉयट उत्पन्न किए जा सकें, जिससे यह मौजूदा उपकरणों से काफी बेहतर प्रदर्शन करता है और 146 वास्तविक दुनिया के ज़ीरो-डे (zero-day) भेद्यताओं की खोज करता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आप सॉफ्टवेयर से बने एक विशाल, हलचल भरे शहर के सुरक्षा गार्ड हैं। यह शहर हजारों पहले से बने लेगो ब्लॉक्स (ओपन-सोर्स लाइब्रेरी) का उपयोग करके बनाया गया है जिन्हें डेवलपर्स एक विशाल स्टोर से उठाते हैं। समस्या यह है कि कुछ लेगो ब्लॉक्स में छिपे हुए जाल या टूटे हुए ताले हो सकते हैं जिनका उपयोग हैकर्स घुसपैठ करने के लिए कर सकते हैं।
पारंपरिक रूप से, सुरक्षा गार्ड इन जालों को खोजने के लिए दो मुख्य तरीकों का उपयोग करते हैं:
- नियम पुस्तिका की जाँच (स्टैटिक एनालिसिस): वे ब्लूप्रिंट पढ़ते हैं और कहते हैं, "हे, यह दरवाजा संदिग्ध लग रहा है!" लेकिन वे इतने सावधान होते हैं कि वे हर चीज़ को संदिग्ध घोषित कर देते हैं, यहाँ तक कि सामने के दरवाजे को भी। यह गलत अलार्मों का एक पहाड़ खड़ा कर देता है जिसे जांचने में इंसानों को वर्षों लग जाते हैं।
- अचानक धक्का देना (फज़िंग/सिम्बोलिक एक्जीक्यूशन): वे दरवाजे को खोलने के लिए उस पर रैंडम वस्तुएं फेंककर या ताले की गणितीय पहेली को हल करने की कोशिश करके देखते हैं। यदि ताला जटिल है (जैसे कोई पहेली), तो वे अटक जाते हैं या हार मान लेते हैं।
एंट्रिए वल्नसेज (VulnSage): डिटेक्टिव स्क्वाड
यह पेपर VulnSage को पेश करता है, जो एक ऐसा नया सिस्टम है जो केवल ब्लूप्रिंट नहीं देखता या रैंडम पत्थर नहीं फेंकता। इसके बजाय, यह विशेषज्ञ मानव जासूसों की एक टीम की तरह काम करता जो एक स्मार्ट मैनेजर के नेतृत्व में मिलकर काम करते हैं।
यह टीम इस तरह काम करती है (एक सरल उपमा का उपयोग करते हुए):
1. मैनेजर (सुपरवाइजर एजेंट)
मैनेजर को टीम कैप्टन के रूप में सोचें। वे खुद भारी काम नहीं करते हैं। इसके बजाय, वे केस फाइल (कोड) को देखते हैं, तय करते हैं कि अगले लिए किस जासूस की आवश्यकता है, और टीम को ट्रैक पर रखते हैं। वे कहते हैं, "ठीक है, हमें एक संदिग्ध दरवाजा मिला है। चलिए एनालिस्ट को इसे देखने के लिए बुलाते हैं, फिर बिल्डर को इसे खोलने की कोशिश करने के लिए, और यदि यह विफल रहता है, तो रिफ्लेक्टर को यह समझने के लिए कि क्यों।"
2. एनालिस्ट (कोड एनालाइजर एजेंट)
यह जासूस एक फोरेंसिक एक्सपर्ट है। वे केवल दरवाजे को नहीं देखते; वे फ्रंट गेट से लेकर बैक वॉल्ट तक के पूरे रास्ते का पता लगाते हैं। वे ब्लूप्रिंट देखते हैं और कहते हैं, "वॉल्ट तक पहुँचने के लिए, आपको लॉबी, फिर लिफ्ट, और फिर हॉलवे से गुजरना होगा। साथ ही, लिफ्ट तभी काम करेगी जब आपके पास एक विशिष्ट की-कार्ड हो।" वे पहेली को सुलझाने के लिए आवश्यक सभी नियम और सुराग इकट्ठा करते हैं।
3. बिल्डर (कोड जनरेशन एजेंट)
यह एक मास्टर क्राफ्ट्समैन है। वे एनालिस्ट से मिले सुरागों को लेते हैं और दरवाजे को खोलने के लिए एक "चाबी" (एक्सप्लॉइट) बनाने की कोशिश करते हैं।
- जादुई ट्रिक: ताले की गणितीय पहेली को हल करने के बजाय (जो कंप्यूटर के लिए कठिन है), बिल्डर ने पहले देखे गए लाखों अन्य घरों को देखा है। वे कहते हैं, "मुझे पता है कि लोग इस प्रकार के ताले के लिए चाबियाँ कैसे बनाते हैं। मैं बस उसी स्टाइल की नकल करूँगा।" वे एक सुपर-स्मार्ट AI (LLM) का उपयोग करते हैं जिसने लगभग हर कोडबुक को पढ़ा है ताकि चाबी का सही आकार अनुमान लगाया जा सके।
4. टेस्टर (वैलिडेशन एजेंट)
यह एक फील्ड एजेंट है। वे बिल्डर द्वारा बनाई गई चाबी को लेते हैं और उसे एक सुरक्षित, अलग कमरे (सैंडबॉक्स) में आज़माते हैं।
- क्या यह काम आया? यदि दरवाजा खुल जाता है, तो वे चिल्लाते हैं, "सफलता! हमने एक वास्तविक भेद्यता (vulnerability) ढूंढ ली है!"
- क्या यह विफल रहा? यदि चाबी टूट जाती है या दरवाजा जाम हो जाता है, तो वे इसे केवल फेंक नहीं देते। वे ठीक से रिपोर्ट करते हैं कि यह क्यों विफल हुआ: "चाबी बहुत बड़ी थी," या "लिफ्ट काम नहीं कर रही थी क्योंकि हम पावर स्विच भूल गए थे।"
5. रिफ्लेक्टर्स (रिफ्लेक्शन एजेंट)
यह एक थिंक टैंक है। जब टेस्टर विफल हो जाता है, तो रिफ्लेक्टर्स हस्तक्षेप करते हैं।
- द फिक्सर: वे विफलता की रिपोर्ट देखते हैं और कहते, "आह, बिल्डर पावर स्विच शामिल करना भूल गया। चलिए बिल्डर को उस सुधार के साथ फिर से प्रयास करने के लिए कहते हैं।"
- द स्केप्टिक (संदेहवादी): कभी-कभी, वे एनालिस्ट के सुरागों को देखते हैं और कहते, "रुको एक मिनट। एनालिस्ट को लगा कि यह एक जाल है, लेकिन करीब से देखने पर, दरवाजा वास्तव में अंदर से लॉक है। यह एक फॉल्स अलार्म (गलत अलार्म) है। चलिए इस पर समय बर्बाद करना बंद करते हैं।"
यह पुराने तरीकों से बेहतर क्यों है?
- पुराना तरीका (द लोन वुल्फ): एक अकेला AI एक साथ सब कुछ करने की कोशिश करता है। वह अभिभूत हो जाता है, सुराग भूल जाता है, या मतिभ्रम (hallucination) का शिकार हो जाता है। यह एक ही व्यक्ति को आँख पर पट्टी बांधकर एनालिस्ट, बिल्डर और टेस्टर तीनों होने के लिए कहने जैसा है।
- VulnSage (द स्क्वाड): काम को छोटे चरणों में तोड़कर और अलग-अलग "एजेंटों" को विशेषज्ञ बनाने से, सिस्टम भ्रमित होने से बच जाता है। यदि चाबी विफल हो जाती है, तो टीम केवल हार नहीं मानती; वे गलती को ठीक करने और फिर से प्रयास करने के लिए एक संरचित बातचीत करते हैं।
परिणाम
इस पेपर ने वास्तविक दुनिया के सॉफ्टवेयर पर इस "डिटेक्टिव स्क्वाड" का परीक्षण किया।
- उन्होंने पिछले सर्वोत्तम उपकरणों की तुलना में 34% अधिक वास्तविक कमजोरियां (vulnerabilities) खोजीं।
- उन्होंने लोकप्रिय सॉफ्टवेयर में 146 बिल्कुल नए (जीरो-डे) दोष खोजे जिनके बारे में पहले कोई नहीं जानता था।
- उन्होंने इंसानों को हजारों गलत अलार्मों की जांच करने से बचाया क्योंकि सिस्टम ने जल्दी ही पहचान लिया कि, "नहीं, यह कोई जाल नहीं है।"
संक्षेप में: VulnSage सॉफ्टवेयर को हैक करने के डरावने, जटिल काम को "डिटेक्टिव, बिल्डर और रिफ्लेक्टर" के एक सहयोगात्मक खेल में बदल देता है। यह पिछले कोड से सीखने की AI की क्षमता का उपयोग करता है, जिसे परीक्षण और सुधार की एक सख्त प्रक्रिया के साथ जोड़ा गया है, ताकि पहले की तुलना में अधिक तेज़ी से और अधिक सटीकता से वास्तविक सुरक्षा खामियों को खोजा जा सके।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।