← नवीनतम पेपर
🤖 AI

AXE: An Agentic eXploit Engine for Confirming Zero-Day Vulnerability Reports

यह शोध पत्र AXE को प्रस्तुत करता है, जो एक मल्टी-एजेंट फ्रेमवर्क है जो वेब कमजोरियों के लिए ठोस एक्सप्लॉइट्स (exploits) उत्पन्न करने को स्वचालित करने के लिए न्यूनतम ग्रे-बॉक्स मेटाडेटा (CWE वर्गीकरण और कोड स्थान) का लाभ उठाता है, जिससे 30% सफलता दर प्राप्त होती है और ज़ीरो-डे रिपोर्टों को मान्य करने में मौजूदा ब्लैक-बॉक्स बेसलाइनों से काफी बेहतर प्रदर्शन होता है।

मूल लेखक: Amirali Sajadi, Tu Nguyen, Kostadin Damevski, Preetha Chatterjee

प्रकाशित 2026-02-17
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Amirali Sajadi, Tu Nguyen, Kostadin Damevski, Preetha Chatterjee

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक विशाल, व्यस्त अपार्टमेंट कॉम्प्लेक्स (एक सॉफ्टवेयर प्रोजेक्ट) के मैनेजर हैं। हर दिन, आपको किरायेदारों और सुरक्षा गार्डों से सैकड़ों पत्र मिलते हैं जिनमें लिखा होता है, "हे, मुझे लगता है कि पीछे के दरवाजे का ताला टूटा हुआ है!" या "किसी ने बेसमेंट में फर्श का एक ढीला हिस्सा पाया है!"

समस्या क्या है? इनमें से अधिकांश सूचनाएं गलत अलार्म (false alarms) हैं। कुछ केवल काल्पनिक हैं ("अगर कोई भूत दीवार के माध्यम से गुजरा, तो वह गिर सकता है"), और अन्य इतनी अस्पष्ट हैं ("दरवाजा टूटा हुआ है") कि आपको पता ही नहीं चलेगा कि वे किस दरवाजे की बात कर रहे हैं या उसे कैसे तोड़ा जा सकता है। आप, मैनेजर, कागजी कार्रवाई में डूब रहे हैं, यह समझने की कोशिश कर रहे हैं कि कौन सी सूचनाएं वास्तविक आपात स्थिति हैं और कौन सी केवल शोर है।

यह बिल्कुल वही समस्या है जिसका सामना सॉफ्टवेयर डेवलपर्स वल्नरेबिलिटी रिपोर्ट्स (vulnerability reports) के साथ करते हैं। उन्हें ऑटोमेटेड स्कैनर्स से अलर्ट की बाढ़ मिलती है, लेकिन उनमें से अधिकांश "फॉल्स पॉजिटिव" (नकली अलार्म) या बहुत अस्पत होते हैं जिन पर कार्रवाई करना मुश्किल होता है।

AXE से मिलिए: "डिटेक्टिव स्क्वाड" (जासूसों की टीम)

यह पेपर AXE (एजेंटिक एक्सप्लॉइट इंजन) को पेश करता है, जो उन पत्रों को पढ़ने और वास्तव में ताले तोड़ने की कोशिश करने के लिए विशेषज्ञ, सुपर-स्मार्ट जासूसों की एक टीम को काम पर रखने जैसा है ताकि यह देखा जा सके कि वे वास्तव में काम करते हैं या नहीं।

यहाँ बताया गया है कि AXE कैसे काम करता है, सरल उपमाओं का उपयोग करके:

1. "ग्रे-बॉक्स" सुराग (The "Grey-Box" Clue)

आमतौर पर, इन जासूसों को बहुत कम जानकारी दी जाती है। उन्हें पूरी इमारत के ब्लूप्रिंट नहीं मिलते, और न ही उन्हें टूटे हुए ताले का नक्शा मिलता है। उन्हें केवल एक छोटा सा नोट मिलता है:

  • सुराग: "पीछे के दरवाजे (CWE वर्गीकरण) के साथ एक समस्या है।"
  • स्थान: "यह तीसरी मंजिल पर, दरवाजे के मैनुअल की लाइन 45 पर है।"
  • पहुंच (Access): उन्हें दरवाजे के मैनुअल (सोर्स कोड) को देखने और दरवाजे को खोलने की कोशिश करने की अनुमति है।

इसे ग्रे-बॉक्स (Grey-Box) दृष्टिकोण कहा जाता है। यह अंधाधुंध अनुमान (ब्लैक-बॉक्स) नहीं है, लेकिन यह पूरी जानकारी के साथ किया गया कार्य भी नहीं है। यह एक स्मार्ट, लक्षित जांच है।

2. चार-विशेषज्ञों की टीम (Multi-Agent)

एक अकेले जासूस द्वारा सब कुछ करने (मैनुअल पढ़ने, ताला खोलने और भागने) के बजाय, AXE काम को चार विशेषज्ञों में विभाजित करता है जो एक-दूसरे से बात करते हैं:

  • रणनीतिकार (The Strategist - दिमाग): यह जासूस सुरागों और मैनुअल को देखता है। वह एक योजना बनाता है: "ठीक है, अगर मैं हैंडल को तीन बार घुमाता हूँ और फिर दरवाजे को लात मारता हूँ, तो शायद यह खुल जाए।" वही है जो सोचता है, "रुको, शायद मुझे पहले एक चाबी की जरूरत है?"
  • एक्सप्लोरर (The Explorer - लाइब्रेरियन): जब रणनीतिकार फंस जाता है, तो वह एक्सप्लोरर से मदद मांगता है। एक्सप्लोरर लाइब्रेरी (सोर्स कोड) की ओर दौड़ता है, दरवाजे के बारे में विशिष्ट पृष्ठ ढूंढता है, और कहता है, "हे, मैनुअल कहता है कि हैंडल को छूने से पहले आपको एक विशिष्ट चाबी (एक 'nonce') की आवश्यकता है।"
  • एक्सप्लॉइटर (The Exploiter - ताला खोलने वाला): यह व्यावहारिक (hands-on) जासूस है। वह योजना और चाबी की जानकारी लेता है और वास्तव में घुसने की कोशिश करता है। वह दरवाजा खटखटाता है, लात मारता है और ताला खोलने की कोशिश करता है। यदि विफल रहता है, तो वह रणनीतिकार को बताता है कि वह क्यों विफल हुआ (जैसे, "दरवाजा जाम हो गया क्योंकि मेरे पास चाबी नहीं थी")।
  • PoC जनरेटर (The PoC Generator - रिपोर्टर): यदि ताला आखिरकार टूट जाता है, तो यह व्यक्ति एक स्पष्ट, चरण-दर-चरण मैनुअल लिखता है: "यहाँ बताया गया है कि हमने वास्तव में कैसे प्रवेश किया, ताकि आप इसे ठीक कर सकें।"

3. "कोशिश, विफलता, सीखो" लूप (The "Try, Fail, Learn" Loop)

AXE का जादू यह है कि यह एक कोशिश के बाद हार नहीं मानता।

  • प्रयास 1: एक्सप्लॉइटर दरवाजे को लात मारने की कोशिश करता है। धड़ाक! दरवाजा नहीं खुलता।
  • फीडबैक: रिपोर्टर कहता है, "यह इसलिए विफल हुआ क्योंकि आपके पास चाबी नहीं थी।"
  • प्रयास 2: रणनीतिकार योजना को अपडेट करता है। "ठीक है, एक्सप्लोरर, पहले चाबी ढूंढो।" एक्सप्लोरर मैनुअल में चाबी ढूंढ लेता है। एक्सप्लॉइटर फिर से कोशिश करता है। क्लिक! दरवाजा खुल जाता है!

योजना → प्रयास → सीखना → सुधार का यह लूप AXE को उन पहेलियों को हल करने की अनुमति देता है जिन्हें एक एकल, एक-बार की कोशिश करने वाला AI हल करने में विफल रहता।

यह एक बड़ी बात क्यों है?

शोधकर्ताओं ने वास्तविक दुनिया के सुरक्षा छिद्रों (जिन्हें CVE-Bench कहा जाता है) की एक सूची पर AXE का परीक्षण किया।

  • पुराना तरीका (Black-Box): यदि आप मैनुअल देखे बिना अंधे होकर अनुमान लगाते हैं, तो आप केवल 10% बार सफल होते हैं।
  • नया तरीका (AXE): मैनुअल को देखकर और टीम दृष्टिकोण का उपयोग करके, AXE 30% बार सफल हुआ। यह 3 गुना बेहतर है।

इससे भी महत्वपूर्ण बात यह है कि जब AXE सफल होता है, तो वह केवल यह नहीं कहता कि "यह टूटा हुआ है।" वह आपको एक प्रूफ-ऑफ-कॉन्सेप्ट (PoC) देता है। यह ताला खोलने की एक वीडियो रिकॉर्डिंग की तरह है, जिसमें एक नोट है: "इसे ठीक करने के लिए, ताले को बदलकर डेडबोल्ट (deadbolt) लगा दें।" यह डेवलपर के अनुमान लगाने के घंटों के समय को बचाता है।

"मानवीय" खामियां (The "Human" Flaws)

पेपर ने यह भी देखा कि AXE कभी-कभी क्यों विफल होता है। यह पता चलता है कि AI जासूस मानवीय गलतियाँ करते हैं:

  • सुराग को गलत समझना: उन्हें लगा कि दरवाजा टूटा हुआ है जबकि वास्तव में खिड़की टूटी हुई थी।
  • तैयारी को भूल जाना: उन्होंने गेट को अनलॉक किए बिना ही दरवाजे को लात मारने की कोशिश की।
  • जल्दी हार मान लेना: उन्होंने कुछ बार कोशिश की, विफल हुए, और रुक गए, यह नहीं समझ पाए कि उन्हें बस थोड़ा अलग कोण (angle) आज़माना था।

निचोड़ (The Bottom Line)

AXE एक ऐसा टूल है जो सॉफ्टवेयर टीमों को नकली अलार्म पर समय बर्बाद करने से रोकने में मदद करता है। एक इंसान द्वारा यह पता लगाने में घंटों बिताने के बजाय कि रिपोर्ट किया गया बग असली है या नहीं, AXE एक तीव्र-गति वाली टेस्टिंग टीम के रूप में कार्य करता है। यह उपलब्ध सुरागों का उपयोग करके सॉफ्टवेयर को तोड़ने की कोशिश करता है। यदि यह सफल होता है, तो यह डेवलपर्स को एक स्पष्ट "आपको इसे ठीक करने की आवश्यकता है" रिपोर्ट देता है। यदि यह विफल होता है, तो यह उन्हें बताता है, "हमने उपलब्ध जानकारी के साथ सब कुछ आज़माया, और यह सुरक्षित लगता है," जिससे उन्हें अपने काम को प्राथमिकता देने में मदद मिलती है।

यह विशेषज्ञ ताला बनाने वालों (locksmiths) की एक टीम होने जैसा है जो जल्दी से आपको बता सकते हैं, "हाँ, यह ताला टूटा हुआ है, इसे ठीक करने का तरीका यहाँ है," या "नहीं, यह ताला ठीक है, इस पर चिंता करना छोड़ दें।"

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →