MultiPhishGuard: An Explainable and Adaptive Multi-Agent LLM System for Phishing Email Detection
MultiPhishGuard एक व्याख्यात्मक, अनुकूलन योग्य मल्टी-एजेंट LLM फ्रेमवर्क है जो गतिशील रूप से भारित समन्वय और प्रतिकूल प्रशिक्षण वाले विशिष्ट एजेंटों का उपयोग करता है ताकि 97.89% सटीकता प्राप्त करते हुए मानव-पठनीय स्पष्टीकरण प्रदान करने के साथ बेहतर फिशिंग ईमेल डिटेक्शन प्रदर्शन हासिल किया जा सके।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आप एक व्यस्त कार्यालय भवन के मुख्य द्वार पर तैनात एक सुरक्षा गार्ड हैं। आपका काम स्कैमर्स (फिशर्स) को अंदर घुसने से रोकना है, लेकिन आपको वास्तविक कर्मचारियों (वैध ईमेल) को बिना किसी परेशानी के जाने देना भी है।
लंबे समय तक, सुरक्षा गार्डों ने एक सरल "बैन लिस्ट" या नियम पुस्तिका का उपयोग किया: "यदि नाम नकली लगे, तो रोक दो।" लेकिन स्कैमर्स जादूगरों की तरह होते हैं; वे अपने वेश, आवाज़ और तरकीबें इतनी तेज़ी से बदलते हैं कि पुरानी नियम पुस्तिकाएं बेकार हो जाती हैं।
पेश है MultiPhishGuard। इसे केवल एक गार्ड के रूप में नहीं, बल्कि एक बहुत ही स्मार्ट और अनुकूलन योग्य (adaptive) मैनेजर के नेतृत्व में काम करने वाली एक विशेषज्ञ टीम के रूप में सोचें।
विशेषज्ञों की टीम
एक व्यक्ति द्वारा सब कुछ करने के बजाय, MultiPhishGuard इस काम को पांच अलग-अलग विशेषज्ञों के बीच बांट देता है, जिनमें से प्रत्येक "पैकेज" (ईमेल) के एक अलग हिस्से की जांच करता है:
- टेक्स्ट डिटेक्टिव (Text Detective): यह एजेंट ईमेल के संदेश (body) को पढ़ता है। यह अजीब भाषा, तत्काल खतरों या संदिग्ध शब्दों को देखता है, और बाकी सब कुछ अनदेखा कर देता है।
- लिंक इंस्पेक्टर (Link Inspector): यह एजेंट केवल ईमेल के भीतर मौजूद यूआरएल (URLs/वेब लिंक्स) को देखता है। यह जांचता है कि क्या कोई लिंक किसी बुरे गंतव्य को छिपा रहा है या किसी भरोसेमंद साइट का ढोंग कर रहा है।
- हेडर फोरेंसिक (Header Forensic): यह एजेंट ईमेल के "लिफाफे" (मेटाडेटा) की जांच करता है। यह प्रेषक (sender) के पते, डिजिटल हस्ताक्षरों और रूटिंग इतिहास की जांच करता है ताकि यह देखा जा सके कि क्या ईमेल फर्जी बनाया गया था।
- एडवर्सरियल ट्रेनर (Adversarial Trainer - "रेड टीम"): यह एक अनूठा एजेंट है जो एक अभ्यास प्रतिद्वंद्वी के रूप में कार्य करता है। यह टीम को परखने के लिए लगभग असली दिखने वाले चालाकी भरे नकली ईमेल बनाने की कोशिश करता है। यह एक स्पैरिंग पार्टनर की तरह है जो आपको मुक्का मारने की कोशिश करता है ताकि आप बेहतर तरीके से बचना सीख सकें।
- ट्रांसलेटर (Translator - व्याख्या सरल बनाने वाला): पहले तीन एजेंट जटिल, तकनीकी शब्दावली में बात करते हैं। यह एजेंट उनके निष्कर्षों को सरल, सामान्य अंग्रेजी (या भाषा) में अनुवादित करता है जिसे एक आम व्यक्ति समझ सके (जैसे, "यह ईमेल एक स्कैम है क्योंकि प्रेषक का पता कंपनी के नाम से मेल नहीं खाता है," बजाय इसके कि "SPF रिकॉर्ड मिसमैच")।
स्मार्ट मैनेजर (The "Brain")
यह टीम कैसे तय करती है कि किसे सुनना है? अतीत में, सुरक्षा प्रणालियाँ सभी को समान महत्व दे सकती थीं। लेकिन MultiPhisGuard एक स्मार्ट मैनेजर का उपयोग करता है जो PPO (प्रॉक्सिमल पॉलिसी ऑप्टिमाइज़ेशन) नामक एक लर्निंग एल्गोरिदम द्वारा संचालित है।
इस मैनेजर को एक कोच के रूप में समझें जो खेल को वास्तविक समय में देखता है।
- यदि किसी ईमेल में संदिग्ध लिंक है, तो मैनेजर कहता है, "लिंक इंस्पेक्टर की बात ध्यान से सुनो!"
- यदि संदेश अजीब लगता है लेकिन लिंक साफ हैं, तो मैनेजर कहता है, "टेक्स्ट डिटेक्टिव पर ध्यान केंद्रित करो।"
- यदि प्रेषक का विवरण संदिग्ध है, तो वह हेडर फोरेंसिक को बढ़ावा देता है।
मैनेजर हर उस ईमेल से सीखता है जो वह देखता है, और लगातार यह समायोजित करता रहता है कि सबसे अच्छा निर्णय लेने के लिए किसे सबसे अधिक महत्व दिया जाए।
प्रशिक्षण मैदान (The Training Ground)
यह सुनिश्चित करने के लिए कि यह टीम किसी भी चीज़ के लिए तैयार रहे, वे केवल पुराने मामलों का अध्ययन नहीं करते हैं। उनके पास एक ट्रेनिंग लूप है जहाँ "एडवर्सरियल ट्रेनर" नए, चालाकी भरे स्कैम बनाता है जो सिस्टम को बेवकूफ बनाने के लिए डिज़ाइन किए गए हैं। टीम उन्हें पकड़ने की कोशिश करती है, और यदि वे चूक जाते हैं, तो मैनेजर अपनी गलती से सीखता है। यह एक फायर ड्रिल की तरह है जहाँ धुआं विशेष रूप से यह परीक्षण करने के लिए उत्पन्न किया जाता है कि अलार्म काम कर रहे हैं या नहीं।
परिणाम
इस टीम का परीक्षण वास्तविक दुनिया के ईमेल के छह अलग-अलग संग्रहों (कुछ पुराने अभिलेखागार से, कुछ बहुत हालिया) के विरुद्ध किया गया। यहाँ बताया गया है कि अन्य तरीकों की तुलना में वे कैसा प्रदर्शन करते हैं:
- सटीकता (Accuracy): टीम ने 97.89% स्कैम पकड़े।
- गलत अलार्म (False Alarms): उन्होंने केवल 2.73% बार एक वास्तविक ईमेल को स्कैम के रूप में चिह्नित किया (जो अन्य तरीकों की तुलना में बहुत कम है जो अक्सर घबराकर वास्तविक ईमेल को ब्लॉक कर देते हैं)।
- छूटे हुए स्कैम (Missed Scams): उन्होंने वास्तव में केवल 0.20% स्कैम मिस किए।
अन्य "स्मार्ट" प्रणालियों (जैसे कि एक एकल AI जो अकेले सब कुछ करने की कोशिश करता है, या एक प्रणाली जो केवल अपने विचारों को चरण-दर-चरण सूचीबद्ध करती है) की तुलना में, MultiPhishGuard गलत अलार्म से बचने और स्कैमरों को पकड़ने में बहुत बेहतर था।
यह क्यों महत्वपूर्ण है
सबसे बड़ी जीत केवल संख्याएँ नहीं हैं; यह व्याख्या (explanation) है।
- पुराने सिस्टम कह सकते हैं: "इसे ब्लॉक करें।" (और आपको पता भी नहीं चलेगा कि क्यों)।
- MultiPhishGuard कहता है: "हमने इसे इसलिए ब्लॉक किया क्योंकि लिंक एक संदिग्ध साइट पर जाता है, और प्रेषक का नाम डोमेन से मेल नहीं खाता है।"
पेपर यह निष्कर्ष निकालता है कि विशेषज्ञों की एक टीम, एक स्मार्ट मैनेजर जो मौके पर सीखता है, और एक ट्रेनर जो कठिन अभ्यास परिदृश्य बनाता है, का उपयोग करके, हम न केवल अधिक मजबूत बल्कि मनुष्यों के लिए अधिक विश्वसनीय और समझने में आसान सुरक्षा प्रणाली बना सकते हैं।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।