← नवीनतम पेपर
💬 NLP

DMFI: A Dual-Modality Log Analysis Framework for Insider Threat Detection with LoRA-Tuned Language Models

यह शोध पत्र DMFI का प्रस्ताव करता है, जो एक द्वैत-मोडैलिटी (dual-modality) ढांचा है जो स्वतंत्र रूप से LoRA-ट्यून किए गए भाषा मॉडलों और एक विभेदक अनुकूलन रणनीति के माध्यम से सिमेंटिक और व्यवहार संबंधी लॉग विश्लेषणों को संलयित करके इनसाइडर थ्रेट डिटेक्शन को बढ़ाता है, और CERT डेटासेट्स पर अत्याधुनिक तरीकों की तुलना में बेहतर सटीकता प्राप्त करता है।

मूल लेखक: Kaichuan Kong, Dongjie Liu, Xiaobo Jin, Guanggang Geng, Zhiying Li, Jian Weng

प्रकाशित 2026-03-24
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Kaichuan Kong, Dongjie Liu, Xiaobo Jin, Guanggang Geng, Zhiying Li, Jian Weng

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि एक विशाल, हलचल भरा ऑफिस बिल्डिंग है। हर दिन हजारों कर्मचारी अंदर आते हैं, अपनी डेस्क पर बैठते हैं, ईमेल भेजते हैं, वेब ब्राउज़ करते हैं और लॉग आउट करते हैं। उनमें से अधिकांश बस अपना काम कर रहे होते हैं। लेकिन कभी-कभी, उनमें से कोई "भेड़ की खाल में भेड़िया" होता है—एक इनसाइडर थ्रेट (आंतरिक खतरा) जो रहस्य चुराने या कंपनी को नुकसान पहुँचाने की कोशिश कर रहा है।

समस्या यह है कि ये बुरे तत्व बहुत चतुर होते हैं। वे हैकर्स की तरह नहीं दिखते जो सामने का दरवाजा तोड़कर घुस रहे हों; वे सामान्य कर्मचारियों की तरह दिखते हैं, बस थोड़ा अलग तरीके से या अजीब समय पर काम कर रहे होते हैं। पारंपरिक सुरक्षा गार्ड (पुराने कंप्यूटर प्रोग्राम) आईडी चेक करने वाले बाउंसरों की तरह हैं। यदि आपके पास आईडी है, तो वे आपको अंदर आने देते हैं। वे यह नहीं बता सकते कि आप अंदर होने के दौरान संदिग्ध व्यवहार कर रहे हैं या नहीं।

यह पेपर DMFI पेश करता है, जो एक नया, सुपर-स्मार्ट सुरक्षा सिस्टम है जिसे इन चालाक इनसाइडर्स को पकड़ने के लिए डिज़ाइन किया गया है। DMFI को एक दो-सदस्यीय जासूसी टीम के रूप में सोचें जो एक बहुत ही उन्नत AI मस्तिष्क (एक लार्ज लैंग्वेज मॉडल) द्वारा संचालित है।

DMFI कैसे काम करता है, यहाँ सरल अवधारणाओं में दिया गया है:

1. दो जासूस: "द रीडर" (The Reader) और "द ऑब्जर्वर" (The Observer)

पूरी तस्वीर को एक साथ देखने के बजाय, DMFI जांच को दो अलग-अलग दृश्यों में विभाजित करता है, जैसे दो जासूस जिनके पास अलग-अलग विशेषज्ञता हो।

  • जासूस A: द रीडर (सिमेंटिक व्यू - अर्थ संबंधी दृश्य)

    • वे क्या करते हैं: यह जासूस लोग जो कर रहे हैं उसकी वास्तविक सामग्री (content) को पढ़ता है। वे ईमेल, वेबसाइट के शीर्षक और चैट संदेशों को पढ़ते हैं।
    • उपमा: एक जासूस की कल्पना करें जो संदिग्ध की डायरी पढ़ रहा है। वे केवल यह नहीं देख रहे हैं कि व्यक्ति ने कब लिखा; वे शब्दों को पढ़ रहे हैं ताकि यह देख सकें कि क्या व्यक्ति चोरी करने, फिशिंग करने या किसी डकैती की योजना बनाने के बारे में बात कर रहा है।
    • तकनीक: यह भाषा की बारीकियों को समझने के लिए प्रशिक्षित एक AI का उपयोग करता है। यदि एक ईमेल कहता है, "हे, क्या तुम मुझे गुप्त फाइलें भेज सकते हो?" तो रीडर तुरंत खतरे को पहचान लेता है।
  • जासूस B: द ऑब्जर्वर (बिहेवियरल व्यू - व्यवहार संबंधी दृश्य)

    • वे क्या करते हैं: यह जासूस शब्दों को अनदेखा करता है और गति के पैटर्न पर ध्यान केंद्रित करता है। वे देखते हैं कि कोई कब लॉग इन हुआ, वे कहाँ थे, उन्होंने क्या क्लिक किया, और उन्होंने किन फाइलों को छुआ।
    • उपमा: एक जासूस की कल्पना करें जो सुरक्षा कैमरे देख रहा है। उन्हें इस बात से फर्क नहीं पड़ता कि व्यक्ति क्या कह रहा है; उन्हें इस बात से फर्क पड़ता है कि कोई रात के 3:00 बजे सर्वर रूम में घुस रहा है, एक USB ड्राइव लगा रहा है, और फिर बाहर भाग रहा है।
    • नवाचार (The "4W" Trick): रॉ लॉग्स (raw logs) अव्यवस्थित और लंबे होते हैं। इसे आसान बनाने के लिए, लेखकों ने एक "4W" समराइज़र (When, Where, What, Which) का आविष्कार किया। यह 50 कार्यों की एक अव्यवस्थित सूची को एक छोटे, स्पष्ट वाक्य में संकुचित कर देता है जैसे: "ऑफिस घंटों के बाद, एक पर्सनल लैपटॉप पर, संवेदनशील फाइलों तक पहुंच बनाई और उन्हें एक बाहरी व्यक्ति को ईमेल किया।" यह पैटर्न को स्पष्ट बना देता है।

2. विशेष प्रशिक्षण (LoRA)

आमतौर पर, एक विशाल AI (जैसे कि एक सुपर-इंटेलिजेंट रोबोट) को एक विशिष्ट कार्य सिखाना महंगा और धीमा होता है। यह एक प्रसिद्ध शेफ को शून्य से एक विशिष्ट सैंडविच बनाना सिखाने जैसा है।

लेखकों ने LoRA नामक एक चतुर शॉर्टकट का उपयोग किया।

  • उपमा: पूरे शेफ को फिर से प्रशिक्षित करने के बजाय, उन्होंने बस उसे इस विशिष्ट सैंडविच के लिए एक विशेष "रेसिपी कार्ड" (एक छोटा सा एड-ऑन) दे दिया। शेफ के पास उसके सभी मौजूदा खाना पकाने के कौशल बरकरार रहते हैं लेकिन वह नई रेसिपी जल्दी और सस्ते में सीख जाता है।
  • परिणाम: उन्होंने दो अलग-अलग "शेफ" (AI मॉडल) को प्रशिक्षित किया। एक संदिग्ध ईमेल पढ़ने में विशेषज्ञ बन गया, और दूसरा अजीब मूवमेंट पैटर्न पहचानने में विशेषज्ञ बन गया।

3. "डबल-चेक" रणनीति (DMFI-B)

पेपर एक विशेष संस्करण पेश करता है जिसे DMFI-B कहा जाता है।

  • उपमा: एक सुरक्षा प्रणाली की कल्पना करें जिसमें दो अलग-अलग अलार्म हैं।
    • अलार्म 1 को केवल यह सिखाया गया है कि "अच्छे लोग" क्या करते हैं।
    • अलार्म 2 को केवल यह सिखाया गया है कि "बुरे लोग" क्या करते हैं।
    • जब कोई नई घटना होती है, तो सिस्टम दोनों अलार्मों से पूछता है: "क्या यह एक अच्छे आदमी जैसा दिखता है या एक बुरे आदमी जैसा?"
  • यह क्यों मदद करता है: यदि कोई बुरा व्यक्ति अच्छा दिखने की कोशिश करता है, तो "बैड गाय अलार्म" फिर भी बज सकता है क्योंकि दोनों अलार्मों के बीच का अंतर बहुत बड़ा होता है। यह सिस्टम को उन दुर्लभ, चालाक खतरों को पकड़ने में बहुत बेहतर बनाता है जिन्हें आमतौर पर मिस कर दिया जाता है।

4. अंतिम निर्णय (द फ्यूजन)

अंत में, दोनों जासूस एक कॉन्फ्रेंस रूम (एक छोटा निर्णय मॉड्यूल) में मिलते हैं।

  • "रीडर" कहता है: "उस ईमेल के शब्द संदिग्ध थे।"
  • "ऑब्जर्वर" कहता है: "समय और फाइल एक्सेस अजीब था।"
  • वे अपने स्कोर को मिलाते हैं। यदि दोनों सहमत हैं, या यदि संयोजन पर्याप्त मजबूत है, तो सिस्टम अलार्म बजाता है: "खतरा पता चला (THREAT DETECTED)।"

यह एक बड़ी बात क्यों है?

  • यह स्मार्ट है: पुराने सिस्टम चीजों को मिस कर देते थे क्योंकि वे केवल नंबरों को देखते थे। यह सिस्टम अर्थ और संदर्भ को समझता है।
  • यह कुशल है: इसे चलाने के लिए किसी इमारत जितने बड़े सुपरकंप्यूटर की आवश्यकता नहीं है; यह वास्तविक कंपनियों के उपयोग के लिए पर्याप्त हल्का है।
  • यह निष्पक्ष है: यह इस तथ्य को संभालता है कि "बुरे लोग" दुर्लभ होते हैं (जैसे घास के ढेर में सुई ढूंढना) बिना बेवजह खतरे का शोर मचाए।

संक्षेप में: DMFI एक ऐसी जासूसी टीम को नियुक्त करने जैसा है जो एक साथ आपके दिमाग को पढ़ सकती है (आपके ईमेल के माध्यम से) और आपके कदमों पर नज़र रख सकती है (आपके कार्यों के माध्यम से), जिसका उपयोग करके वे बुरे लोगों को पकड़ने के लिए एक स्मार्ट, कुशल AI का उपयोग करती है जो आपके बेशकीमती खजाने चुराने की कोशिश कर रहे हैं।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →