← नवीनतम पेपर
🤖 machine learning

LogNEO: A GPT-Neo Reinforcement Learning Framework for Accurate Real-Time Log Anomaly Detection

LogNEO एक नवीन लॉग विसंगति पहचान (log anomaly detection) फ्रेमवर्क है जो प्रमुख बेंचमार्क पर अत्याधुनिक सटीकता और वास्तविक समय के प्रदर्शन को प्राप्त करने के लिए PPO का उपयोग करके एक स्थिति-जागरूक (position-aware), तेजी से क्षय होने वाले (exponentially decaying) रिवॉर्ड स्कीम के साथ GPT-Neo को फाइन-ट्यून करता है।

मूल लेखक: David Eje, Tanmay Sharma, Khush Patel, Manuel Mazzara, Leonard Johard

प्रकाशित 2026-06-09
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: David Eje, Tanmay Sharma, Khush Patel, Manuel Mazzara, Leonard Johard

मूल पेपर CC0 1.0 (http://creativecommons.org/publicdomain/zero/1.0/) के तहत सार्वजनिक डोमेन को समर्पित है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक विशाल फैक्ट्री के 24 घंटे के निगरानी फीड (surveillance feed) को देख रहे एक सुरक्षा गार्ड हैं। हर सेकंड, हजारों कर्मचारी (कंप्यूटर सिस्टम) आपको छोटे-छोटे नोट्स भेज रहे हैं कि वे क्या कर रहे हैं: "मशीन A शुरू हुई," "पार्ट B आया," "मशीन C रुकी।"

ज्यादातर समय, ये नोट्स एक अनुमानित लय का पालन करते हैं। लेकिन कभी-कभी, कोई कर्मचारी गलती कर देता है, कोई मशीन टूट जाती है, या कोई हैकर चुपके से घुस आता है। ये विसंगतियां (anomalies) हैं। आपका काम सामान्य नोट्स के समुद्र में उस अजीब नोट को पहचानना है, इससे पहले कि फैक्ट्री में विस्फोट हो जाए।

यह शोध पत्र LogNEO को पेश करता है, जो इस काम को करने के लिए बनाया गया एक नया "सुपर-गार्ड" है, जो किसी भी अन्य व्यक्ति की तुलना में इसे बेहतर और तेज़ी से कर सकता है। यह कैसे काम करता है, यहाँ सरल भाषा में समझाया गया है:

1. पुराने गार्डों के साथ समस्या क्या थी?

पहले, सबसे अच्छा गार्ड LogGPT कहलाता था। वह बुद्धिमान था, लेकिन उसकी दो बड़ी कमजोरियां थीं:

  • कम ध्यान अवधि (Short Attention Span): वह एक बार में केवल पिछले 1,024 नोट्स पढ़ सकता था। यदि कोई समस्या 2,000 नोट्स पहले शुरू हुई थी और धीरे-धीरे बिगड़ती गई, तो पुराना गार्ड कहानी की शुरुआत भूल जाता था और चेतावनी के संकेतों को चूक जाता था।
  • "सब कुछ या कुछ नहीं" वाला ग्रेडिंग सिस्टम: जब पुराना गार्ड अनुमान लगाता था कि अगला नोट क्या होगा, तो उसे एक साधारण "अच्छा काम किया!" (+1) या "बुरा काम किया!" (-1) मिलता था। इससे कोई फर्क नहीं पड़ता था कि गार्ड ने बहुत कम जानकारी (दिन की शुरुआत) के साथ अनुमान लगाया था या उनके पास सुरागों का ढेर (दिन का अंत) था। इसने सीखने की प्रक्रिया को अव्यवस्थित और भ्रमित करने वाला बना दिया।

2. नया गार्ड: LogNEO

लेखकों ने GPT-Neo नामक एक बड़े, अधिक बुद्धिमान मस्तिष्क का उपयोग करके एक नया गार्ड बनाया है। यहाँ बताया गया है कि LogNEO को क्या खास बनाता है:

A. लंबी याददाश्त (2,048 नोट्स)

पिछले 1,024 नोट्स को देखने के बजाय, LogNEO पिछले 2,048 नोट्स तक देख सकता है।

  • उपमा (Analogy): कल्पना कीजिए कि आप एक रहस्य उपन्यास पढ़ रहे हैं। पुराना गार्ड केवल पिछले 10 पन्ने पढ़ सकता था। यदि विलेन (खलनायक) को पेज 1 पर पेश किया गया था, तो गार्ड को कभी पता नहीं चल पाता कि वह कौन था। LogNEO पिछले 20 पन्ने पढ़ सकता है, इसलिए वह विलेन के परिचय को याद रखता है भले ही वे कुछ समय से दिखाई न दिए हों। यह इसे उन धीमी गति से विकसित होने वाली समस्याओं को पकड़ने में मदद करता है जिन्हें पुराना गार्ड मिस कर देता था।

B. "फेयर टीचर" (निष्पक्ष शिक्षक) ग्रेडिंग सिस्टम

सबसे बड़ा नवाचार गार्ड के अनुमानों को ग्रेड देने का एक नया तरीका है। लेखकों ने महसूस किया कि किसी अनुक्रम (sequence) की शुरुआत में अगले नोट का अनुमान लगाना कठिन होता है (क्योंकि आपके पास संदर्भ कम होता है) और अंत में यह आसान होता है (क्योंकि आपने बहुत सारा इतिहास देखा होता है)।

  • पुराना तरीका: यदि आप शुरुआत में गलत अनुमान लगाते थे, तो आपको -1 मिलता था। यदि आप अंत में गलत अनुमान लगाते थे, तो भी आपको -1 ही मिलता था। यह अनुचित है!
  • LogNEO का तरीका (Position-Aware Reward):
    • शुरुआती अनुमान: यदि आप बहुत कम जानकारी के साथ सही अनुमान लगाते हैं, तो आपको बड़ा बोनस मिलता है (क्योंकि यह प्रभावशाली है!)। यदि आप गलत अनुमान लगाते हैं, तो आपको मामूली दंड मिलता है (क्योंकि यह अपेक्षित रूप से कठिन होता है)।
    • बाद के अनुमान: यदि आप बहुत अधिक जानकारी के साथ सही अनुमान लगाते हैं, तो आपको छोटा बोनस मिलता है (क्योंकि यह आसान होना चाहिए)। यदि आप गलत अनुमान लगाते हैं, तो आपको भारी दंड मिलता है (क्योंकि आपको बेहतर पता होना चाहिए था!)।

यह "फेयर टीचर" सिस्टम गार्ड को बहुत तेज़ी से और अधिक सटीकता से सिखाता है, जिससे उसे एक वास्तविक समस्या और कहानी की केवल एक भ्रमित करने वाली शुरुआत के बीच अंतर करने में मदद मिलती है।

3. परिणाम: यह कितना अच्छा है?

शोधकर्ताओं ने LogNEO का परीक्षण तीन प्रसिद्ध "फैक्ट्री लॉग्स" (वास्तविक सुपरकंप्यूटर और फ़ाइल सिस्टम से डेटासेट) पर किया:

  • HDFS: LogNEO ने पिछले सबसे अच्छे गार्ड की तुलना में 6% अधिक वास्तविक समस्याओं को पकड़ा, बिना अधिक गलत अलार्म (false alarms) दिए।
  • Thunderbird: इसने सबसे अच्छे गार्ड के प्रदर्शन के बराबर प्रदर्शन किया, लगभग हर एक समस्या को पकड़ लिया।
  • गति: उन्होंने इसे केवल लैब में ही नहीं परखा; उन्होंने एक वास्तविक समय की प्रणाली बनाई है जो 15,000 नोट्स प्रति सेकंड को केवल 45 मिलीसेकंड के विलंब (delay) के साथ प्रोसेस कर सकती है। यह पलक झपकने से भी तेज़ है।

4. जहाँ यह चूक जाता है

यह शोध पत्र स्वीकार करता है कि LogNEO पूर्ण नहीं है।

  • "छिपा हुआ नंबर" वाली समस्या: LogNEO अजीब शब्दों (जैसे कि जब नहीं होना चाहिए तब "Error" का आना) को पहचानने में बहुत अच्छा है। लेकिन यदि कोई मशीन कहती है "Disk Full" (जो कि एक सामान्य शब्द है) लेकिन फाइलों की संख्या वास्तव में 1 अरब (एक असामान्य संख्या) है, तो LogNEO इसे मिस कर सकता है क्योंकि यह केवल शब्दों को देखता है, उनके अंदर की संख्याओं को नहीं।
  • हार्डवेयर की आवश्यकता: इसे चलाने के लिए एक शक्तिशाली कंप्यूटर (GPU) की आवश्यकता होती है, इसलिए इसे नेटवर्क के किनारे (edge) पर किसी छोटे, सस्ते डिवाइस पर आसानी से स्थापित नहीं किया जा सकता है।

सारांश

LogNEO कंप्यूटर सिस्टम के लिए एक स्मार्ट, तेज़ और अधिक धैर्यवान सुरक्षा गार्ड है। खुद को एक लंबी याददाश्त और एक स्मार्ट ग्रेडिंग सिस्टम देकर, जो उस क्षण की कठिनाई को समझता है, यह पिछले तरीकों की तुलना में अधिक समस्याओं को ढूंढ लेता है, जिससे विशाल कंप्यूटर सिस्टम को सुचारू रूप से और सुरक्षित रूप से चलाने में मदद मिलती है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →