← नवीनतम पेपर
🤖 machine learning

ATLAS: Adaptive Topology-based Learning at Scale for Homophilic and Heterophilic Graphs

ATLAS एक स्केलेबल, प्रोपेगेशन-मुक्त ग्राफ लर्निंग फ्रेमवर्क है जो संरचनात्मक जानकारी को स्पष्ट विशेषताओं के रूप में एनकोड करने के लिए अनुकूल रूप से इष्टतम कम्युनिटी ग्रैनुलैरिटी की पहचान करता है, जिससे होमोफिलिक और हेटरोफिलिक दोनों ग्राफों पर उत्कृष्ट प्रदर्शन प्राप्त होता है और कुशल मिनी-बैच ट्रेनिंग तथा एडजेसेंसी-मुक्त इन्फरेंस सक्षम होता है।

मूल लेखक: Turja Kundu, Sanjukta Bhowmick

प्रकाशित 2026-08-27
📖 7 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Turja Kundu, Sanjukta Bhowmick

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

डिजिटल दुनिया में, डेटा अक्सर स्प्रेडशीट की साफ-सुथरी पंक्तियों के रूप में नहीं, बल्कि कनेक्शन के एक उलझे हुए जाल के रूप में आता है। एक सोशल नेटवर्क के बारे में सोचें जहाँ हर व्यक्ति एक बिंदु (डॉट) है और हर दोस्ती उन्हें जोड़ने वाली एक रेखा है, या एक साइटेशन नेटवर्क के बारे में जहाँ शोध पत्र वे बिंदु हैं जो इस बात से जुड़े हैं कि किसने किसे उद्धृत (साइट) किया है। वैज्ञानिकों ने लंबे समय से कंप्यूटर को इन जालों को समझने के लिए सिखाने की कोशिश की है, इस उम्मीद में कि वे यह अनुमान लगा सकें कि कोई व्यक्ति आगे क्या खरीद सकता है या कोई नया शोध पत्र किस विषय पर है। वर्षों तक, सबसे सफल दृष्टिकोण एक सरल धारणा पर निर्भर रहा: कि नेटवर्क में एक नोड, या बिंदु, अपने तत्काल पड़ोसियों के समान होता है। यदि आप लोगों के एक ऐसे समूह के मित्र हैं जो सभी जैज़ संगीत पसंद करते हैं, तो कंप्यूटर मानता है कि आप भी शायद जैज़ पसंद करते होंगे। यह विचार, जिसे 'होमोफिली' (homophily) के रूप में जाना जाता है, तब बहुत खूबसूरती से काम करता है जब नेटवर्क समान विचारधारा वाले समूहों से भरा हो। लेकिन वास्तविक दुनिया अधिक जटिल है। कई नेटवर्कों में, कनेक्शन बहुत अलग चीजों के बीच बनते हैं। एक शोध पत्र किसी ऐसे पेपर को उद्धृत कर सकता है जो बिल्कुल विपरीत तर्क देता हो, या एक व्यक्ति का संबंध किसी ऐसे व्यक्ति से हो सकता है जिसकी पसंद पूरी तरह से अलग हो। जब कंप्यूटर इन मिश्रित नेटवर्कों पर अपने "मित्र समान होते हैं" के नियम को लागू करने की कोशिश करता है, तो वह अक्सर भ्रमित हो जाता है, और उन अंतरों को मिटा देता है जो डेटा को दिलचस्प बनाते हैं।

यूनिवर्सिटी ऑफ नॉर्थ टेक्सस के शोधकर्ताओं की एक टीम ने इस जटिलता को नेविगेट करने का एक नया तरीका प्रस्तावित किया है, जो हर नेटवर्क को एक ही सांचे में ढालने की कोशिश करना बंद कर देता है। वे अपने इस तरीके को ATLAS कहते हैं। कंप्यूटर को पड़ोसियों के बीच लगातार संदेशों का आदान-प्रदान करने पर निर्भर रहने के बजाय—एक ऐसी प्रक्रिया जो धीमी है और अक्सर विफल हो जाती है जब पड़ोसी अलग होते हैं—उन्होंने सीखने की प्रक्रिया शुरू होने से पहले ही नेटवर्क के आकार को देखने का निर्णय लिया। कल्पना करें कि पूरे वेब का एक स्नैपशॉट लेना और उसे तीन अलग-अलग, पूर्व-निर्धारित दृश्यों (views) में विभाजित करना। पहला दृश्य बड़े पैमाने के समूहों, या समुदायों की तलाश करता है जो नोड्स के साथ जुड़े रहते हैं। दूसरा दृश्य केवल एक नोड के तत्काल पड़ोसियों के कच्चे गुणों (attributes) को एकत्र करता है, जैसे कि यह एक त्वरित सूची हो कि किसके बगल में कौन खड़ा है। तीसरा दृश्य प्रभाव के मार्ग का पता लगाता है, यह देखता है कि नेटवर्क में और दूर तक कौन से लेबल या श्रेणियाँ दिखाई देती हैं, भले ही वे ठीक बगल में न हों। इन तीन दृश्यों को फिर प्रत्येक एकल नोड के लिए एक समृद्ध, विस्तृत प्रोफाइल बनाने के लिए आपस में जोड़ा जाता है।

इस दृष्टिकोण की महानता इसकी अनुकूलन क्षमता में निहित है। शोधकर्ताओं ने पाया कि कोई भी एक दृश्य हर नेटवर्क के लिए काम नहीं करता है। कुछ ग्राफों पर, बड़े समुदाय सबसे महत्वपूर्ण संकेत होते हैं; अन्य पर, तत्काल पड़ोसी कुंजी होते हैं; और कुछ पर, दूर के संबंध सबसे अधिक मायने रखते हैं। ATLAS यह अनुमान नहीं लगाता कि कौन सा सही है। यह यह देखने के लिए एक त्वरित, एक बार का चेक चलाता है कि इनमें से कौन सा दृश्य वास्तव में विशिष्ट कार्य के लिए उपयोगी जानकारी रखता है। यदि बड़े समुदाय केवल शोर (noise) हैं, तो सिस्टम उन्हें अनदेखा कर देता है। यदि तत्काल पड़ोसी भ्रामक हैं, तो वह उस दृश्य को त्याग देता है। यह केवल उन्हीं चैनलों को रखता है जो मूल्य जोड़ते हैं, और उन्हें एक संक्षिप्त, कुशल लर्निंग इंजन में फीड करता है। इसका मतलब है कि भारी काम प्रशिक्षण शुरू होने से पहले केवल एक बार होता है। एक बार जब फीचर्स तैयार हो जाते हैं, तो वास्तविक सीखने की प्रक्रिया अविश्वसनीय रूप से तेज़ हो जाती है क्योंकि कंप्यूटर को अब नेटवर्क कनेक्शनों को बार-बार खोजने की आवश्यकता नहीं होती है। वह बस पूर्व-निर्मित प्रोफाइल्स को पढ़ता है और उनसे सीखता है।

इस पद्धति के परिणाम प्रभावशाली हैं, विशेष रूप से वास्तविक दुनिया के डेटा की जटिल वास्तविकता के विरुद्ध परीक्षण करने पर। शोधकर्ताओं ने अठारह विभिन्न डेटासेट्स पर अपने सिस्टम का मूल्यांकन किया, जिसमें कुछ हज़ार नोड्स के छोटे नेटवर्क से लेकर लाखों प्रविष्टियों वाले विशाल ग्राफ तक शामिल थे। कई मामलों में, उनके तरीके ने सबसे उन्नत उपलब्ध सिस्टमों को पछाड़ दिया, और सभी परीक्षणों में सर्वश्रेष्ठ औसत रैंकिंग प्राप्त की। यह कठिन, मिश्रित-प्रकार के नेटवर्कों पर विशेष रूप से प्रभावी साबित हुआ जहाँ पारंपरिक तरीके संघर्ष करते हैं। 'रोमन-एम्पायर' नामक एक डेटासेट पर, जहाँ कनेक्शन अत्यधिक विविध हैं और "मित्र समान होते हैं" की धारणा पूरी तरह से विफल हो जाती है, उनके सिस्टम ने स्थानीय पड़ोसी फीचर्स और दूर के लेबल संकेतों पर भरोसा करके खोई हुई सटीकता को पुनः प्राप्त किया, जबकि भ्रामक सामुदायिक संरचना को अनदेखा कर दिया। इसके विपरीत, उन नेटवर्कों पर जहाँ सामुदायिक संरचना मजबूत और सहायक थी, सिस्टम ने उन समूहों पर भारी झुकाव दिखाया।

यह खोज क्यों महत्वपूर्ण है, इसका कारण केवल यह नहीं है कि यह अच्छा काम करता है, बल्कि यह है कि यह सामान्य कम्प्यूटेशनल लागत के बिना काम करता है। पारंपरिक तरीके जो इन जटिल नेटवर्कों को संभालने की कोशिश करते हैं, अक्सर कंप्यूटर को पूरे नेटवर्क को बार-बार स्कैन करने की आवश्यकता होती है, जो डेटा बढ़ने के साथ अत्यधिक महंगा हो जाता है। ATLAS इसे पूरी तरह से टाल देता है। संरचनात्मक दृश्यों को पहले ही निकालने का कठिन काम करके, यह सीखने के चरण को एक मानक टेक्स्ट-प्रोसेसिंग कार्य की तरह तेज़ चलने की अनुमति देता है, बिना कभी भी नेटवर्क कनेक्शनों को दोबारा छूने की आवश्यकता के। यह उन विशाल, जटिल नेटवर्कों के विश्लेषण के द्वार खोलता है जो पहले उच्च सटीकता के साथ अध्ययन करने के लिए बहुत धीमे या कठिन थे। शोधकर्ताओं ने यह भी दिखाया कि उनका सिद्धांत कायम रहता है: उन्होंने गणितीय रूप से सिद्ध किया कि एक दृश्य कितना जानकारी प्रदान करता है और इसे अनुमानित करने की कितनी लागत आती है, इसके बीच एक ट्रेड-ऑफ (तालमेल) होता है। कभी-कभी, नेटवर्क में गहराई से देखना स्पष्टता के बजाय शोर जोड़ता है, और उनका सिस्टम यह जानने में सक्षम है कि कब रुकना है।

अंततः, यह कार्य इस बारे में हमारी सोच में बदलाव का सुझाव देता है कि जुड़े हुए डेटा से कैसे सीखा जाए। एक एकल, कठोर नियम को हर नेटवर्क पर थोपने के बजाय, हम संरचना को विभिन्न, पूरक संकेतों के संग्रह के रूप में देख सकते हैं। कुछ नेटवर्क बड़े समूहों की भाषा बोलते हैं, अन्य तत्काल पड़ोसियों की भाषा, और कुछ दूर के प्रभाव की भाषा। कंप्यूटर को इन तीनों को सुनने और यह तय करने के उपकरण देकर कि किस पर भरोसा किया जाए, शोधकर्ताओं ने एक ऐसा सिस्टम बनाया है जो मजबूत और स्केलेबल दोनों है। यह हमें याद दिलाता है कि जटिल जालों के अध्ययन में, उत्तर अक्सर गंदगी को सरल बनाने में नहीं, बल्कि इसके कई अलग-अलग स्तरों को पढ़ने में निहित होता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →