← नवीनतम पेपर
💻 computer science

A Dataset-Centric Benchmark of Deep Learning Methods for Grape Leaf Disease Classification and Detection

यह शोध पत्र विविध सार्वजनिक डेटासेट्स के माध्यम से अंगूर की पत्तियों के रोग वर्गीकरण और पहचान के लिए डीप लर्निंग विधियों का मूल्यांकन करने वाला एक डेटासेट-केंद्रित बेंचमार्क प्रस्तुत करता है, जो यह प्रकट करता है कि जहाँ नियंत्रित डेटा पर प्रदर्शन उच्च होता है, वहीं जटिल पृष्ठभूमि, एनोटेशन विसंगतियों और डोमेन शिफ्ट जैसी चुनौतियों के कारण वास्तविक दुनिया की फील्ड स्थितियों और क्रॉस-डेटासेट परिदृश्यों में यह काफी गिर जाता है।

मूल लेखक: Petar Canoski, Vlatko Spasev, Ivica Dimitrovski, Ivan Kitanovski, Petre Lameski

प्रकाशित 2026-08-24
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Petar Canoski, Vlatko Spasev, Ivica Dimitrovski, Ivan Kitanovski, Petre Lameski

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

एक अंगूर के बाग की शांत पंक्तियों में, अंगूर की बेल का स्वास्थ्य अक्सर उसकी पत्तियों की भाषा में लिखा होता है। रंग में एक मामूली बदलाव, एक मुरझाती हुई किनारी, या धब्बों का एक अजीब पैटर्न किसी बीमारी की शुरुआत का संकेत दे सकता है, जो यदि अनियंत्रित छोड़ दी जाए, तो पूरी फसल बर्बाद कर सकती है। सदियों से, किसान और विशेषज्ञ इन शुरुआती चेतावनियों को पहचानने के लिए अपनी आँखों पर भरोसा करते आए हैं, जो एक ऐसा कार्य है जो अत्यंत महत्वपूर्ण और थकाऊ दोनों है। आज, वैज्ञानिक कंप्यूटरों को इसी भाषा को पढ़ना सिखा रहे हैं, जिसमें वे पत्तियों की छवियों को स्कैन करने और बीमारी के फैलने से पहले उसे पहचानने के लिए आर्टिफिशियल इंटेलिजेंस (कृत्रिम बुद्धिमत्ता) का उपयोग कर रहे हैं। यह क्षेत्र, जिसे 'प्रिसिजन एग्रीकल्चर' (सटीक कृषि) के रूप में जाना जाता है, अंगूर के बाग के प्रबंधन को तेज़ और अधिक सटीक बनाने का वादा करता है, जिससे संभावित रूप से फसलों को बचाया जा सकता है और व्यापक रासायनिक उपचारों की आवश्यकता को कम किया जा सकता है। हालाँकि, इन डिजिटल उपकरणों को वास्तविक दुनिया में काम करने के लिए, उन्हें न केवल आदर्श, स्टूडियो-रोशनी वाली तस्वीरों में बीमारी को पहचानना होगा, बल्कि एक वास्तविक अंगूर के बाग की अव्यवsted, अप्रत्याशित स्थितियों में भी, जहाँ पत्तियाँ एक-दूसरे के ऊपर होती हैं, छाया बदलती रहती है, और हवा कैमरे को हिला देती है।

उत्तरी मैसेडोनिया के शोधकर्ताओं की एक टीम ने यह परीक्षण करने के लिए हाथ में लिया कि क्या इन स्मार्ट इमेज सिस्टम की वर्तमान पीढ़ी वास्तव में खेत के लिए तैयार है। उन्होंने केवल एक नया, अधिक उन्नत कंप्यूटर प्रोग्राम नहीं बनाया; इसके बजाय, उन्होंने उन डेटा सेटों का एक कठोर ऑडिट किया जिनका उपयोग उन्हें प्रशिक्षित करने के लिए किया गया था। शोधकर्ताओं ने अंगूर की पत्तियों के सार्वजनिक रूप से उपलब्ध छवियों के एक विस्तृत संग्रह को इकट्ठा किया, जिसमें सावधानीपूर्वक नियंत्रित प्रयोगशाला की तस्वीरों से लेकर जंगल में खींची गई तस्वीरें तक शामिल थीं। फिर उन्होंने विभिन्न 'डीप लर्निंग मॉडल्स'—कंप्यूटर सिस्टम जिन्हें दृश्य पैटर्न से सीखने के लिए डिज़ाइन किया गया है—का परीक्षण किया। लक्ष्य यह देखना था कि क्या ये मॉडल वास्तव में सामान्यीकरण (generalize) कर सकते हैं, यानी क्या एक सेट की छवियों पर प्रशिक्षित प्रणाली अलग परिस्थितियों में ली गई छवियों के पूरी तरह से अलग सेट में बीमारी को पहचान सकती है? अध्ययन ने तीन अलग-अलग तरीकों पर ध्यान केंद्रित किया कि कैसे एक कंप्यूटर एक पत्ती को देख सकता है: एक पूरी तस्वीर में बीमारी की पहचान करना, एक पत्ती के विशिष्ट कटे हुए हिस्से को वर्गीकृत करना, या एक जटिल दृश्य के भीतर बीमारी के सटीक स्थान को ढूंढना और उसे बॉक्स में बंद करना।

परिणामों ने प्रयोगशाला और वास्तविक दुनिया के बीच एक स्पष्ट अंतर प्रकट किया। जब शोधकर्ताओं ने नियंत्रित वातावरण में लिए गए डेटासेट पर मॉडलों का परीक्षण किया—जहाँ पत्तियाँ अक्सर सादे बैकग्राउंड के सामने अलग की गई थीं और रोशनी समान थी—तो कंप्यूटर लगभग पूरी तरह से प्रदर्शन करते थे। कई मॉडल्स ने लगभग पूर्ण स्कोर प्राप्त किया, जिसने लगभग हर एक छवि में बीमारी की सही पहचान की। हालाँकि, यह सफलता कुछ हद तक भ्रामक साबित हुई। शोधकर्ताओं ने पाया कि इनमें से कई "परफेक्ट" डेटासेट वास्तव में मूल छवियों से ही बने थे, जिन्हें बस पुनर्गठित या थोड़ा बदला गया था। क्योंकि कंप्यूटर ने अपने प्रशिक्षण और परीक्षण के दौरान प्रभावी रूप से उन्हीं तस्वीरों को देख लिया था, इसलिए वह वास्तव में बीमारी को पहचानना नहीं सीख रहा था; वह केवल उस डेटासेट के विशिष्ट दृश्य पैटर्न को याद कर रहा था। जब शोधकर्ताओं ने इन समान मॉडलों का परीक्षण एक वास्तविक अंगूर के बाग में लिए गए डेटासेट पर किया, जहाँ पत्तियाँ उलझी हुई थीं, छाया गहरी थी, और बैकग्राउंड अव्यवस्थित था, तो मॉडलों का प्रदर्शन ढह गया। सटीकता नाटकीय रूप से गिर गई, जिससे पता चला कि सिस्टम ने बीमार पत्ती की जैविक वास्तविकता को पहचानने के बजाय, एक नियंत्रित फोटो के विशिष्ट स्वरूप को पहचानना सीख लिया था।

अध्ययन ने यह भी जांचा कि ये सिस्टम एक डेटासेट से दूसरे में कितनी अच्छी तरह जा सकते हैं, जो किसी भी व्यापक उपयोग के लिए इच्छित तकनीक के लिए एक महत्वपूर्ण परीक्षण है। शोधकर्ताओं ने पाया कि भले ही दो डेटासेट में बीमारियों के समान नाम हों, जैसे कि "ब्लैक रॉट" या "मिल्ड्यू", कंप्यूटर सिस्टम उनके बीच ज्ञान का हस्तांतरण करने में विफल रहे। एक मॉडल जो एक सेट की छवियों में मिल्ड्यू को खोजने के लिए प्रशिक्षित था, वह दूसरे में उसे नहीं खोज सका, भले ही बीमारी वही थी। यह विफलता इसलिए हुई क्योंकि छवियों में बीमारियों को चिह्नित करने का तरीका अलग था; एक डेटासेट ने सड़न के एक छोटे से धब्बे के चारों ओर बॉक्स बनाया होगा, जबकि दूसरे ने संक्रमित पूरी पत्ती के चारों ओर बॉक्स बनाया होगा। कंप्यूटर ने पहले डेटासेट के विशिष्ट नियमों को सीख लिया था और वह दूसरे के अनुकूल नहीं हो सका। यह निष्कर्ष बताता है कि केवल बड़ी मात्रा में डेटा होना पर्याप्त नहीं है; डेटा विविध, वास्तविक दुनिया की स्थितियों का प्रतिनिधि और निरंतर तरीके से एनोटेटेड (चिह्नित) होना चाहिए।

शायद सबसे आश्चर्यजनक खोज यह थी कि सबसे उन्नत कंप्यूटर आर्किटेक्चर ने भी इन समस्याओं को हल नहीं किया। शोधकर्ताओं ने सरल, हल्के सिस्टम से लेकर जटिल, विशाल सिस्टम तक, मॉडलों की एक विस्तृत श्रृंखला का परीक्षण किया। नियंत्रित डेटासेट पर, सरल मॉडल जटिल मॉडलों के समान ही अच्छा प्रदर्शन करते थे, जो यह सुझाव देता है कि डेटा स्वयं कंप्यूटरों को चुनौती देने के लिए बहुत आसान था। कठिन, वास्तविक दुनिया के डेटासेट पर, अधिक जटिल मॉडल लगातार सरल मॉडलों से बेहतर प्रदर्शन नहीं कर सके। बाधा कंप्यूटर की बुद्धिमत्ता में नहीं, बल्कि उन छवियों की गुणवत्ता और प्रकृति में थी जिन्हें इसे खिलाया जा रहा था। अध्ययन ने निष्कर्ष निकाला कि आर्टिफिशियल इंटेलिजेंस को वास्तव में अंगूर के बाग प्रबंधकों की मदद करने के लिए, ध्यान बड़े एल्गोरिदम बनाने के बजाय बेहतर, अधिक यथार्थवादी डेटासेट बनाने पर केंद्रित होना चाहिए। इस तकनीक का भविष्य ऐसे चित्र एकत्र करने पर निर्भर करता है जो अंगूर के बाग की वास्तविक जटिलता को पकड़ सकें, यह सुनिश्चित करते हुए कि सिस्टम बीमारी को स्वयं देख सकें, न कि केवल उस स्थिति को जिसके तहत फोटो ली गई थी।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →