← नवीनतम पेपर
🤖 machine learning

CHASM: Unveiling Covert Advertisements on Chinese Social Media

यह शोध पत्र CHASM को प्रस्तुत करता है, जो चीनी सोशल मीडिया प्लेटफॉर्म रेडनोट (Rednote) से लगभग 5,000 वास्तविक दुनिया के गुप्त विज्ञापनों का एक नया डेटासेट है, ताकि यह प्रदर्शित किया जा सके कि वर्तमान मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स इन भ्रामक पोस्टों का पता लगाने में संघर्ष करते हैं और इस उभरते खतरे के विरुद्ध बेहतर फाइन-ट्यूनिंग और रक्षा तंत्र की आवश्यकता पर प्रकाश डाला जा सके।

मूल लेखक: Jingyi Zheng, Tianyi Hu, Yule Liu, Zhen Sun, Zongmin Zhang, Zifan Peng, Wenhan Dong, Xinlei He

प्रकाशित 2026-04-23
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Jingyi Zheng, Tianyi Hu, Yule Liu, Zhen Sun, Zongmin Zhang, Zifan Peng, Wenhan Dong, Xinlei He

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप अपने पसंदीदा सोशल मीडिया ऐप को स्क्रॉल कर रहे हैं, प्रेरणा की तलाश में कि क्या पहनना है या कौन सा स्किनकेयर आज़माना है। आपको एक पोस्ट दिखाई देती है जो एक सच्चे दोस्त द्वारा अपनी ईमानदार राय साझा करने जैसा लगता है: "मैंने यह नया टोनर आज़माया, और वाह, मेरी त्वचा अद्भुत महसूस कर रही है! यहाँ मेरी मॉर्निंग रूटीन की एक फोटो है।"

यह वास्तविक लगता है। यह एक साथी की सिफारिश जैसा महसूस होता है। लेकिन क्या होगा अगर वह "दोस्त" वास्तव में एक भेष बदले हुए सशुल्क विज्ञापनदाता (paid advertiser) है, और वह "ईमानदार राय" वास्तव में आपको कुछ बेचने के लिए बनाया गया एक सावधानीपूर्वक तैयार किया गया स्क्रिप्ट है?

यही वह समस्या है जिसे CHASM पेपर हल करता है। यह एक जासूसी कहानी की तरह है जहाँ अपराधी मास्क पहनने में इतने माहिर हैं कि सबसे स्मार्ट AI जासूस भी धोखा खा जाते हैं।

यहाँ इस पेपर की कहानी है, जिसे सरल भागों में विभाजित किया गया है:

1. खलनायक: "भेड़ की खाल में भेड़िया"

सोशल मीडिया की दुनिया में (विशेष रूप से एक लोकप्रिय चीनी ऐप Rednote में, जो Instagram या TikTok के समान है), एक बढ़ता हुआ खतरा है जिसे कवरट एडवरटाइजमेंट (Covert Advertisements) यानी गुप्त विज्ञापन कहा जाता है।

  • पारंपरिक विज्ञापन (Traditional Ads): ये स्पष्ट होते हैं। वे "AD" या "SPONSORED" कहते हैं। वे हाईवे पर लगे एक बिलबोर्ड की तरह हैं। आप जानते हैं कि वे आपको कुछ बेचने की कोशिश कर रहे हैं, इसलिए आप उन्हें अनदेखा करने का विकल्प चुन सकते हैं।
  • गुप्त विज्ञापन (Covert Ads): ये भेड़ की खाल में छिपे भेड़िये हैं। वे बिल्कुल सामान्य पोस्ट की तरह दिखते हैं। वे यह नहीं कहते कि "इसे खरीदें!" वे कहते हैं, "मुझे यह पसंद है!" या "मेरा आउटफिट देखें!" लेकिन इसके अंदर—तस्वीर, कैप्शन या कमेंट्स में—गुप्त लिंक, ब्रांड के नाम, या खरीदने के निर्देश छिपे होते हैं।

इन विज्ञापनों का लक्ष्य आपको यह सोचने के लिए मजबूर करना है कि, "ओह, यह तो बस एक असली व्यक्ति द्वारा कोई टिप साझा करना है," ताकि आप अपनी रक्षात्मक मुद्रा (guard) कम कर दें और उत्पाद खरीद लें।

2. जासूसी उपकरण: CHASM डेटासेट

शोधकर्ताओं ने महसूस किया कि वर्तमान AI मॉडल (लार्ज लैंग्वेज मॉडल्स) इन छद्म विज्ञापनों को पहचानने में बहुत खराब हैं। उन्होंने सोचा, "हम AI को भेड़िए को पहचानना कैसे सिखा सकते हैं?"

इसे करने के लिए, उन्होंने CHASM बनाया। CHASM को AI जासूसों के लिए एक विशाल प्रशिक्षण जिम (training gym) के रूप में समझें।

  • वर्कआउट: उन्होंने Rednote से लगभग 5,000 वास्तविक पोस्ट एकत्र किए।
  • मिश्रण: कुछ पोस्ट छद्म रूप में वास्तविक विज्ञापन थे ("बुरे लोग"), और कुछ केवल सामान्य लोग अपने जीवन को साझा कर रहे थे ("अच्छे लोग")।
  • चुनौती: उन्होंने यह सुनिश्चित किया कि "अच्छे लोग" दिखने में "बुरे लोगों" के बहुत समान हों। यह "अंतर पहचानो" (Spot the Difference) के खेल जैसा है जहाँ अंतर बहुत सूक्ष्म होते हैं।
  • गोपनीयता: उन्होंने तस्वीरों से सभी वास्तविक नाम और चेहरे हटा दिए ताकि किसी भी वास्तविक व्यक्ति को नुकसान न पहुँचे, ठीक वैसे ही जैसे पुलिस स्केच में चेहरे धुंधले किए जाते हैं।

3. बड़ा टेस्ट: क्या AI मास्क के पार देख सकता है?

शोधकर्ताओं ने दुनिया के सबसे स्मार्ट AI मॉडल्स (जैसे GPT-4o, DeepSeek और अन्य) को लिया और उन्हें CHASM जिम में डाल दिया। उन्होंने पूछा: "क्या आप बता सकते हैं कि इनमें से कौन सा पोस्ट एक नकली विज्ञापन है?"

परिणाम? AI बुरी तरह विफल रहा।

  • यहाँ तक कि "सुपर-स्मार्ट" AI भी केवल 60% बार सही थे। यह सिक्का उछालकर अनुमान लगाने से भी मुश्किल से बेहतर है!
  • AI बार-बार धोखा खाता रहा। उसने सोचा कि असली दोस्त चीजें बेच रहे हैं, और वह कमेंट सेक्शन में छिपे वास्तविक सेल्स पिच को भी मिस कर गया।
  • उपमा: यह एक मास्टर शेफ को आँखों पर पट्टी बांधकर यह चखने के लिए कहने जैसा है कि क्या इसमें नमक है। AI उस सूक्ष्म "स्वाद" को पहचानने में विफल रहा जो एक छिपे हुए विज्ञापन का संकेत था।

4. ट्रेनिंग मोंटाज: फाइन-ट्यूनिंग (Fine-Tuning)

चूंकि AI विफल हो रहा था, शोधकर्ताओं ने एक नई रणनीति आजमाई: फाइन-ट्यूनिंग

  • केवल AI को अनुमान लगाने के लिए कहने के बजाय, उन्होंने उसे CHASM डेटासेट दिखाया और कहा, "इन उदाहरणों को देखो। यह क्यों एक विज्ञापन है, और वह क्यों नहीं है। अब, फिर से प्रयास करो।"
  • परिणाम: यह जासूस को एक आवर्धक लेंस (magnลifying glass) और एक हैंडबुक देने जैसा था। AI का प्रदर्शन काफी बढ़ गया। एक मॉडल (Qwen2.5) की सफलता दर 42% से बढ़कर 75% हो गई।
  • कैच (Catch): प्रशिक्षण के बाद भी, AI सबसे कठिन मामलों में संघर्ष करता रहा। वह कमेंट सेक्शन में छिपे सूक्ष्म सुरागों को मिस कर गया या यह नोटिस करने में विफल रहा कि एक पोस्ट केवल एक ही ब्रांड पर ध्यान केंद्रित कर रहा था (एक क्लासिक विज्ञापन ट्रिक) बजाय इसके कि वह विभिन्न ब्रांडों की तुलना करे (जो एक वास्तविक उपयोगकर्ता की आदत है)।

5. यह क्यों महत्वपूर्ण है?

हमें इस बात से क्यों फर्क पड़ना चाहिए कि क्या एक AI नकली विज्ञापन को पहचान सकता है?

  • विश्वास (Trust): यदि हम यह नहीं बता सकते कि क्या वास्तविक है और क्या एक सेल्स पिच है, तो हम सोशल मीडिया पर भरोसा करना बंद कर देते हैं।
  • पैसा: लोग उन उत्पादों पर पैसा गंवा रहे हैं जिनके बारे में उन्हें पता ही नहीं था कि उन्हें बेचा जा रहा है।
  • कानून: कई देशों में, यह तथ्य छिपाना कि आपको किसी चीज़ को प्रमोट करने के लिए भुगतान किया जा रहा है, वास्तव में अवैध है।

निचोड़ (The Bottom Line)

पेपर यह निष्कर्ष निकालता है कि वर्तमान AI अकेले सोशल मीडिया विज्ञापनों की निगरानी करने के लिए तैयार नहीं है। यह चालाक भेषों से बहुत आसानी से धोखा खा जाता है।

हालाँकि, CHASM डेटासेट एक बड़ा कदम है। यह एक नए "प्रशिक्षण मैनुअल" की तरह है जो AI को इन ट्रिक्स को पहचानने में बेहतर होने में मदद करता है। शोधकर्ताओं को उम्मीद है कि इस डेटा को साझा करके, प्लेटफॉर्म बेहतर सुरक्षा बना सकते हैं, जिससे यह सुनिश्चित हो सके कि जब आप कोई पोस्ट देखें, तो आपको पता हो कि वह एक दोस्त की सलाह है या एक सेल्समैन की पिच।

संक्षेप में: इंटरनेट भेड़ की खाल में छिपे भेड़ियों से भरा है। इस पेपर ने हमारे AI कुत्तों को उन्हें सूंघने के लिए प्रशिक्षित करने हेतु एक प्रशिक्षण शिविर बनाया है, लेकिन भेड़िये अभी भी बहुत चालाक हैं, और हमें प्रशिक्षण जारी रखने की आवश्यकता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →