← नवीनतम पेपर
🤖 AI

When Ads Become Profiles: Uncovering the Invisible Risk of Web Advertising at Scale with LLMs

यह शोध पत्र यह प्रदर्शित करता है कि 'ऑफ-द-शेल्फ' मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स, केवल फेसबुक विज्ञापन इंप्रेशन से, राजनीतिक संबद्धता और रोजगार स्थिति जैसे संवेदनशील उपयोगकर्ता गुणों को कुशलतापूर्वक और सटीकता से रिवर्स-इंजीनियर कर सकते हैं, जो एक महत्वपूर्ण प्रणालीगत भेद्यता को उजागर करता है जहाँ विज्ञापन स्ट्रीम उच्च-सटीक डिजिटल पदचिह्न के रूप में कार्य करती हैं जो वर्तमान प्लेटफॉर्म सुरक्षा उपायों को दरकिनार कर देती हैं।

मूल लेखक: Baiyu Chen, Benjamin Tag, Hao Xue, Daniel Angus, Flora Salim

प्रकाशित 2026-01-30
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Baiyu Chen, Benjamin Tag, Hao Xue, Daniel Angus, Flora Salim

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

मुख्य विचार: आपके विज्ञापन एक गुप्त डायरी हैं

कल्पना कीजिए कि आप एक किराने की दुकान में जाते हैं। मैनेजर के पास आपकी व्यक्तिगत आदतों की एक गुप्त सूची है: आप बेबी फॉर्मूला खरीदते हैं, आपको तीखा खाना पसंद है, और आप एक विशिष्ट राजनीतिक दल को वोट देते हैं। आपको डायपर का फ्लायर देने के बजाय, वे आपको हॉट सॉस और एक स्थानीय राजनेता के अभियान के फ्लायर्स थमा देते हैं।

यह शोध पत्र तर्क देता है कि फेसबुक पर आपको दिखने वाले विज्ञापनों का प्रवाह उस गुप्त सूची की तरह है। भले ही कंपनियाँ कहती हैं कि वे आपको संवेदनशील चीजों (जैसे आपकी राजनीति या स्वास्थ्य) के आधार पर विज्ञापन नहीं दिखाती हैं, लेकिन उनके कंप्यूटर एल्गोरिदम आपको क्लिक करने के लिए प्रेरित करने के लिए यह काम स्वचालित रूप से करते हैं।

डरावनी बात क्या है? अब अपने रहस्यों को जानने के लिए आपको हैकर होने की ज़रूरत नहीं है। आपको बस एक शक्तिशाली AI (एक लार्ज लैंग्वेज मॉडल, या LLM) की आवश्यकता है जो आपके द्वारा देखे गए विज्ञापनों को पढ़े और आपकी एक प्रोफाइल तैयार कर सके।

नया खतरा: "जादुई जासूस"

अतीत में, यदि कोई आपके विज्ञापनों से आपके रहस्य जानना चाहता था, तो उसे एक बहुत ही बुद्धिमान डेटा वैज्ञानिक होना पड़ता था। उसे एक जटिल रोबोट बनाना पड़ता, उसे लाखों उदाहरणों से खिलाना पड़ता और महीनों तक उसे प्रशिक्षित करना पड़ता। यह कठिन, महंगा और धीमा काम था।

यह शोध पत्र कहता है कि यह बदल गया है।
अब, हमारे पास "ऑफ-द-शेल्फ" AI मॉडल हैं (जैसे वे जिनसे आप ऑनलाइन मुफ्त में चैट कर सकते हैं)। ये जादुई जासूसों की तरह हैं। ये इतने स्मार्ट हैं कि आपको इन्हें प्रशिक्षित करने की आवश्यकता नहीं है। आप बस उन्हें आपके द्वारा देखे गए विज्ञापनों की एक सूची दिखा सकते हैं, और वे तुरंत कह सकते हैं, "ओह, यह व्यक्ति संभवतः स्नातक है, स्वास्थ्य सेवा में काम करता है, और पार्टी X का समर्थक है।"

यह हमला कैसे काम करता है (द "ब्राउज़र एक्सटेंशन" ट्रिक)

शोधकर्ता एक ऐसी स्थिति की कल्पना करते हैं जहाँ एक बुरा व्यक्ति (bad actor) आपकी प्रोफाइल चुराना चाहता है। उन्हें आपके कंप्यूटर को हैक करने या वायरस डालने की आवश्यकता नहीं है।

  • उपमा (Analogy): अपने ब्राउज़र में एक मिलनसार दिखने वाले "कूपन फाइंडर" या "एड ब्लॉकर" एक्सटेंशन की कल्पना करें। आप पैसे बचाने या परेशान करने वाले पॉप-अप को रोकने के लिए इसे इंस्टॉल करते हैं।
  • चाल (Trick): इस एक्सटेंशन के पास वेब पेजों को देखने का एक वैध कारण है (कूपन खोजने के लिए)। शोधकर्ता दिखाते हैं कि यही एक्सटेंशन चुपचाप आपके द्वारा देखे गए हर विज्ञापन की कॉपी कर सकता है।
  • परिणाम: यह उन विज्ञापनों को "जादुई जासूस" AI को भेज देता है। AI उन विज्ञापनों को पढ़ता है और आपके निजी जीवन (आपकी नौकरी, आपकी शिक्षा, आपके राजनीतिक विचार) की एक विस्तृत प्रोफाइल बनाता है, और आपको इसका पता भी नहीं चलता।

शोधकर्ताओं ने वास्तव में क्या किया

यह साबित करने के लिए कि यह संभव है, शोधकर्ताओं ने वास्तविक लोगों पर हमला नहीं किया। उन्होंने ऑस्ट्रेलियाई एड ऑब्जर्वेटरी (Australian Ad Observatory) से एक विशाल, वास्तविक दुनिया के डेटासेट का उपयोग किया।

  • डेटा: उन्होंने दो वर्षों में 891 वास्तविक लोगों को दिखाए गए 4,35,000 से अधिक विज्ञापनों का विश्लेषण किया।
  • परीक्षण: उन्होंने इन विज्ञापनों को शक्तिशाली AI मॉडल (जैसे Gemini और GPT-4/5) में डाला और AI से उपयोगकर्ताओं के रहस्यों (आयु, लिंग, आय, शिक्षा, नौकरी और राजनीतिक दल) का अनुमान लगाने को कहा।
  • तुलना: उन्होंने AI के अनुमानों की तुलना निम्नलिखित से की:
    1. रैंडम गेसिंग (यादृच्छिक अनुमान): केवल रैंडम उत्तर चुनना।
    2. जनगणना डेटा (Census Data): यह अनुमान लगाना कि ऑस्ट्रेलिया में क्या "सबसे आम" है (जैसे, यह अनुमान लगाना कि लगभग सभी कार्यरत हैं क्योंकि अधिकांश लोग कार्यरत हैं)।
    3. मानव विशेषज्ञ: वास्तविक लोग जो उन्हीं विज्ञापनों को देख रहे हैं और उनसे अनुमान लगाने की कोशिश कर रहे हैं।

चौंकाने वाले परिणाम

शोध पत्र में पाया गया कि AI इसमें अविश्वसनीय रूप से अच्छा था, और अक्सर विशेषज्ञों से भी बेहतर प्रदर्शन करता था।

  1. AI बनाम इंसान: शिक्षा और रोजगार जैसी जटिल चीजों के लिए, AI वास्तव में मानव विशेषज्ञों से बेहतर था। लिंग (Gender) के मामले में, AI विशेषज्ञों के समान ही प्रभावी था।
  2. गति और लागत: AI ने यह काम इंसानों की तुलना में 52 गुना तेजी से और 223 गुना कम खर्च में किया।
  3. लघु अवधि (Short Windows): आपको किसी पर वर्षों तक नज़र रखने की ज़रूरत नहीं है। AI केवल एक छोटे ब्राउज़िंग सत्र (जैसे 10-15 मिनट) में देखे गए विज्ञापनों को देखकर आपके रहस्यों का सटीक अनुमान लगा सकता है।
  4. "निकट चूक" (Near Misses) भी खतरनाक हैं: भले ही AI आपकी सटीक आयु (जैसे "34") का अनुमान न लगा पाए, लेकिन वह आमतौर पर बहुत करीब (जैसे "30-39") होता है। शोध पत्र इसे "दिशात्मक शुद्धता" (directional correctness) कहता है। यह किसी को "मध्य आयु" का बताने जैसा है जब वह वास्तव में 42 वर्ष का हो। यह अभी भी एक बड़ा गोपनीयता लीक है।

निचोड़ (The Bottom Line)

शोध पत्र निष्कर्ष निकालता है कि विज्ञापन एक उच्च-सटीकता वाला डिजिटल फुटप्रिंट (digital footprint) हैं।

भले ही सोशल मीडिया प्लेटफॉर्म आपकी गोपनीयता की रक्षा के लिए "संवेदनशील" टारगेटिंग बटनों को हटा दें, फिर भी AI एल्गोरिदम आपके निजी गुणों के आधार पर विज्ञापनों को वर्गीकृत करते हैं। क्योंकि शक्तिशाली AI अब मुफ्त और आसान है, इसलिए कोई भी उन विज्ञापनों को आपके जीवन की विस्तृत प्रोफाइल में बदल सकता है।

मुख्य बात: आप विज्ञापनों को देखना आसानी से बंद नहीं कर सकते। और अब, केवल उन विज्ञापनों को देखकर, आपके निजी जीवन को उन मशीनों द्वारा डिकोड किया जा रहा है जो मनुष्यों से अधिक स्मार्ट और तेज़ हैं। यह एक नया, अदृश्य जोखिम है जिसके लिए वर्तमान गोपनीयता कानून तैयार नहीं हो सकते हैं।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →