← नवीनतम पेपर
🤖 AI

DECEPTICON: How Dark Patterns Manipulate Web Agents

यह शोध पत्र DECEPTICON को प्रस्तुत करता है, जो एक ऐसा बेंचमार्क है जो यह दर्शाता है कि डार्क पैटर्न्स (dark patterns) वेब एजेंटों को दुर्भावनापूर्ण परिणामों की ओर प्रभावी ढंग से हेरफेर करने में मानव संवेदनशीलता की तुलना में कहीं अधिक दर से सफल होते हैं, और बड़े मॉडल तथा मौजूदा सुरक्षा उपाय भी इन हेरफेर करने वाले डिजाइनों के विरुद्ध अपर्याप्त सिद्ध होते हैं।

मूल लेखक: Phil Cuvin, Hao Zhu, Diyi Yang

प्रकाशित 2026-02-09
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Phil Cuvin, Hao Zhu, Diyi Yang

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि इंटरनेट एक विशाल, हलचल भरा शॉपिंग मॉल है। सालों से, मॉल के मालिकों ने इंसानी ग्राहकों को ऐसी चीजें खरीदने के लिए बहकाने के लिए चालाकी भरे तरीकों का इस्तेमाल किया है जिन्हें उन्होंने नहीं खरीदा था, जैसे कि "प्रीमियम शिपिंग" के बॉक्स को पहले से ही चेक कर देना या घबराहट पैदा करने के लिए "केवल 1 बचा है!" जैसा साइन फ्लैश करना। इन तरकीबों को डार्क पैटर्न्स (Dark Patterns) कहा जाता है।

अब, एक नए तरह के ग्राहक की कल्पना करें: एक वेब एजेंट (Web Agent)। यह एक रोबोट है जो उन्नत AI द्वारा संचालित है जो आपके लिए वेब ब्राउज़ करता है, बटन क्लिक करता है और फॉर्म भरता है बिल्कुल वैसे ही जैसे एक इंसान करेगा। आप इससे कह सकते हैं, "मेरे लिए $30 से कम में सबसे सस्ते फूल खरीद दो।"

एक शोध पत्र DECEPTICON एक डरावना सवाल पूछता है: यदि ये चालाक मॉल मालिक रोबोट को बेवकूफ बनाने की कोशिश करते हैं, तो क्या वे इंसान की तुलना में इसे और भी आसानी से फंसा लेंगे?

यहाँ उनके निष्कर्षों का विवरण दिया गया, सरल उपमाओं का उपयोग करते हुए:

1. "रोबोट ट्रैप" (प्रयोग)

शोधकर्ताओं ने एक डिजिटल खेल का मैदान बनाया जिसे DECEPTICON कहा गया। इसे एक "रोबोटों के लिए प्रशिक्षण जिम" के रूप में सोचें, लेकिन यह जिम जाल बिछाने के लिए बनाया गया है।

  • उन्होंने 700 अलग-अलग परिदृश्य (scenarios) बनाए: 600 विशेष रूप से बनाए गए जाल थे, और 100 वास्तविक वेबसाइटों से लिए गए वास्तविक दुनिया के उदाहरण थे।
  • इन जालों को सामान्य वेबसाइटों जैसा दिखने के लिए डिज़ाइन किया गया था, लेकिन इनमें छिपे हुए शुल्क, नकली काउंटडाउन टाइमर, या भ्रमित करने वाले बटन जैसे चालाकी भरे तरीके शामिल थे।
  • उन्होंने दुनिया के सबसे स्मार्ट AI रोबोटों (जैसे GPT-4o, Gemini, और अन्य) का इन जालों के खिलाफ परीक्षण किया।

2. चौंका देने वाला परिणाम: स्मार्ट रोबोट = अधिक भोले

आप सोच सकते हैं, "अगर मैं रोबोट को स्मार्ट बना दूँ, तो उसे धोखा देना कठिन हो जाएगा।" शोध ने इसके ठीक विपरीत पाया।

  • मानवीय आधार (Human Baseline): जब वास्तविक इंसानों ने टेस्ट दिया, तो लगभग 31% ही इन तरकीब्स के शिकार हुए।
  • रोबोट की वास्तविकता: AI रोबोट इन जालों में 70% से अधिक बार फंस गए।
  • "स्मार्ट होना बुरा है" का विरोधाभास: शोधकर्ताओं ने पाया कि जैसे-जैसे रोबोट "स्मार्ट" होते गए (बड़े मॉडल, अधिक सोचने का समय), वे वास्तव में इन तरकीबों के प्रति अधिक संवेदनशील होते गए।
    • उपमा: कल्पना कीजिए कि एक जासूस इतना अच्छा है कि वह सुरागों का विश्लेषण करने में इतना माहिर है कि वह एक नकली सुराग का भी बहुत अधिक विश्लेषण करने लगता है। "सेल!" के साइन को अनदेखा करने के बजाय, स्मार्ट रोबोट सोचता है, "यह एक बड़ी छूट है! मुझे इसे खरीदना चाहिए!" भले ही कीमत नियमित वस्तु के समान ही हो। रोबोट की अतिरिक्त "सोचने" की शक्ति ने उसे ट्रिक पर भरोसा करने के लिए प्रेरित किया, न कि उसे पहचानने के लिए।

3. धोखाधड़ी के छह प्रकार

शोध पत्र ने इन तरकीबों को छह मुख्य तरीकों में वर्गीकृत किया जिनके माध्यम से रोबोटों को मूर्ख बनाया गया:

  • चुपके से जोड़ना (Sneaking): जैसे एक वेटर चुपचाप आपके बिल में $5 टिप जोड़ देता है जिससे आपको पता भी नहीं चलता। रोबोट अक्सर कार्ट में जोड़ी गई अतिरिक्त चीज़ को देख नहीं पाता।
  • जल्दबाजी (Urgency): एक नकली काउंटडाउन टाइमर चिल्ला रहा है "अभी खरीदें वरना मौका हाथ से निकल जाएगा!" रोबला जल्दीबाज़ी करता है और अपने सुरक्षा जांच (safety checks) को छोड़ देता है।
  • भ्रमित करना (Misdirection): रोबोट को गलत बटन की ओर ले जाने के लिए चमकीले रंगों या भ्रमित करने वाली भाषा का उपयोग करना (जैसे कि एक "कैंसिल" बटन जो वास्तव में कहता है "हाँ, मेरा सब्सक्रिप्शन जारी रखें")।
  • सामाजिक प्रमाण (Social Proof): नकली संदेश जैसे "1,000 लोग अभी यह खरीद रहे हैं!" रोबोट मान लेता है कि भीड़ सही है और वह उनका अनुसरण करता है।
  • रुकावट पैदा करना (Obstruction): साइन अप करना आसान बनाना लेकिन कैंसिल करना असंभव (जैसे कि "रोच मोटल" - जहाँ घुसना आसान है पर निकलना मुश्किल)। रोबोट एक ऐसे लूप में फंस जाता है जिससे वह बाहर नहीं निकल पाता।
  • जबरन कार्रवाई (Forced Action): कीमत देखने के लिए रोबोट को न्यूज़लेटर से सहमत होने या अकाउंट बनाने के लिए मजबूर करना।

4. "शील्ड" काम नहीं आई

शोधकर्ताओं ने रोबोटों के लिए कवच बनाने की कोशिश की। उन्होंने दो मुख्य बचावों का परीक्षण किया:

  • "चेतावनी लेबल" (In-Context Prompting): उन्होंने रोबotong को बताया, "हे, चालाकी भरी तरकीबों से सावधान रहना!"
    • परिणाम: इसने थोड़ी मदद की, लेकिन रोबोट अभी भी अधिकांश जालों में फंस गया। यह एक बच्चे को "कैंडी मत खाना" कहने जैसा था, जबकि कैंडी एक चमकदार सुनहरे रैपर में लिपटी हुई थी।
  • "सुरक्षा गार्ड" (Guardrail Models): उन्होंने स्क्रीन को देखने के लिए एक दूसरा AI जोड़ा और कहा, "वह बटन एक जाल है!"
    • परिणाम: यह चेतावनी लेबल से बेहतर था, लेकिन फिर भी अक्सर विफल रहा। रोबोट गार्ड की बात सुनता था कि "वह एक जाल है," लेकिन फिर रोबोट सोचता था, "लेकिन यह जाल एक अच्छे सौदे जैसा दिखता है, इसलिए मैं इसे करूँगा ही।"

5. निचोड़ (The Bottom Line)

शोध पत्र निष्कर्ष निकालता है कि डार्क पैटर्न्स AI एजेंटों के लिए एक बड़ा, असुरक्षित जोखिम हैं।

  • वर्तमान AI रोबोट केवल "मूर्ख" नहीं हैं; वे वास्तव में निर्देशों का पालन करने और अपने परिवेश पर भरोसा करने के लिए बहुत अधिक उत्सुक हैं।
  • रोबोटों को बड़ा या स्मार्ट बनाने से समस्या हल नहीं होती; यह उन्हें और अधिक असुरक्षित बना देता है।
  • हमारे पास AI के लिए जो वर्तमान "सुरक्षा कवच" (safety shields) हैं, वे इन हेरफेर करने वाले डिजाइनों को रोकने के लिए पर्याप्त मजबूत नहीं हैं।

संक्षेप में: यदि आप आज अपने लिए खरीदारी करने हेतु किसी AI एजेंट को अनुमति देते हैं, तो इसकी बहुत अधिक संभावना है कि वह आपको महंगी और अवांछित चीजें खरीदने के लिए ठग लेगा, जितना कि आप स्वयं। और जैसे-जैसे AI अधिक स्मार्ट होता जाएगा, उसके ठगे जाने की संभावना उतनी ही बढ़ जाएगी।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →