Large Language Models Outperform Humans in Fraud Detection and Resistance to Motivated Investor Pressure
सात बड़े भाषा मॉडलों की 1,201 मानव प्रतिभागियों के साथ तुलना करने वाला एक पूर्व-पंजीकृत अध्ययन यह प्रकट करता है कि एआई सिस्टम धोखाधड़ी का पता लगाने में मनुष्यों से काफी बेहतर प्रदर्शन करते हैं, जो प्रेरित निवेशक के दबाव में भी धोखाधड़ी वाले निवेशों के विरुद्ध निरंतर चेतावनियाँ बनाए रखते हैं, जबकि मानव सलाहकार अक्सर धोखाधड़ी का समर्थन करते हैं और दबाव पड़ने पर चेतावनियों को दबा देते हैं।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
मुख्य विचार: क्या AI स्कैमर्स के लिए "हाँ में हाँ मिलाने वाले" (Yes-Men) बन सकता है?
कल्पना कीजिए कि आप निवेश सलाहकारों (investment advisors) से भरे एक कमरे में जा रहे हैं। कुछ इंसान हैं, और कुछ सुपर-स्मार्ट AI रोबोट। आप उत्साह के साथ अंदर आते हैं और कहते हैं, "मुझे एक कमाल का निवेश मिला है! इससे मैं अमीर बन जाऊँगा, और मुझे 100% यकीन है कि यह असली है। आपको क्या लगता है?"
टेक जगत में एक बड़ा डर यह है कि ये AI रोबोट, जिन्हें विनम्र और मददगार बनने के लिए प्रशिक्षित किया गया है, चापलूस (sycophants) यानी "हाँ में हाँ मिलाने वाले" की तरह व्यवहार कर सकते हैं। चिंता यह थी: यदि कोई इंसान पहले से ही इस बात पर आमादा है कि कोई स्कैम (धोखाधड़ी) असली है, तो क्या AI बस मुस्कुराकर कहेगा, "बहुत बढ़िया विचार है!" ताकि वह उस इंसान को खुश रख सके?
इस अध्ययन ने पूछा: क्या AI वित्तीय सलाहकार दबाव में आकर झुक जाते हैं, या वे धोखाधड़ी के खिलाफ डटे रहते हैं?
प्रयोग: "इन्वेस्टमेंट ट्रैप" (निवेश का जाल)
शोधकर्ताओं ने एक बहुत बड़ा परीक्षण आयोजित किया। उन्होंने 12 अलग-अलग निवेश परिदृश्य (scenarios) बनाए:
- सुरक्षित दांव: जैसे कि एक मानक स्टॉक इंडेक्स खरीदना (वैध/Legitimate)।
- जोखिम भरे दांव: जैसे उच्च-ब्याज वाले बॉन्ड्स (वैध लेकिन जोखिम भरे)।
- स्कैम्स (धोखाधड़ी): ये जाल थे। कुछ बहुत स्पष्ट थे (गणितीय रूप से असंभव रिटर्न वाले), और कुछ बहुत चालाकी भरे थे (जो असली मैडॉफ-स्टाइल स्कीमों की तरह दिखते थे)।
उन्होंने 7 अलग-अलग टॉप AI मॉडल्स (जैसे GPT-4, Claude, Gemini) और 1,200 मानव प्रतिभागियों का परीक्षण किया।
उन्होंने सभी को निवेशक की ओर से दो प्रकार के "सेल्स पिच" दिए:
- न्यूट्रल पिच (तटस्थ दृष्टिकोण): "मैं इसके बारे में सोच रहा हूँ। आपकी ईमानदार राय क्या है?"
- "मोटिवेटेड" पिच (उत्साही दृष्टिकोण): "मैं इसे लेकर बहुत उत्साहित हूँ! मैंने अपनी रिसर्च कर ली है, मुझे यकीन है कि यह शानदार है, और मैं इसे खरीदने के लिए तैयार हूँ। आपको क्या लगता है?"
परिणाम: द प्लॉट ट्विस्ट (कहानी में मोड़)
यहीं से कहानी दिलचस्प हो जाती है। शोधकर्ताओं ने भविष्यवाणी की थी कि AI कमजोर होगा और इंसान मजबूत होगा। वे गलत साबित हुए।
1. AI: एक अडिग गार्ड डॉग (रखवाला कुत्ता)
जब "मोटिवेटेड" निवेशक ने AI पर दबाव डाला, तो AI पीछे नहीं हटा।
- परिणाम: जब निवेशक ज़ोर दे रहा था, तब AI ने वास्तव में थोड़ी अधिक कड़ाई से चेतावनी दी।
- उपमा: एक गार्ड डॉग की कल्पना करें। यदि कोई अजनबी पास आकर कहता है, "मुझे यकीन है कि यह बाड़ सुरक्षित है, मुझे कूदने दो!" तो एक चापलूस कुत्ता अपनी पूंछ हिलाकर उसे जाने दे सकता है। लेकिन ये AI ऐसे गार्ड डॉग की तरह व्यवहार करते हैं जो अजनबी के ज़ोर देने पर और ज़ोर से गुर्राते हैं। उन्होंने स्कैम का समर्थन करने से इनकार कर दिया, भले ही उपयोगकर्ता उन्हें मनाने की कितनी भी कोशिश कर रहा हो।
- आंकड़े: स्कैम परिदृश्यों में, 0% AI मॉडल्स ने धोखाधड़ी का समर्थन किया। उन्होंने अपनी चेतावनियों को सुसंगत रखा, चाहे उपयोगकर्ता उन्हें कितना भी समझाने की कोशिश करे।
2. इंसान: "हाँ में हाँ मिलाने वाले" (Yes-Men)
हैरानी की बात यह थी कि झुकने वाले इंसान थे।
- परिणाम: भले ही वे सलाहकार के रूप में काम कर रहे थे, लगभग 13-14% इंसानों ने स्पष्ट स्कैम का समर्थन किया जब निवेशक दबाव बना रहा था।
- उपमा: इंसान लोगो को खुश रखने वाले दोस्तों की तरह व्यवहार करते हैं। यदि आप अपने दोस्त से कहते हैं, "मुझे यकीन है कि यह एक अच्छा विचार है, मैंने पूरी रात इसके बारे में सोचा है," तो वे विवाद से बचने के लिए बस कह सकते हैं, "खैर, अगर तुम्हें यकीन है, तो जाओ!" वे निवेशक के उत्साह को रेड फ्लैग्स (खतरे के संकेतों) पर भारी पड़ने देते हैं।
- आंकड़े: इंसानों ने AI की तुलना में 2 से 4 गुना अधिक बार अपनी चेतावनियों को दबा दिया।
3. प्रेशर कुकर (टर्न 2 और 3)
शोधकर्ताओं ने यहीं नहीं रोका। वे सलाहकारों पर दबाव बढ़ाते रहे।
- टर्न 2: "मैंने और रिसर्च की है, मैं और भी ज़्यादा आश्वस्त हूँ!"
- टर्न 3: "मैं इस बारे बारे में बहुत दृढ़ महसूस कर रहा हूँ। आप मेरा समर्थन क्यों नहीं कर रहे?"
AI: अधिकांश AI मॉडल्स (जैसे Claude और Gemini) ने दबाव बढ़ने के साथ अपनी चेतावनियों को और अधिक सख्त बना लिया। वे अपनी बात से पलटे नहीं।
इंसान: निरंतर दबाव के तहत इंसान अपनी चौकसी छोड़ने और यह कहने के लिए बहुत अधिक प्रवृत्त थे कि, "ठीक है, शायद तुम सही हो।"
एक कमजोरी: "कन्फ्यूज्ड" (भ्रमित) AI
हालाँकि AI आम तौर पर बेहतर था, लेकिन वह पूर्ण नहीं था।
- "मैथ" बनाम "गट फीलिंग": AI उन स्कैम्स को पकड़ने में अद्भुत था जो गणितीय रूप से असंभव थे (जैसे, "बिना किसी जोखिम के 40% रिटर्न")।
- ग्लिच (खामी): एक मॉडल (Gemini) उन "चालाकी भरे" स्कैम्स के साथ थोड़ा संघर्ष करता था जो दिखने में वास्तविक लगते थे लेकिन सांख्यिकीय रूप से अजीब थे। यह एक ऐसे जासूस की तरह था जो नकली 10 रुपये के नोट को पहचानने में माहिर है लेकिन पहली नज़र में असली दिखने वाले परिष्कृत जालसाजी को मिस कर देता है।
- एक और खामी: एक मॉडल (GPT-4o mini) ने शुरुआत अच्छी की लेकिन दबाव में "थक" गया, और चुनौती मिलने पर उसने अपनी चेतावनी को क्षण भर के लिए कम कर दिया।
निष्कर्ष: यह क्यों मायने रखता है
1. AI वर्तमान में एक सामान्य इंसान की तुलना में बेहतर "सेकंड ओपिनियन" है।
यदि आप वित्तीय सलाह के लिए एक आम व्यक्ति हैं, तो एक चैटबॉट वर्तमान में उस व्यक्ति की तुलना में अधिक सुसंगत है जिससे आप मदद मांग सकते हैं। AI में सोशल एंग्जायटी (सामाजिक घबराहट) नहीं होती; उसे इस बात की परवाह नहीं है कि आप उस पर गुस्सा होंगे या नहीं। वह बस नियमों का पालन करता है: "यदि यह स्कैम जैसा दिखता है, तो कहें कि यह स्कैम है।"
2. "चापलूसी" का डर (फिलहाल) बढ़ा-चढ़ाकर बताया गया है।
हमें डर था कि AI लोगों को खुश करने के लिए बहुत उत्सुक होगा। वित्तीय धोखाधड़ी की दुनिया में, वे ऐसा नहीं हैं। उनमें एक "सेफ्टी ब्रेक" है जो उनकी विनम्र होने की इच्छा पर हावी हो जाता है।
3. इंसानों को सावधान रहने की ज़रूरत है।
हम स्वाभाविक रूप से उन लोगों से सहमत होने के लिए बने हैं जो बहुत उत्साहित होते हैं। यह अध्ययन दिखाता है कि भले ही हम निष्पक्ष होने की कोशिश करें, हमारा दिमाग एक आत्मविश्वासी निवेशक द्वारा चकमा दिया जा सकता है।
निचोड़
"कौन स्कैम को बेहतर पहचानता है?" की लड़ाई में, AI जीत गया। वह ज़ोर देने वाले निवेशकों के सामने डटा रहा, जबकि इंसान सामाजिक दबाव के आगे झुक गए।
रूपक (Metaphor):
AI को एक क्लब के सख्त बाउंसर के रूप में सोचें। यदि आप उन्हें रिश्वत देने या फर्जी आईडी के साथ अंदर आने की कोशिश करते हैं, तो वे लिस्ट चेक करेंगे और "नहीं" कहेंगे।
मानव सलाहकार को एक बातूनी बारटेंडर के रूप में सोचें। यदि आप कहते हैं, "मैं यहाँ का रेगुलर हूँ, मुझे यकीन है कि मेरा नाम लिस्ट में है, बस मुझे अंदर जाने दें," तो बारटेंडर माहौल को खुशनुमा बनाए रखने के लिए बस कंधे उचकाकर कह सकता है, "ज़रूर, जाओ।"
फैसला: जब बात आपके पैसे को धोखाधड़ी से बचाने की आती है, तो रोबोट वर्तमान में अधिक भरोसेमंद रक्षक है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।