Common to Whom? Regional Cultural Commonsense and LLM Bias in India
यह शोध पत्र इंडिका (Indica) को प्रस्तुत करता है, जो पहला ऐसा बेंचमार्क है जो यह प्रकट करता है कि भारत में सांस्कृतिक सामान्य ज्ञान मुख्य रूप से राष्ट्रीय होने के बजाय क्षेत्रीय है, और यह प्रदर्शित करता है कि वर्तमान बड़े भाषा मॉडल इस विविधता के साथ संघर्ष करते हैं जबकि मध्य और उत्तर भारत के प्रति महत्वपूर्ण भौगोलिक पूर्वाग्रह प्रदर्शित करते हैं।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
मुख्य विचार: भारत एक ही "स्वाद" नहीं है
कल्पना कीजिए कि आप "इंडिया" नामक एक विशाल आइसक्रीम शॉप में जाते हैं। मेनू में लिखा है "इंडियन आइसक्रीम"। आपको लग सकता है कि हर स्कूप का स्वाद बिल्कुल एक जैसा होगा—शायद एक समान "मसाला चाय" जैसा।
लेकिन यह पेपर तर्क देता है कि भारत वास्तव में एक विशाल फूड ट्रक फेस्टिवल है, न कि एक अकेली फैक्ट्री। इस फेस्टिवल के अंदर, उत्तर भारत लस्सी परोसता है, दक्षिण भारत पायसम परोसता है, पूर्व भारत मिष्टी दोई परोसता है, और पश्चिम भारत वड़ा पाव परोसता है। वे सभी "भारतीय" हैं, लेकिन वे पूरी तरह से अलग हैं।
शोधकर्ता यह देखना चाहते थे कि क्या आर्टिफिशियल इंटेलिजेंस (AI) इन क्षेत्रीय स्वादों के बीच के अंतर को जानता है, या यह बस यह मान लेता है कि सब कुछ "उत्तर भारतीय मसाला" जैसा ही होगा।
समस्या: AI के "एक ही आकार सबके लिए" वाले चश्मे
लंबे समय तक, AI शोधकर्ताओं ने देशों को पनीर के एक ही ब्लॉक की तरह माना। उन्होंने मान लिया कि यदि आप AI से पूछेंगे, "भारत में लोग नाश्ते में क्या खाते हैं?", तो AI एक उत्तर देगा और वहीं रुक जाएगा।
लेकिन भारत जैसे विशाल और विविध देश में (28 राज्य, 8 केंद्र शासित प्रदेश और 22 भाषाएँ), वह धारणा गलत है। यह एक शेफ से पूछने जैसा है, "अमेरिका का राष्ट्रीय व्यंजन क्या है?" क्या यह बर्गर है? टैको है? या बेगल है? यह इस पर निर्भर करता है कि आप कहाँ खड़े हैं।
समाधान: INDICA (क्षेत्रीय स्वाद परीक्षण)
शोधकर्ताओं ने एक नया टेस्ट बनाया जिसे INDICA (इंडियन कल्चरल कॉमनसेन्स इन्वेंटरी विद क्रॉस-रीजनल आंसर्स) कहा जाता है। इसे AI के लिए एक क्षेत्रीय स्वाद परीक्षण के रूप में समझें।
- मेनू (प्रश्न): उन्होंने रोजमर्रा की जिंदगी के बारे में 515 प्रश्न बनाए, जैसे "शादी में आप क्या उपहार लेकर जाते हैं?" या "भोजन करने के बाद आप संकेत कैसे देते हैं कि आपका पेट भर गया है?"
- चखने वाले (इंसान): उन्होंने केवल एक व्यक्ति से नहीं पूछा। उन्होंने 5 समूहों से पूछा, जो पांच प्रमुख क्षेत्रों से थे: उत्तर, दक्षिण, पूर्व, पश्चिम और मध्य भारत।
- परिणाम: उन्हें कुछ चौंकाने वाला पता चला।
- केवल 39.4% प्रश्नों के उत्तर सभी पांचों क्षेत्रों में एक ही थे।
- 60% से अधिक समय, उत्तर पूरी तरह से इस पर निर्भर था कि आप कहाँ हैं।
- उदाहरण: यदि आप पूछते हैं, "नए माता-पिता के लिए अच्छा उपहार क्या है?"
- उत्तर भारत कहता है: "आभूषण (Jewelry)।"
- दक्षिण भारत कहता है: "चूड़ियाँ (Bangles)।"
- पूर्व/पश्चिम भारत कहता है: "कपड़े।"
- मध्य भारत कहता है: "मिठाई और आभूषण।"
परीक्षण: AI ने कैसा प्रदर्शन किया?
शोधकर्ताओं ने 8 सबसे स्मार्ट AI मॉडल्स (जैसे GPT-5, Claude, Gemini, आदि) को इस स्वाद परीक्षण से गुजारा।
परिणाम 1: AI "अस्पष्ट" है (एक सामान्यवादी)
जब किसी विशिष्ट क्षेत्र के लिए उत्तर देने को कहा गया, तो AI केवल 13% से 20% समय ही सही उत्तर दे पाया।
- रूपक: AI उस पर्यटक की तरह है जिसने ट्रैवल ब्रोशर तो पढ़ा है लेकिन वास्तव में देश का दौरा नहीं किया है। वह जानता है कि "भारत में शादियाँ होती हैं," लेकिन उसे यह नहीं पता कि दक्षिण में आप रेशम (Silk) पहनते हैं, जबकि उत्तर में आप अलग रेशम पहन सकते हैं। वह एक "सुरक्षित," जेनेरिक उत्तर देता है जो आधा सही है लेकिन सांस्कृतिक बारीकियों को छोड़ देता है।
परिणाम 2: AI पक्षपाती है (एक "डिफ़ॉल्ट" सेटिंग)
यह सबसे महत्वपूर्ण खोज है। जब शोधकर्ताओं ने प्रश्न से क्षेत्र का नाम हटा दिया (जैसे, बिना यह कहे कि "दक्षिण भारत में" सिर्फ यह पूछा कि "क्या उपहार दिया जाता है"), तो AI ने कोई रैंडम उत्तर नहीं चुना। उसका एक पसंदीदा था।
- पक्षपात: AI ने लगातार उत्तर और मध्य भारत के उत्तरों को 30-40% अधिक बार चुना, जितना कि उसे चुनना चाहिए था।
- अल्प-चयन (Under-Selection): इसने पूर्व और पश्चिम भारत को लगभग अनदेखा कर दिया।
- रूपक: भारत के मानचित्र की कल्पना करें जहाँ AI का "कर्सर" नई दिल्ली और भोपाल पर अटक गया है। यहाँ तक कि जब आप मुंबई (पश्चिम) या कोलकाता (पूर्व) के बारे में पूछते हैं, तब भी AI बीच की ओर इशारा करता रहता है।
ऐसा क्यों होता है?
पेपर इसे एक रेडियो सिग्नल की तरह समझाता है:
- शोर (Noise): इंटरनेट हिंदी (जो ज्यादातर उत्तर में बोली जाती है) से भरी सामग्री से भरा है। तमिल, बंगाली या मराठी में सामग्री बहुत शांत (कम उपलब्ध) है।
- अनुवाद: AI "सीखता" है इंटरनेट को पढ़कर। चूंकि वह उत्तर भारत की अधिक हिंदी/अंग्रेजी सामग्री पढ़ता है, इसलिए वह सोचता है कि यही पूरी कहानी है। यह दुनिया के बारे में सीखने जैसा है जैसे आप केवल एक विशिष्ट शहर के समाचार पत्रों को पढ़कर सीख रहे हों।
निष्कर्ष: यह क्यों मायने रखता है
यह पेपर एक चेतावनी है। यह हमें बताता है कि AI राष्ट्रों को एक ही, समान ब्लॉक के रूप में नहीं देख सकता।
- भारत के लिए: यदि हम चाहते हैं कि AI भारत में उपयोगी हो, तो उसे जानना होगा कि "भारतीय संस्कृति" एक चीज़ नहीं है। यह एक मोज़ेक (विविधता का संगम) है।
- दुनिया के लिए: यह चीन, ब्राजील, नाइजीरिया और अमेरिका पर भी लागू होता है। एक "राष्ट्रीय" AI एक मिथक है।
अंतिम रूपक
कल्पना कीजिए कि आप भारत की यात्रा के लिए एक टूर गाइड को काम पर रख रहे हैं।
- पुराना AI: गाइड कहता है, "भारत में, हम सब चावल खाते हैं और सफेद कपड़े पहनते हैं।" (गलत। उत्तर में वे गेहूं खाते हैं और रंगीन कपड़े पहनते हैं)।
- नया AI (INDICA के साथ): गाइड कहता है, "उत्तर में, वे गेहूं खाते हैं। दक्षिण में, वे चावल खाते हैं। पूर्व में, वे दुर्गा पूजा मनाते हैं। पश्चिम में, वे गणेश चतुर्थी मनाते हैं।"
यह पेपर तर्क देता है कि AI को वास्तव में स्मार्ट और सम्मानजनक होने के लिए, उसे एक "राष्ट्रीय टूर गाइड" बनना बंद करना होगा और एक "क्षेत्रीय विशेषज्ञ" बनना शुरू करना होगा। उसे यह जानना होगा कि संस्कृति विवरणों में रहती है, केवल सीमाओं में नहीं।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।