← नवीनतम पेपर
💬 NLP

Imperative Interference: Social Register Shapes Instruction Topology in Large Language Models

यह शोध पत्र यह प्रदर्शित करता है कि सिस्टम प्रॉम्प्ट में आज्ञावाचक रूप (इम्पेरेटिव मूड) भाषा-निर्भर निर्देश टोपोलॉजी बनाता है—जो अंग्रेजी में सहयोगात्मक है लेकिन स्पेनिश में प्रतिस्पर्धी है—जो विभिन्न सामाजिक रजिस्टर परंपराओं के कारण होता है, जबकि निर्देशों को निश्चयात्मक रूप (डिक्लेरेटिव मूड) में फिर से लिखने से इस अंतर-भाषाई भिन्नता में काफी कमी आती है।

मूल लेखक: Tony Mason

प्रकाशित 2026-03-27
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Tony Mason

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

मुख्य विचार: निर्देश केवल तकनीकी नहीं, बल्कि सामाजिक होते हैं

कल्पना कीजिए कि आप एक जहाज के कप्तान हैं। आपके पास एक चालक दल (AI) है और एक नियम पुस्तिका (System Prompt) है।

आमतौर पर, हम नियम पुस्तिका को तकनीकी तथ्यों की एक सूची के रूप में देखते हैं: "इंजन चालू है," "पाल ऊपर हैं।" लेकिन यह शोध पत्र तर्क देता है कि AI के लिए, एक नियम पुस्तिका वास्तव में एक सामाजिक संवाद है। यह इस बारे में है कि कौन किससे बात कर रहा है, और वे इसे कैसे कह रहे हैं।

शोधकर्ताओं ने कुछ अजीब खोजा: नियमों का वही सेट अंग्रेजी में तो पूरी तरह काम करता है, लेकिन स्पेनिश में अनुवादित होने पर बिखर जाता है।

ऐसा नहीं है कि अनुवाद खराब है। बात यह है कि नियमों को लिखने का तरीका प्रत्येक भाषा में एक अलग 'सोशल वाइब' (सामाजिक माहौल) पैदा करता है।


उपमा: "कमांडिंग ऑफिसर" बनाम "फैक्ट शीट"

यह समझने के लिए कि ऐसा क्यों होता है, कल्पना कीजिए कि लोगों के समूह को निर्देश देने के दो अलग-अलग तरीके हैं:

  1. इम्पेरेटिव स्टाइल (कमांडिंग ऑफिसर - आदेश देने वाला अधिकारी):

    • "लाल बटन को कभी न छुएं!"
    • "हमेशा अपना हेलमेट पहनें!"
    • "दौड़ें मत!"
    • वाइब (Vibe): यह मुखर, अधिकारपूर्ण और सीधा है। अंग्रेजी में, यदि आप ऐसे पाँच आदेशों को एक साथ रखते हैं, तो चालक दल को एक एकल, मजबूत अधिकार की आवाज महसूस होती है। वे सब सहमत होते हैं: "ठीक है, कप्तान बोल रहे हैं। हम सुनते हैं।"
  2. डिक्लेरेटिव स्टाइल (फैक्ट शीट - तथ्य पत्रक):

    • "लाल बटन: न छुएं।"
    • "हेलमेट की स्थिति: आवश्यक।"
    • "दौड़ना: निषिद्ध।"
    • वाइब (Vibe): यह शांत और तथ्यात्मक है। यह कोई आदेश नहीं है; यह बस इस बात का वर्णन है कि दुनिया कैसे काम करती है।

समस्या: स्पेनिश में "सोशल नॉइज़" (सामाजिक शोर)

शोधकर्ताओं ने पाया कि अंग्रेजी में, "कमांडिंग ऑफिसर" शैली बहुत अच्छा काम करती है। AI सभी आदेशों को सुनता है और उन सभी का एक साथ पालन करता है।

लेकिन स्पेनिश में, वही "कमांडिंग ऑफिसर" शैली सोशल नॉइज़ (सामाजिक शोर) पैदा करती है।

  • अंग्रेजी में: आदेशों को एक के ऊपर एक रखने से एक मजबूत नेता द्वारा स्पष्ट आदेशों की सूची जैसा महसूस होता है। AI सोचता है, "समझ गया, कप्तान।"
  • स्पेनिश में: वे ही समान आदेशों को जोड़ने से ऐसा लगता है जैसे पाँच अलग-अलग लोग एक साथ आदेश चिल्ला रहे हों। सांस्कृतिक और भाषाई बारीकियों के कारण, "अनिवार्य बल" (कि आपको कितना सुनना ही होगा) अलग महसूस होता है। AI भ्रमित हो जाता है। वह सोचता है, "रुको, क्या व्यक्ति A मुझे यह करने के लिए कह रहा है, जबकि व्यक्ति B मुझे यह न करने के लिए कह रहा है? बॉस कौन है?"

एक दूसरे के साथ सहयोग करने के बजाय, निर्देश आपस में लड़ने लगते हैं। एक आदेश को हटा देने से वास्तव में AI का प्रदर्शन बेहतर होता है क्योंकि यह चिल्लाने के मुकाबले को रोक देता है।

प्रयोग: "रीराइट" (पुनर्लेखन) समाधान

शोधकर्ताओं ने इसका परीक्षण एक वास्तविक AI सिस्टम (Claude Code) के साथ किया। उन्होंने 56 निर्देशों वाले एक प्रॉम्प्ट को लिया और प्रयोग किए:

  1. बेसलाइन (आधार रेखा): उन्होंने देखा कि अंग्रेजी में, निर्देश एक सहकारी टीम की तरह काम करते हैं। स्पेनिश में, वे एक प्रतिस्पर्धी लड़ाई की तरह काम करते हैं।
  2. सुधार (The Fix): उन्होंने स्पेनिश में "कमांडिंग ऑफिसर" निर्देशों को लेकर उन्हें "फैक्ट शीट्स" (डिक्लेरेटिव) के रूप में फिर से लिखा।
    • पहले: "आपको इस टूल का उपयोग कभी नहीं करना चाहिए!" (आदेश)
    • बाद में: "यह टूल अक्षम (disabled) है।" (तथ्य)
  3. परिणाम:
    • जादू: जब उन्होंने ग्यारह "कमांडिंग" निर्देशों में से केवल तीन को "तथ्यों" (Facts) के रूप में फिर से लिखा, तो पूरा स्पेनिश सिस्टम अचानक लड़ना बंद कर दिया। निर्देश फिर से सहकारी हो गए।
    • स्पिलओवर (Spillover): यहाँ तक कि जिन निर्देशों को उन्होंने नहीं बदला था, वे भी बेहतर काम करने लगे। यह कमरे में चिल्लाने वाले तीन लोगों के शोर को कम करने जैसा है; अचानक, कमरे में मौजूद बाकी सभी लोग एक-दूसरे को बेहतर ढंग से सुन पा रहे हैं।

यह क्यों मायने रखता है?

यह हमारे AI सुरक्षा और प्रशिक्षण के बारे में सोचने के तरीके को बदल देता है।

  • "कॉन्स्टिट्यूशनल AI" (संवैधानिक AI) की समस्या: कई AI मॉडल को "कॉन्स्टिट्यूशनल AI" का उपयोग करके प्रशिक्षित किया जाता है, जहाँ मनुष्य AI को नियम सिखाते हैं जैसे "सहायक बनें," "हानिरहित बनें," और "ईमानदार रहें।" ये आदेशों (Imperatives) के रूप में लिखे जाते हैं।
  • भविदन (Prediction): यदि AI इन नियमों को अंग्रेजी में सीखता है (जहाँ आदेश अच्छी तरह काम करते हैं) लेकिन फिर स्पेनिश में उनका उपयोग करने की कोशिश करता है (जहाँ आदेश भ्रम पैदा करते हैं), तो AI अंग्रेजी में "अच्छा" हो सकता है लेकिन स्पेनिश में "अजीब" या "अविश्वसनीय" हो सकता है। ऐसा इसलिए नहीं है कि AI को भाषा नहीं पता; बल्कि इसलिए है क्योंकि नियमों का सामाजिक स्वर (social tone) अनुवादित नहीं होता।

निष्कर्ष (Takeaway)

यदि आप चाहते हैं कि एक AI हर भाषा में नियमों का पूरी तरह से पालन करे, तो चिल्लाना बंद करें।

"कभी X न करें! हमेशा Y करें!" कहने के बजाय, कहें, "X अक्षम है। Y आवश्यक है।"

निर्देशों को आदेशों के बजाय तथ्यों के रूप में मानकर, आप सांस्कृतिक भ्रम को दरकिनार कर देते हैं। आप AI को यह सोचने से रोक देते हैं कि "बॉस कौन है" और उसे बस "नियम क्या है" पर ध्यान केंद्रित करने देते हैं।

संक्षेप में: यह शोध पत्र सिद्ध करता है कि AI केवल एक कैलकुलेटर नहीं है; यह एक सामाजिक प्राणी है जो भाषा के आधार पर आवाज के लहजे के प्रति अलग तरह से प्रतिक्रिया करता है। सर्वोत्तम परिणाम प्राप्त करने के लिए, तथ्यों में बात करें, आदेशों में नहीं।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →