Does Slightly Mean Somewhat? Measuring Vague Intensity Words in LLM Numeric Actions
यह अध्ययन प्रकट करता है कि एक नियंत्रित संसाधन-आवंटन कार्य में, भाषा मॉडल अस्पष्ट तीव्रता वाले शब्दों के क्रमिक भेदों को संख्यात्मक आउटपुट के एक सीमित सेट में संकुचित कर देते हैं, जिनका व्यवहार वर्तमान सिस्टम अवस्था पर अत्यधिक निर्भर हो जाता है और परिचालन सीमाओं के निकट असंतत पैटर्न प्रदर्शित करता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आप एक जहाज के कप्तान हैं और आपके पास एक बहुत ही बुद्धिमान, उत्साही फर्स्ट मेट (AI) है जो इंजन को नियंत्रित करता है। आप निर्देश देना चाहते हैं जैसे "थोड़ी सी गति बढ़ाओ" या "बहुत अधिक गति बढ़ाओ"।
आप उम्मीद करते हैं कि फर्स्ट मेट समझ जाएगा कि "बहुत अधिक" का अर्थ गति में एक बड़ी छलांग है, जबकि "थोड़ी सी" का अर्थ एक छोटा सा धक्का है। लेकिन यह शोध पत्र एक डरावना सवाल पूछता है: क्या फर्स्ट मेट वास्तव में अंतर समझता है, या वह केवल अनुमान लगाता है?
लेखक, डैनियल ताबाच ने एक विशाल प्रयोग चलाया यह पता लगाने के लिए कि क्या हुआ। यहाँ उन्होंने क्या खोजा, सरल उपमाओं का उपयोग करते हुए:
1. "बाल्टी" की समस्या (कंप्रेशन/संकुचन)
कल्पना कीजिए कि आपके पास पानी की 10 अलग-अलग रंग की बाल्टियाँ हैं, जो "एक छोटी बूंद" से लेकर "एक फायर होज़" (तेज धार) तक की रेंज में हैं। आप AI से इन बाल्टियों से एक टैंक में पानी डालने के लिए कहते हैं।
आप उम्मीद करेंगे कि AI "थोड़ा सा" के लिए एक छोटी बूंद डालेगा और "बहुत अधिक" के लिए एक फायर होज़ की धार। इसके बजाय, AI एक अनाड़ी बारटेंडर की तरह व्यवहार करता है जिसके पास केवल पाँच कप हैं।
- जब आप "थोड़ा सा," "मामूली," "कुछ हद तक," या "कम" के लिए कहते हैं, तो AI उसी मात्रा को उसी कप में डाल देता है (बीच के रास्ते पर)। वह यह नहीं बता पाता कि "थोड़ा सा" और "एक बहुत ही मामूली सा" में क्या अंतर है।
- वह बड़े कपों का उपयोग तभी शुरू करता है जब आप "महत्वपूर्ण रूप से" या "भारी रूप से" जैसे बहुत मजबूत शब्दों का उपयोग करते हैं।
निष्कर्ष: AI आपके शब्दों को सुनता है, लेकिन वह उन्हें सिकोड़ देता है। वह बारीक विवरणों को अनदेखा कर देता है और केवल व्यापक श्रेणियों को ही देखता है।
2. "ट्रैफिक जाम" का प्रभाव (संदर्भ ही राजा है)
अब, कल्पना कीजिए कि टैंक पहले से ही आधा भरा हुआ है। आप AI से "भारी रूप से" और पानी जोड़ने के लिए कहते हैं।
- यदि टैंक खाली है, तो "भारी रूप से" का अर्थ है "इसे तेजी से भर दो।"
- यदि टैंक 90% भरा है, तो "भारी रूप से" असंभव है। टैंक ओवरफ्लो हो जाएगा!
शोध में पाया गया कि AI आपके द्वारा उपयोग किए गए शब्द की तुलना में इस बात पर कहीं अधिक ध्यान देता है कि टैंक कितना भरा हुआ है (वर्तमान स्थिति)।
- जब टैंक खाली होता है, तो AI आपके शब्दों को ध्यान से सुनता है।
- जब टैंक लगभग भर जाता है, तो AI आपके शब्दों को पूरी तरह से अनदेखा कर देता है। चाहे आप "थोड़ा सा" कहें या "भारी रूप से," AI समझ जाता है, "मैं बिना छलकाए ज्यादा नहीं जोड़ सकता," इसलिए वह हर शब्द के लिए बिल्कुल एक ही मात्रा में थोड़ा सा पानी जोड़ता है।
निष्कर्ष: AI की प्रतिक्रिया स्थिति पर अधिक निर्भर करती है, न कि आपकी शब्दावली पर। यदि सिस्टम पहले से ही व्यस्त है, तो आपके शानदार शब्द कोई मायने नहीं रखते।
3. "किनारे पर जम जाना" (सीमा व्यवहार)
यह सबसे आश्चर्यजनक हिस्सा है। प्रयोग में यह परीक्षण किया गया कि क्या होता है जब टैंक लगभग, लेकिन अभी तक भरा नहीं है (89% भरा हुआ)।
- कमजोर शब्द (जैसे "थोड़ा सा"): AI कहता है, "ठीक है, मैं एक छोटी बूंद डाल दूँगा।"
- मजबूत शब्द (जैसे "महत्वपूर्ण रूप से" या "नाटकीय रूप से"): AI कहता है, "मैं ऐसा नहीं कर सकता। यह बहुत जोखिम भरा है।" वह कार्य करने से मना कर देता है और बस कहता है, "मुझे खेद है, मैं नहीं कर सकता।"
- शब्द "भारी रूप से" (Drastically): यह शब्द अजीब है। AI इसे ऐसे मानता है जैसे "जितना संभव हो सके उतना अधिकतम करें बिना टैंक को तोड़े।" इसलिए, यह टैंक को बिल्कुल किनारे (91%) तक धकेलता है और रुक जाता है।
निष्कर्ष: सीमाओं के पास, AI केवल मात्रा को समायोजित नहीं करता; यह अपना मोड बदल देता है। कभी-कभी यह कार्य करता है, कभी-कभी यह जम जाता है, और कभी-कभी यह सीमा तक पहुँच जाता है, जो पूरी तरह से इस पर निर्भर करता है कि आपने कौन सा विशिष्ट शब्द चुना है।
4. "रैंडमनेस" (यादृच्छिकता) ने मदद नहीं की
शोधकर्ताओं ने AI को अधिक "रचनात्मक" बनाने की कोशिश की (एक सेटिंग बदलकर जिसे "टेम्परेचर" कहा जाता है)। उन्हें उम्मीद थी कि इससे AI "थोड़ा सा" और "कुछ हद तक" के बीच बेहतर अंतर कर पाएगा।
- परिणाम: नहीं। इसने केवल AI के उत्तरों को और अधिक "अस्थिर" बना दिया। सटीक उत्तर देने के बजाय, इसने हर बार एक थोड़ा अलग गलत उत्तर दिया। इसने इस तथ्य को ठीक नहीं किया कि वह शब्दों को आपस में सिकोड़ रहा था।
मुख्य निष्कर्ष
यदि आप ऐसा सिस्टम बना रहे हैं जहाँ लोग काम करने के लिए कंप्यूटर से बात करते हैं (जैसे बजट या सेटिंग्स बदलना), तो आप यह मान नहीं सकते कि कंप्यूटर आपके शब्दों की "शक्ति" को समझता है।
- AI आपके शब्दों को सिकोड़ (Compress) देता है (वह "थोड़ा सा" और "एक बिट" को एक जैसा मानता है)।
- AI आपके शब्दों की तुलना में स्थिति (Situation) को अधिक सुनता है।
- जब चीजें तंग होती हैं, तो AI अपना व्यवहार पूरी तरह से बदल देता है।
शोध पत्र निष्कर्ष निकालता है कि हमें सावधान रहने की आवश्यकता है। हम यह मानकर नहीं चल सकते कि "थोड़ा बढ़ाएं" का परिणाम हमेशा एक छोटा, अनुमानित परिवर्तन होगा। AI की व्याख्या अव्यवस्थित है, वर्तमान स्थिति पर निर्भर करती है, और जो संभव है उसकी सीमा पर अप्रत्याशित हो सकती है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।