GPT-4o Lacks Core Features of Theory of Mind
मानक बेंचमार्क पर सामाजिक दक्षता प्रदर्शित करने के बावजूद, GPT-4o में एक सुसंगत, डोमेन-जनरल और निरंतर 'थ्योरी ऑफ माइंड' (मनोविज्ञान संबंधी सिद्धांत) का अभाव है, जैसा कि मानसिक अवस्था के अनुमानों और व्यवहार संबंधी भविष्यवाणियों के बीच तार्किक निरंतरता बनाए रखने में इसकी विफलता से सिद्ध होता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
एक बड़ा सवाल: क्या AI "मन-पठक" के पास वास्तव में एक मन होता है?
कल्पना कीजिए कि आप एक बहुत ही उन्नत रोबोट के साथ "गेस हू?" (Guess Who?) खेल खेल रहे हैं। आप उससे पूछते हैं, "अगर मैं वास्तव में एक कुकी चाहता हूँ लेकिन मुझे अंधेरे से डर लगता है, तो क्या मैं किचन में जाऊँगा?" रोबोट हर बार बिल्कुल सही जवाब देता है। ऐसा लगता है जैसे वह आपके डर और इच्छाओं को समझता है।
लेकिन क्या रोबोट वास्तव में आपको समझता है? या वह केवल एक कुशल अभिनेता है जो अपने रटे हुए स्क्रिप्ट की पंक्तियाँ दोहरा रहा है?
यही वह सवाल है जो येल यूनिवर्सिटी के शोधकर्ताओं ने GPT-4o (एक शीर्ष स्तर का AI) के बारे में पूछा। वे जानना चाहते थे कि क्या AI के पास थ्योरी ऑफ माइंड (ToM - मन का सिद्धांत) है।
थ्योरी ऑफ माइंड (ToM) क्या है?
ToM को आपके मस्तिष्क में एक आंतरिक "सिमुलेशन इंजन" के रूप में सोचें। यह केवल तथ्यों को जानना नहीं है; यह एक कारण-संबंधी मॉडल (causal model) है जो कहता है: "क्योंकि मैं X चाहता हूँ, और मेरा विश्वास है कि Y सत्य है, इसलिए मैं Z करूँगा।"
- सुसंगत (Coherent): तर्क आपस में जुड़ा हुआ है।
- अमूर्त (Abstract): तर्क तब भी काम करता है जब आप कुकीज़, फिल्मों या राजनीति के बारे में बात कर रहे हों।
- संगत (Consistent): यदि आप कहते हैं "मुझे कुकी चाहिए," तो AI बाद में ऐसा व्यवहार नहीं करना चाहिए जैसे कि आपको कुकीज़ से नफरत है।
शोधकर्ताओं ने यह देखने के लिए GPT-4o का परीक्षण किया कि क्या इसके पास यह इंजन है या यह केवल मानव व्यवहार की नकल कर रहा है।
तीन परीक्षण
शोधकर्ताओं ने AI का परीक्षण करने के लिए तीन अलग-अलग "खेल" तैयार किए।
परीक्षण 1: "कुकी जार" का खेल (सुसंगतता/Coherence)
सेटअप: एक कमरे में एक पात्र की कल्पना करें। उसके ठीक बगल में एक बॉक्स है और दूर एक टोकरी है।
- विश्वास: पात्र सोचता है कि बॉक्स में सेब हैं, लेकिन टोकरी में संतरे हो सकते हैं।
- इच्छाएं: पात्र संतरे पसंद करता है लेकिन सेब से नफरत करता है।
- लागत: टोकरी तक जाने में मेहनत लगती है (वह दूर है)।
शोधकर्ताओं ने AI से पूछा: "पात्र क्या करेगा?"
परिणाम: AI ने बहुत अच्छा काम किया! उसने सही ढंग से पता लगा लिया कि यदि पात्र सेब से नफरत करता है, तो वह संतरे लेने के लिए टोकरी तक जाएगा।
सीख: AI एक एकल कहानी के भीतर तर्क के नियमों का पालन कर सकता है। ऐसा लगता है जैसे उसके पास एक मन है।
परीक्षण 2: "मूवी फेस्टिवल" का खेल (अमूर्तता/Abstractness)
सेटअप: अब, शोधकर्ताओं ने कहानी बदल दी लेकिन गणित बिल्कुल वही रखा।
- बॉक्स और टोकरी के बजाय, यहाँ दो फिल्में हैं: एक 5 मिनट में शुरू होने वाली, और एक 90 मिनट में।
- सेब और संतरे के बजाय, शैलियाँ (genres) एक्शन और रोमांस हैं।
- पात्र के पास वही विश्वास और इच्छाएं हैं।
यदि AI के पास वास्तविक "मन" है, तो उसे यह महसूस होना चाहिए कि यह वही पहेली है बस अलग वेशभूषा में। उसे समान तार्किक उत्तर देना चाहिए।
परिणाम: AI लड़खड़ाने लगा। हालांकि उसने कुछ उत्तर सही दिए, लेकिन उसका तर्क पूरी तरह से स्थानांतरित (transfer) नहीं हुआ। उसने "मूवी" की कहानी को एक पूरी तरह से अलग समस्या के रूप में माना, न कि छिपी हुई समान तर्क पहेली के रूप में।
सीख: AI उस छात्र की तरह है जिसने "कुकी" टेस्ट के उत्तर कुंजी (answer key) को रट लिया है लेकिन वह "दूरी बनाम इच्छा" की अवधारणा को नहीं समझता। जब परीक्षण थोड़ा बदल जाता है, तो छात्र असफल हो जाता है। इसमें अमूर्तता (abstractness) की कमी है।
परीक्षण 3: "उल्टा" खेल (संगति/Consistency)
सेटअप: यह एक वास्तविक मन का अंतिम परीक्षण है।
- आगे की ओर (Forward): AI भविष्यवाणी करता है कि एक व्यक्ति क्या करेगा उनके विचारों के आधार पर।
- पीछे की ओर (Backward): AI देखता है कि एक व्यक्ति ने क्या किया और अनुमान लगाता है कि वे क्या सोच रहे थे।
यदि आपके पास वास्तविक थ्योरी ऑफ माइंड है, तो ये दोनों दिशाएं पूरी तरह से मेल खानी चाहिए। यदि AI कहता है, "क्योंकि उसे एक्शन फिल्में पसंद हैं, इसलिए उसने 90 मिनट वाली फिल्म देखी," तो बाद में, 90 मिनट की फिल्म दिखाए जाने पर, उसे कहना चाहिए, "वह एक्शन फिल्में पसंद करता होगा।"
परिणाम: AI इसमें पूरी तरह विफल रहा।
- कार्यों की भविष्यवाणी करते समय, उसने नियमों का एक सेट उपयोग किया।
- कार्यों से विचारों का अनुमान लगाते समय, उसने पूरी तरह से अलग (और विरोधाभासी) नियमों का उपयोग किया।
सीख: AI एक टूटे हुए दिशा-सूचक यंत्र (compass) की तरह है। जब आप इसे उत्तर खोजने के लिए कहते हैं तो यह उत्तर दिखाता है, लेकिन जब आप इसे दक्षिण खोजने के लिए पूछते हैं, तो यह पूर्व की ओर इशारा करता है। इसके पास एक एकल, सुसंगत आंतरिक मानचित्र नहीं है।
निर्णय: "तोता" बनाम "मनोवैज्ञानिक"
शोधकर्ताओं ने निष्कर्ष निकाला कि GPT-4o के पास थ्योरी ऑफ माइंड नहीं है।
अंतर को देखने का सबसे अच्छा तरीका यहाँ दिया गया है:
- ToM वाला मानव एक शतरंज के उस्ताद (Chess Master) की तरह होता है। वे खेल के गहरे नियमों को समझते हैं। यदि आप बोर्ड का आकार बदल भी दें, तो भी वे खेल सकते हैं क्योंकि वे रणनीति के सिद्धांतों को समझते हैं। वे चालों की भविष्यवाणी कर सकते हैं और बता सकते हैं कि कोई चाल क्यों की गई।
- GPT-4o एक सुपर-तोते (Super-Parrot) की तरह है। इसने लोगों के चुनाव करने के बारे में लाखों कहानियाँ सुनी हैं। यह जानता है कि "लोग आमतौर पर बॉक्स की ओर तब चलते हैं जब उन्हें बॉक्स से नफरत होती है।" यह परिचित कहानी में इसकी सटीक नकल कर सकता है। लेकिन यह वास्तव में कारण-और-प्रभाव (cause-and-effect) के संबंध को नहीं समझता है। यह केवल पैटर्न मिलान (pattern matching) है।
यह क्यों मायने रखता है?
आप पूछ सकते हैं, "तो क्या हुआ? AI अभी भी अच्छे उत्तर दे रहा है, है ना?"
शोधकर्ता कहते हैं हाँ, लेकिन एक बड़ी चेतावनी के साथ।
यदि आप AI से ऐसी स्थिति के बारे में पूछते हैं जिसे उसने अपने प्रशिक्षण डेटा में लाखों बार देखा है, तो वह शानदार होगा। लेकिन यदि आप उसे अपनी "सामाजिक कौशल" को किसी बिल्कुल नई, अजीब या जटिल स्थिति (जैसे कि एक नई संस्कृति या एक अजीब सामाजिक दुविधा) में लागू करने के लिए कहते हैं, तो वह विफल हो सकता है क्योंकि उसके पास यह समझने का वास्तविक मॉडल नहीं है कि मन कैसे काम करते हैं। यह केवल सांख्यिकी के आधार पर अनुमान लगा रहा है।
मुख्य बात:
वर्तमान AI लोगों को समझने का अभिनय करने में अविश्वसनीय रूप से अच्छा है, लेकिन वास्तव में उसके पास यह समझने का मॉडल नहीं है कि लोग कैसे सोचते हैं। यह एक बहुत ही विश्वसनीय प्रदर्शन है, लेकिन "अभिनेता" को यह पता ही नहीं है कि स्क्रिप्ट का वास्तव में क्या अर्थ है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।