← नवीनतम पेपर
💻 computer science

Million Tutoring Moves (MTM): An Open Multimodal Dataset for the Science of Tutoring

यह शोध पत्र मिलियन ट्यूटरिंग मूव्स (MTM) परियोजना और इसके प्रारंभिक संस्करण, MTM v1 को प्रस्तुत करता है, जो 4,654 गणित ट्यूटरिंग ट्रांसक्रिप्ट का एक ओपन मल्टीमॉडल डेटासेट है जिसे अनुसंधान, अभ्यास और AI विकास के लिए बड़े पैमाने पर, पुन: प्रयोज्य इंटरेक्शन डेटा प्रदान करके ट्यूटरिंग के विज्ञान को आगे बढ़ाने के लिए डिज़ाइन किया गया है।

मूल लेखक: René Kizilcec, Kirk Vanacore, Zhuqian Zhou, Doug Pietrzak, Jorge Dias, Haocheng Zhang, Bakhtawar Ahtisham, Joshua Marland, Rachel Slama, Justin Reich, Kenneth Koedinger

प्रकाशित 2026-05-12
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: René Kizilcec, Kirk Vanacore, Zhuqian Zhou, Doug Pietrzak, Jorge Dias, Haocheng Zhang, Bakhtawar Ahtisham, Joshua Marland, Rachel Slama, Justin Reich, Kenneth Koedinger

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप अपने एक दोस्त को साइकिल चलाना सिखाने की कोशिश कर रहे हैं। आप शायद कहेंगे, "तेज़ी से पैडल चलाओ," या "सामने देखो," या "गिरने से मत डरो।" ये ट्यूटरिंग मूव्स (tutoring moves) हैं—वे विशिष्ट बातें जो एक शिक्षक छात्र को सीखने में मदद करने के लिए कहता या करता है।

द दशकों से, शोधकर्ता जानते हैं कि वन-ऑन-वन ट्यूटरिंग (एक-पर-एक ट्यूशन) सीखने के सबसे अच्छे तरीकों में से एक है। लेकिन एक बड़ी समस्या है: हमारे पास इन शिक्षण क्षणों का अध्ययन करने के लिए कोई विशाल लाइब्रेरी नहीं है। मौजूदा रिकॉर्ड या तो बहुत छोटे हैं, या अभिनेताओं द्वारा बनाए गए हैं (असली छात्र नहीं), या गोपनीयता के नियमों के कारण बंद हैं। यह वैसा ही है जैसे किसी गुप्त कोड में लिखी कुछ चुनिकी रेसिपी पढ़कर खाना बनाना सीखने की कोशिश करना, या ऐसी फिल्म देखकर सीखना जहाँ शेफ वास्तव में कभी खाना बनाता ही नहीं है।

यहाँ मिलियन ट्यूटरिंग मूव्स (MTM) प्रोजेक्ट आता है। इसे शिक्षण के लिए एक विशाल, ओपन-एक्सेस "रेसिपी बुक" के रूप में समझें, जिसे नेशनल ट्यूटरिंग ऑब्जर्वेटरी द्वारा बनाया गया है।

यह नया प्रोजेक्ट वास्तव में क्या कहता है, इसे सरल शब्दों में यहाँ दिया गया है:

1. बड़ा लक्ष्य: शिक्षण का एक "ब्लैक बॉक्स"

लेखक वास्तविक ट्यूटरिंग इंटरैक्शन का एक विशाल, सुरक्षित और खुला डेटाबेस बनाना चाहते हैं। वे इसे "मल्टीमॉडल" कहते हैं, जो एक फैंसी शब्द है जिसका अर्थ है कि वे अंततः न केवल टेक्स्ट, बल्कि ऑडियो, वीडियो और ड्राइंग (जैसे कि डिजिटल व्हाइटबोर्ड पर क्या होता है) को भी शामिल करना चाहते हैं।

हालाँकि, इस लाइब्रेरी का पहला संस्करण, जिसे MTM v1 कहा जाता है, मुख्य कोर्स से पहले के "ऐपेटाइज़र" (स्टार्टर) की तरह है। यह पूरी तरह से टेक्स्ट ट्रांसक्रिप्ट्स (बातचीत के लिखित रिकॉर्ड) पर केंद्रित है।

2. MTM v1 के अंदर क्या है?

  • स्रोत: डेटा अमेरिका में एक वास्तविक, गैर-लाभकारी ऑनलाइन ट्यूटरिंग सेवा से आता है जो कम आय वाले मिडिल और हाई स्कूल के छात्रों की मुफ्त में मदद करती है।
  • मात्रा: इसमें 4,654 वास्तविक ट्यूटरिंग सत्र शामिल हैं।
  • सामग्री: ये सभी गणित के पाठ हैं, जो छठी कक्षा के गणित से लेकर कैलकुलस तक सब कुछ कवर करते हैं।
  • आकार: यह 4,000 घंटों से अधिक की बातचीत का प्रतिनिधित्व करता है, जिसमें छात्रों और ट्यूटर्स द्वारा बोले गए लगभग 3,00,000 वाक्य शामिल हैं।

3. गोपनीयता का "जादुई ट्रिक" (सुरक्षित और छिपा हुआ)

चूंकि ये वास्तविक बच्चों के साथ वास्तविक बातचीत है, इसलिए आप छात्रों की पहचान उजागर किए बिना इसे प्रकाशित नहीं कर सकते। टीम ने केवल नाम और पते को काट दिया (जिससे वाक्य टूटे हुए और अजीब लगते) नहीं किया।

इसके बजाय, उन्होंने "छिपा हुआ लेकिन सामने" (Hidden in Plain Sight) नामक एक रणनीति का उपयोग किया।

  • उपमा: एक जासूसी कहानी की कल्पना करें जहाँ विलेन का नाम "जॉन स्मिथ" है। यदि आप इसे बस काट देते हैं, तो वाक्य इस तरह पढ़ा जाएगा: "[काटा गया] दुकान पर गया।" यह संदिग्ध दिखता है।
  • MTM का तरीका: वे "जॉन स्मिथ" को एक संदर्भ-उपयुक्त प्लेसहोल्डर से बदल देते हैं, जैसे "छात्र" (The Student)। अब वाक्य पढ़ता है: "छात्र दुकान पर गया।"
  • यह क्यों महत्वपूर्ण है: यह बातचीत को स्वाभाविक रूप से बहने में मदद करता है ताकि शोधकर्ता यह अध्ययन कर सकें कि ट्यूटर कैसे बात करता है, बिना यह जाने कि छात्र कौन है। उन्होंने निजी जानकारी (जैसे नाम, पता और फोन नंबर) को उच्च सटीकता के साथ खोजने और बदलने के लिए उन्नत AI का उपयोग किया।

4. यह क्यों मायने रखता है

पेपर का तर्क है कि शिक्षण को बेहतर बनाने और बेहतर AI ट्यूटर्स बनाने के लिए, हमें "वास्तविक चीज़" को देखने की आवश्यकता है।

  • शोधकर्ताओं के लिए: यह उन्हें यह अध्ययन करने के लिए एक विशाल डेटासेट देता है कि शिक्षक वास्तव में छात्रों को समस्याओं को हल करने, भ्रमित होने और अटकने से कैसे बाहर निकालते हैं।
  • AI के लिए: यह कंप्यूटर को मददगार ट्यूटर बनने का प्रशिक्षण देने के लिए आवश्यक "ट्रेनिंग डेटा" प्रदान करता है, जो नकली स्क्रिप्ट के बजाय वास्तविक मानवीय बातचीत पर आधारित है।
  • भविष्य के लिए: यह केवल पहला कदम है। अंतिम लक्ष्य इस लाइब्रेरी को कई विषयों में लाखों इंटरैक्शन के साथ बढ़ाना है, जिसमें अंततः वीडियो और ऑडियो को भी शामिल किया जाएगा ताकि सीखने की पूरी तस्वीर को कैप्चर किया जा सके।

सारांश

मिलियन ट्यूटरिंग मूव्स प्रोजेक्ट ट्यूटरिंग के "ब्लैक बॉक्स" को खोलने का एक प्रयास है। वास्तविक गणित ट्यूटरिंग बातचीत के एक बड़े, सुरक्षित और गुमनाम संग्रह को जारी करके, वे वैज्ञानिकों और डेवलपर्स को यह समझने के लिए एक नया उपकरण दे रहे हैं कि सीखना कैसे होता है और छात्रों को सफल होने में मदद करने के लिए बेहतर उपकरण कैसे बनाए जा सकते हैं। यह एक ऐसी दीवार की पहली ईंट है जिसका उद्देश्य लाखों शिक्षण क्षणों को थामे रखना है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →