🤖 AI

Human-in-the-Loop Benchmarking of Heterogeneous LLMs for Automated Competency Assessment in Secondary Level Mathematics

यह शोध पत्र नेपाल में स्वचालित माध्यमिक-स्तर के गणित मूल्यांकन के लिए विषम (heterogeneous) एलएलएम (LLMs) का मूल्यांकन करने हेतु एक बहु-आयामी रूब्रिक का उपयोग करते हुए एक ह्युमन-इन-द-लूप बेंचमार्किंग फ्रेमवर्क प्रस्तुत करता है, जो यह प्रकट करता है कि मानव विशेषज्ञों के साथ सहमति प्राप्त करने के लिए मॉडल का पैमाना (scale) तुलना में निर्देश बाधाओं (instruction constraints) के साथ स्थापत्य अनुकूलता (architectural compatibility) अधिक महत्वपूर्ण है और यह निष्कर्ष निकालता है कि ये मॉडल स्वायत्त प्रमाणन के बजाय सहायक साक्ष्य निष्कर्षण (assistive evidence extraction) के लिए सबसे उपयुक्त हैं।

Jatin Bhusal, Nancy Mahatha, Aayush Acharya, Raunak Regmi2026-04-30
🤖 AI

Resume-ing Control: (Mis)Perceptions of Agency Around GenAI Use in Recruiting Workflows

22 भर्ती पेशेवरों के साक्षात्कार के आधार पर, यह शोध पत्र प्रकट करता है कि जहाँ भर्तीकर्ता यह मानते हैं कि अंतिम अधिकार उनके पास है, वहीं जेनरेटिव एआई एक अदृश्य वास्तुकार बन गया है जो भर्ती कार्यप्रवाह और निर्णयों को आकार दे रहा है, जो अक्सर विकल्प के बजाय बाहरी दबावों से प्रेरित होता है, जिसके परिणामस्वरूप भर्तीकर्ताओं के कौशल ह्रास और समझौतापूर्ण निगरानी की उच्च लागत पर मामूली दक्षता लाभ प्राप्त होते हैं।

Sajel Surati, Rosanna Bellini, Emily Black2026-04-30
🤖 AI

Justice in Judgment: Unveiling (Hidden) Bias in LLM-assisted Peer Reviews

यह शोध पत्र एलएलएम-सहायता प्राप्त सहकर्मी समीक्षाओं (पीयर रिव्यूज) में पूर्वाग्रह की जांच करता है, यह प्रकट करते हुए कि मॉडल प्रतिष्ठित लेखकों के पक्ष में महत्वपूर्ण संबद्धता, वरिष्ठता और प्रकाशन इतिहास संबंधी पूर्वाग्रह प्रदर्शित करते हैं, और ये अंतर्निहित प्राथमिकताएं संभावित संरेखण मास्किंग (अलाइनमेंट मास्किंग) के बावजूद टोकन स्तर पर विश्लेषण किए जाने पर और भी अधिक स्पष्ट हो जाती हैं।

Sai Suresh Macharla Vasu, Ivaxi Sheth, Hui-Po Wang, Ruta Binkyte, Mario Fritz2026-04-29
💻 computer science

Responsible Evaluation of AI for Mental Health

यह शोध पत्र एक अंतर्विषयक ढांचे और एक तीन-स्तरीय वर्गीकरण (आकलन, हस्तक्षेप और सूचना संश्लेषण) का प्रस्ताव करके मानसिक स्वास्थ्य में एआई के वर्तमान खंडित और नैदानिक रूप से असंगत मूल्यांकन की आलोचना करता है ताकि यह सुनिश्चित किया जा सके कि भविष्य के आकलन नैदानिक वैधता, सामाजिक संदर्भ, समानता और उपयोगकर्ता अनुभव को प्राथमिकता दें।

Hiba Arnaout, Anmol Goel, H. Andrew Schwartz, Steffen T. Eberhardt, Dana Atzil-Slonim, Gavin Doherty, Brian Schwartz, Wo (…)2026-04-29
💻 computer science

Cyclic Adaptive Private Synthesis for Sharing Real-World Data in Education

यह शोध पत्र उच्च-आयामी, लघु-नमूना शैक्षिक डेटा के लिए गोपनीयता-संरक्षित साझाकरण की चुनौतियों को संबोधित करने हेतु साइक्लिक एडेप्टिव प्राइवेट सिंथेसिस (CAPS) फ्रेमवर्क का प्रस्ताव करता है, जो पुनरावृत्ति रूप से डिफरेंशियल प्राइवेट सिंथेटिक डेटा उत्पन्न करके ओपन साइंस और डिज़ाइन-आधारित अनुसंधान को सक्षम बनाता है और पारंपरिक वन-शॉट सिंथेसिस दृष्टिकोणों से बेहतर प्रदर्शन करता है।

Hibiki Ito, Chia-Yu Hsu, Hiroaki Ogata2026-04-29
💻 computer science

Risk Reporting for Developers' Internal AI Model Use

यह शोध पत्र फ्रंटियर एआई कंपनियों के लिए आंतरिक उपयोग जोखिम रिपोर्ट तैयार करने हेतु एक सामंजस्यपूर्ण मानक का प्रस्ताव करता है, जो साधन, उद्देश्य और अवसर के माध्यम से स्वायत्त दुर्व्यवहार और इनसाइडर खतरों के दृष्टिकोण से जोखिमों का मूल्यांकन करके कैलिफोर्निया, न्यूयॉर्क और यूरोपीय संघ की नियामक आवश्यकताओं को संबोधित करता है।

Oscar Delaney, Sambhav Maheshwari, Joe O'Brien, Theo Bearman, Oliver Guest2026-04-29
💻 computer science

Coasting Through Class: Learning Opportunity Loss from Practice Avoidance During Individual Seatwork

यह अध्ययन ASSISTments डेटा का विश्लेषण करता है जिससे यह पता चलता है कि छात्र देरी से शुरू करने, निष्क्रिय रहने और जल्दी रुक जाने के कारण उपलब्ध गणित अभ्यास समय के 60% भाग में "कोस्ट" (बिना प्रयास के समय बिताते) करते हैं, जो एक सुसंगत व्यवहारिक पैटर्न है जो सीखने के अवसरों को महत्वपूर्ण रूप से कम करता है और मानकीकृत परीक्षण प्रदर्शन पर नकारात्मक प्रभाव डालता है।

Ashish Gurung, Jordan Gutterman, Danielle R. Thomas, Mingyu Feng, Vincent Aleven, Kenneth R. Koedinger2026-04-29
💻 computer science

Barriers and Enablers of Online Instruction in Hospitality Education in the Philippines: An Exploratory Study

फिलीपीन आतिथ्य (हॉस्पिटैलिटी) शिक्षकों के इस अन्वेषणात्मक अध्ययन ने ऑनलाइन निर्देश को प्रभावित करने वाले प्रमुख कारकों के रूप में शैक्षणिक चुनौतियों, तकनीकी बाधाओं और संस्थागत सहायता की पहचान की है, जबकि शैक्षिक परिणामों को बेहतर बनाने के लिए उन्नत प्रशिक्षण और जिम्मेदार एआई (AI) एकीकरण की आवश्यकता पर भी प्रकाश डाला है।

Maria Anna D. Cruz, Jeaneth D. Serna, Lloyd D. Feliciano, Mike Haizon M. David, Ma. Ferna Bel L. Punsalan, Glen Brian L. (…)2026-04-29
💻 computer science

Adoption of TikTok as a Learning Tool in Physical Education: Evidence from the Philippines

1,075 फिलिपिनो उच्च शिक्षा के छात्रों का यह अध्ययन दर्शाता है कि टेक्नोलॉजी एक्सेप्टेंस मॉडल और यूज़ेस एंड ग्रेटिफिकेशन थ्योरी को एकीकृत करने वाले विश्लेषण के आधार पर, कथित उपयोगिता (Perceived Usefulness) और कथित सुगमता (Perceived Ease of Use), शारीरिक शिक्षा के लिए एक आकर्षक और सुलभ शिक्षण उपकरण के रूप में टिकटॉक को अपनाने के उनके इरादे के सबसे मजबूत भविष्यवक्ता हैं।

Vanessa B. Sibug, Jan Henry B. Sunga, Emerson Q. Fernando, Roe Vincent S. Ovejas, Arjan Gil S. Mendoza, Trisha Anne A. O (…)2026-04-29
💻 computer science

Towards the Development of Detection of Learned Helplessness in Mathematics: Design and Data Collection Challenges from a Developing Country Perspective

यह शोध पत्र एक संसाधन-सीमित विकासशील देश में गणित के भीतर सीखी गई लाचारी (learned helplessness) का पता लगाने के लिए एक वेब-आधारित ट्यूटरिंग सिस्टम विकसित करते समय सामना की गई डिज़ाइन और डेटा संग्रह की चुनौतियों का दस्तावेजीकरण करता है, जो यह रेखांकित करता है कि कैसे ढांचागत सीमाओं और लॉजिस्टिक व्यवधानों ने छात्रों से डेटा प्राप्ति को महत्वपूर्ण रूप से प्रभावित किया।

John Paul P. Miranda, Rex P. Bringula, Laharni S. Simpao, Jordan L. Salenga, Juvy C. Grume, Madilaine Claire B. Naciance (…)2026-04-29