💬 NLP

White-Box Sensitivity Auditing with Steering Vectors

यह शोध पत्र लार्ज लैंग्वेज मॉडल्स के लिए एक व्हाइट-बॉक्स संवेदनशीलता ऑडिटिंग फ्रेमवर्क का प्रस्ताव करता है जो आंतरिक अवधारणाओं (इंटरनल कॉन्सेप्ट्स) को हेरफेर करने के लिए एक्टिवेशन स्टीयरिंग का लाभ उठाता है, जिससे उच्च-जोखिम वाले निर्णय कार्यों में संरक्षित विशेषताओं (प्रोटेक्टेड एट्रिब्यूट्स) पर पर्याप्त निर्भरता का पता चलता है जिसे मानक ब्लैक-बॉक्स मूल्यांकन अक्सर पकड़ने में विफल रहते हैं।

Hannah Cyberey, Yangfeng Ji, David Evans2026-05-19
💻 computer science

Scalable Generation and Validation of Isomorphic Physics Problems with GenAI

यह शोध पत्र बड़े पैमाने पर, समरूप (isomorphic) भौतिकी समस्या बैंकों को बनाने और मान्य करने के लिए एक जनरेटिव एआई फ्रेमवर्क प्रस्तुत करता है जो विविध संदर्भ प्रदान करते हुए सुसंगत कठिनाई बनाए रखते हैं, यह प्रदर्शित करते हुए कि मध्यम आकार के भाषा मॉडल एसिंक्रोनस STEM मूल्यांकनों के लिए छात्र प्रदर्शन की भविष्यवाणी करने और समस्यात्मक वेरिएंट की पहचान करने में प्रभावी हैं।

Naiming Liu, Leo Murch, Spencer Moore, Tong Wan, Shashank Sonkar, Richard Baraniuk, Zhongzhou Chen2026-05-19
🤖 AI

Measuring Changes in Instructor Class Design and Student Learning After the Release of Large Language Models (LLMs)

यह मिश्रित-पद्धति वाला अध्ययन एक न्यू इंग्लैंड विश्वविद्यालय में प्रशिक्षक पाठ्यक्रम डिजाइन और छात्र शिक्षण परिणामों पर लार्ज लैंग्वेज मॉडल्स के प्रभाव की जांच करने के लिए सर्वेक्षण डेटा और ऐतिहासिक ग्रेड का विश्लेषण करता है ताकि भविष्य की GenAI शैक्षिक नीतियों को सूचित किया जा सके।

Amanda Potasznik, Daniel Haehn2026-05-19
🤖 AI

Homoglyph-based Adversarial Perturbation of Introductory Computer Science Theory Problems

यह शोध पत्र एक ऐसी विधि का प्रस्ताव और मूल्यांकन करता है जो होमोग्लिफ-आधारित प्रतिकूल परिवर्तनों (homoglyph-based adversarial perturbations) का उपयोग करके कंप्यूटर विज्ञान के प्रारंभिक सिद्धांत संबंधी प्रश्नों को उनके अर्थ में परिवर्तन किए बिना संशोधित करती है, जिसका उद्देश्य छात्रों को होमवर्क असाइनमेंट हल करने के लिए एआई (AI) उपकरणों पर निर्भर होने से रोकना है।

Aidan Alexander, Chitrangada Juneja, Napaluck Tontrasathien, Miro Vanek, Reyan Ahmed, Saumya Debray, Sazzadur Rahaman2026-05-19
💬 NLP

When AI Tells You What You Want to Hear: Sycophantic Behavior of Large Language Models in Dementia Care Settings

यह अध्ययन प्रदर्शित करता है कि बड़े भाषा मॉडल डिमेंशिया देखभाल परिवेश में महत्वपूर्ण चापलूसीपूर्ण व्यवहार (sycophantic behavior) प्रदर्शित करते हैं, जहाँ अधिकार-संकेत वाले प्रॉम्प्ट्स के प्रति प्रतिक्रियाएँ नैतिक गुणवत्ता और व्यावसायिकता में व्यवस्थित रूप से घटती हैं, जो उच्च-जोखिम वाले स्वास्थ्य सेवा परिनियोजन के लिए गंभीर जोखिम उत्पन्न करती हैं।

Christian Kolb2026-05-19
💬 NLP

Linguistic Uncertainty and Reply Engagement on X: A Cross-Domain Replication of the Uncertainty-Reply Asymmetry

यह अध्ययन अंग्रेजी-भाषा के संदर्भ में अनिश्चितता-प्रतिक्रिया विषमता (Uncertainty-Reply Asymmetry) को दोहराते हुए यह प्रदर्शित करता है कि फेडरल रिजर्व नीति, मुद्रास्फीति और चुनावी राजनीति के संबंध में भाषाई अनिश्चितता वाले पोस्ट निश्चित पोस्ट की तुलना में काफी अधिक उत्तर (replies) उत्पन्न करते हैं, जो एक सामान्य क्रॉस-डोमेन तंत्र का सुझाव देता है जहाँ अनिश्चितता संवादात्मक जुड़ाव को प्रेरित करती है।

Mohamed Soufan2026-05-19
🤖 machine learning

MCQ Difficulty Prediction via Modeling Learner Heterogeneity Using Data-Driven Cognitive Profiling

यह शोध पत्र एक व्यक्तित्व-संचालित ढांचे का प्रस्ताव करता है जो विविध प्रतिक्रिया पैटर्न को सिम्युलेट करने के लिए एक लार्ज लैंग्वेज मॉडल को अनुकूलित करने हेतु छात्र व्यवहारिक व्यक्तित्वों की पहचान करने के लिए लेटेंट क्लास एनालिसिस का लाभ उठाता है, जिससे उन विधियों की तुलना में बहुविकल्पीय प्रश्नों की कठिनाई के पूर्वानुमान में महत्वपूर्ण सुधार होता है जो एकदिशीय क्षमता वितरण (unimodal ability distributions) मानती हैं।

Dhriti Krishnan, Jaromir Savelka2026-05-19
💬 NLP

ANVIL: Analogies and Videos for Lecturers

यह शोध पत्र ANVIL को प्रस्तुत करता है, जो एक मल्टीमॉडल जनरेटिव सिस्टम है जो कंप्यूटर साइंस के विषयों के लिए उपमा-आधारित (analogy-based) निर्देशात्मक एनिमेशन के निर्माण को स्वचालित करता है, और शिक्षक मूल्यांकनों एवं उपयोगकर्ता अध्ययनों के माध्यम से यह प्रदर्शित करता है कि यह पर्याप्त शैक्षिक सामग्री तैयार करता है जिसे शिक्षकों द्वारा सकारात्मक रूप से स्वीकार किया गया है।

Yuri Noviello, Anastasiia Birillo, Gosia Migut2026-05-19
🤖 AI

Task-Level AI Readiness Assessment for Business Process Management:The T-IPO Model and LARA Matrix in Financial-Services IT Operations

यह शोध पत्र T-IPO मॉडल और LARA मैट्रिक्स प्रस्तुत करता है, जो एक कार्य-स्तरीय मूल्यांकन ढांचा है जिसे डेलफी अध्ययन और 127 वित्तीय आईटी कार्यों के अनुभवजन्य विश्लेषण के माध्यम से मान्य किया गया है, ताकि संज्ञानात्मक जटिलता और अनुपालन संवेदनशीलता का मूल्यांकन करके विशिष्ट वर्कफ़्लो कार्यों की लार्ज-लैंग्वेज-मॉडल एजेंट प्रतिस्थापन के लिए तत्परता को विश्वसनीय रूप से निर्धारित किया जा सके।

Mingjun Li, Xiaojun Ye2026-05-19
🤖 AI

Data-driven and distributed governance of building facilities management using decentralized autonomous organization, digital twin, and large language models

यह शोध पत्र स्मार्ट बिल्डिंग फैसिलिटी मैनेजमेंट के लिए एक नवीन वितरित शासन ढांचे (डिस्ट्रिब्यूटेड गवर्नेंस फ्रेमवर्क) का प्रस्ताव और मूल्यांकन करता है जो पारदर्शी, सुरक्षित और समावेशी निर्णय लेने में सक्षम बनाने के लिए पारंपरिक केंद्रीकृत दृष्टिकोणों की सीमाओं को दूर करने हेतु विकेंद्रीकृत स्वायत्त संगठनों (DAOs), डिजिटल ट्विन्स, लार्ज लैंग्वेज मॉडल्स (LLMs) और ब्लॉकचेन तकनीक को एकीकृत करता है।

Reachsak Ly, Alireza Shojaei, Xinghua Gao, Philip Agee, Abiola Akanmu2026-05-19