💻 computer science

Classroom Behavior Monitoring with YOLO An Empirical Study in Higher Education Settings

यह अध्ययन BAV-Classroom डेटासेट प्रस्तुत करता है और प्रदर्शित करता है कि YOLOv11 मॉडल उच्च शिक्षा में कक्षा के व्यवहार की निगरानी को प्रभावी ढंग से स्वचालित करता है, जिससे व्याख्यानों के अंतिम हिस्सों के दौरान छात्रों की एकाग्रता में महत्वपूर्ण गिरावट का पता चलता है।

Sinh Vu Trong, Dung Nguyen Manh, Hieu Hoang Minh, Hieu Pham Trung, Thu Pham Ha, Nhu Le Hoang2026-07-07
💻 computer science

Doom Researching: A Conceptual Framework for Repetitive AI-Assisted Information Seeking, Cognitive Offloading, and the Illusion of Knowing

यह वैचारिक शोधपत्र "डूम रिसर्चिंग" (doom researching) को एक ऐसे ढांचे के रूप में प्रस्तुत करता है जो यह वर्णन करता है कि कैसे जनरेटिव एआई के साथ प्रवाहपूर्ण अंतःक्रियाएं ऐसी पुनरावृत्ति वाली सूचना खोज को बढ़ावा दे सकती हैं जो कथित ज्ञान को बढ़ाती है और वास्तविक संश्लेषण, क्रियान्वयन एवं स्थायी समझ के विकल्प के रूप में कार्य करती है।

Santosh Premi Adhikari2026-07-07
🤖 AI

The Foreign Policy AI Evaluation Gap

यह शोध पत्र तर्क देता है कि विदेश नीति कूटनीति में निहित अद्वितीय संरचनात्मक जटिलताओं और विनाशकारी जोखिमों के लिए एक मांग-पक्ष मूल्यांकन ढांचे को विकसित करने हेतु एक तत्काल, साहित्य-आधारित अनुसंधान एजेंडा आवश्यक है जो उच्च-परिणाम वाले वर्कफ़्लो को मूल्यांकनीय उप-कार्यों में विभाजित कर सके, जिससे इस क्षेत्र के लिए तकनीकी एआई (AI) शासन में वर्तमान महत्वपूर्ण अंतराल को संबोधित किया जा सके।

Charles Pozniak, Jeba Sania2026-07-07
💻 computer science

CAFÉ, an automated feedback tool to approach Formal Methods

यह शोध पत्र CAFÉ प्रस्तुत करता है, जो एक स्वचालित फीडबैक प्लेटफॉर्म है जो कंप्यूटर साइंस के छात्रों को कोडिंग करने से पहले ग्राफ़िकल लूप इनवैरिएंट्स (Graphical Loop Invariants) डिज़ाइन करने के लिए निर्देशित करके उन्हें औपचारिक विधियों (formal methods) की ओर संक्रमण में सहायता प्रदान करता है, जिससे उनके आरेखीय तर्क (diagrammatic reasoning) और अंतिम कार्यान्वयन (final implementation) दोनों पर व्यक्तिगत फीडबैक मिलता है।

Géraldine Brieven, Ayman Labrahimi Kasdaoui, Benoit Donnet2026-07-07
💬 NLP

Silicon Sampling via Cross-Survey Transfer

यह शोध पत्र सिलिकॉन सैंपलिंग (silicon sampling) के लिए एक कठोर मूल्यांकन ढांचे के रूप में "क्रॉस-सर्वे ट्रांसफर" (cross-survey transfer) को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि बड़े भाषा मॉडल (large language models) अनदेखी मदों (unseen items) पर 52% सटीकता के साथ व्यक्तिगत सर्वेक्षण प्रतिक्रियाओं की भविष्यवाणी कर सकते हैं—जो लगभग सुपरवाइज्ड बेसलाइन्स (supervised baselines) के बराबर है—जबकि निर्माण पूर्वानुमेयता (construct predictability) के एक स्थिर पदानुक्रम और वेरिएंस कोलैप्स (variance collapse) एवं सुरक्षा संरेखण (safety alignment) के संबंध में सूक्ष्म सीमाओं को भी उजागर करता है।

Chan-Tung Ku, Chan Hsu, Pei-Cing Huang, Frank Cheng-shan Liu, I-Ling Cheng, Yihuang Kang2026-07-07
💻 computer science

Macro-Prudential AI Governance: A Two-Layer Early Warning and Response System for Frontier AI

यह शोध पत्र आंतरिक सीमावर्ती (फ्रंटियर) एआई प्रणालियों के लिए एक मैक्रो-प्रूडेंशियल "MEWRS" ढांचे का प्रस्ताव करता है जो क्षेत्र-व्यापी सहसंबद्ध जोखिमों का पता लगाने के लिए 2008 के बाद के वित्तीय स्थिरता सुधारों को अनुकूलित करता है, जिसमें एक सरकारी क्लियरिंगहाउस के माध्यम से 'इफेक्टिव कंप्यूट-एट-रिस्क' और 'एलाइनमेंट रोबस्टनेस स्कोर' जैसे मात्रात्मक बफर मेट्रिक्स के माध्यम से स्वचालित रूप से कड़े सुरक्षा उपायों को ट्रिगर किया जाता है।

Pranav Mehta2026-07-07
🤖 AI

Responsibility Distribution Estimation in Ego-View Accident Videos with Multimodal Large Language Models

यह शोध पत्र ईगो-व्यू (ego-view) ट्रैफ़िक दुर्घटना वीडियो में उत्तरदायता वितरण अनुमान (responsibility distribution estimation) के नवीन कार्य को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि फाइन-ट्यून्ड मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स ड्राइवर के प्रत्यक्ष दृश्य परिप्रेक्ष्य का लाभ उठाकर एजेंट की उत्तरदायता प्रतिशत को प्रभावी ढंग से अनुमानित कर सकते हैं।

Ryosei Tamura, Andrew Shin2026-07-07
💻 computer science

Dean of LLM Tutors: A Framework for Automated Quality Review of AI-generated Feedback

यह शोध पत्र DeanLLM का परिचय देता है, जो एक स्वचालित समीक्षा ढांचा है जिसमें 16-आयामी मूल्यांकन प्रणाली है जो छात्रों तक पहुँचने से पहले एआई-जनित शैक्षिक फीडबैक की शैक्षणिक गुणवत्ता, तथ्यात्मकता और सुरक्षा को विश्वसनीय रूप से आंकने और सुधारने के लिए सुपरवाइज्ड फाइन-ट्यून्ड एलएलएम (LLMs) का लाभ उठाता है।

Keyang Qian, Yixin Cheng, Rui Guan, Wei Dai, Flora Jin, Kaixun Yang, Sadia Nawaz, Zachari Swiecki, Guanliang Chen, Lixia (…)2026-07-03
💻 computer science

SCALEFeedback: A Large-Scale Dataset of Synthetic Computer Science Assignments for LLM-generated Educational Feedback Research

यह शोध पत्र SCALEFeedback को प्रस्तुत करता है, जो स्केलेबल, प्रभावी और जिम्मेदार LLM-आधारित शैक्षिक फीडबैक पर अनुसंधान को आगे बढ़ाने के लिए सोफिस्टिकेटेड असाइनमेंट मिमिक्री (SAM) फ्रेमवर्क के माध्यम से जनरेट किए गए 10,000 सिंथेटिक कंप्यूटर साइंस असाइनमेंट और छात्र सबमिशन का एक बड़े पैमाने का ओपन-सोर्स डेटासेट है।

Keyang Qian, Kaixun Yang, Wei Dai, Flora Jin, Yixin Cheng, Rui Guan, Sadia Nawaz, Zachari Swiecki, Guanliang Chen, Lixia (…)2026-07-03
💬 NLP

Office Comprehension Benchmark

यह शोध पत्र ऑफिस कॉम्प्रिहेंशन बेंच (OCB) को प्रस्तुत करता है, जो वर्ड, एक्सेल और पावरपॉइंट बोध के मूल्यांकन के लिए डिज़ाइन किया गया पहला सार्वजनिक बेंचमार्क है, जो दो ट्रैक्स—फाइल फिडेलिटी Q&A और डोमेन Q&A—के माध्यम से यह प्रकट करता है कि शीर्ष स्तर के मॉडल भी जटिल दस्तावेज़ तर्क करने में संघर्ष करते हैं, और डोमेन कार्यों पर केवल 59.3% सटीकता प्राप्त करते हैं।

Firoz Shaik, Mateus Picanço Lima Gomes, Tanvir Aumi, Jingci Wang, Milos Milunovic, Filip Basara, Ivana Jovanovic, Vishwa (…)2026-07-03