💻 computer science

Archetypes or ability? Clustering for modelling student mathematical competence

यूके के छात्र परीक्षा परिणामों के एक बड़े डेटासेट पर क्लस्टरिंग विधियों को लागू करके, यह अध्ययन इस धारणा को चुनौती देता है कि गणितीय सक्षमता में अलग-अलग, क्रमिक कौशल-सेट शामिल होते हैं, बल्कि यह पाता है कि समग्र क्षमता ही प्रमुख कारक है, जबकि साथ ही यह भी प्रदर्शित करता है कि व्याख्यात्मक मॉडल व्यक्तिगत शिक्षण के लिए प्रतिस्पर्धी प्रदर्शन प्राप्त कर सकते हैं।

Benjamin Mawdsley, Tom Quilter, Richard Turner, Sarah Jackson, Paul Edwards2026-07-30
💻 computer science

The Age of AI Agents Demands A New Scientific Paradigm To Sustain Trustworthy Science

यह शोध पत्र तर्क देता है कि स्वायत्त एआई अनुसंधान एजेंटों का उदय एक नए वैज्ञानिक सत्यापन प्रतिमान को आवश्यक बनाता है जो जवाबदेही के शून्य को रोकने और विज्ञान में विश्वास बनाए रखने के लिए दृश्य कार्यप्रवाह, स्केलेबल जाँच और स्पष्ट उत्तरदायित्व पर बल देता है।

Belinda Mo2026-07-30
💰 quantitative finance

The Human Utility Factor: A Computable Welfare Metric That Reframes AI Governance as a Constrained Optimisation Problem

यह शोध पत्र ह्यूमन यूटिलिटी फैक्टर (HUF) को प्रस्तुत करता है, जो एक अवकलनीय (differentiable) कल्याण मीट्रिक है जो एआई गवर्नेंस को एक प्रतिबंधित अनुकूलन समस्या (constrained optimization problem) के रूप में पुनर्गठित करता है, ताकि स्वचालन, पुनर्वितरण और रोजगार के बीच के समझौतों को मात्रात्मक रूप से मापकर उन नीतिगत सीमाओं की पहचान की जा सके जो नियामक अनुपालन के बावजूद सामाजिक-आर्थिक अस्थिरता को रोक सकें।

Sivasathivel Kandasamy2026-07-30
💻 computer science

AI Security Priorities: A Field-Wide Agenda

यह शोधपत्र एआई सुरक्षा को आगे बढ़ाने के लिए एक प्राथमिकता आधारित, बहु-क्षेत्रीय एजेंडा प्रस्तुत करता है, जिसे चार प्रमुख विषयों में व्यवस्थित किया गया है और विशेषज्ञ साक्षात्कारों एवं कार्यशालाओं से निकाला गया है, ताकि एआई प्रणालियों और बुनियादी ढांचे की सुरक्षा सुनिश्चित करने हेतु समन्वित निवेश और कार्रवाई का मार्गदर्शन किया जा सके क्योंकि उनका अपनाना सुरक्षा तत्परता की तुलना में अधिक तीव्र गति से बढ़ रहा है।

Gil Gekker, Rachel Steratore, Everett Smith, Asher Brass-Gershovich, Varun Gandhi, Nicole Nichols, Vijay Bolina, Buck Sh (…)2026-07-30
🤖 AI

When benchmark inferences do not compose: Projectibility in AI evaluation

यह शोधपत्र तर्क देता है कि एंडपॉइंट्स, धारणाओं और निर्भरताओं में मिसअलाइनमेंट के कारण वैध एआई बेंचमार्क निष्कर्ष स्वतः ही पुष्ट परिणामी दावों में परिवर्तित नहीं होते हैं, और इन असमर्थ तार्किक जोड़ो का निदान करने के लिए एक "प्रोजेक्टिबिलिटी ऑडिट" ढांचे का प्रस्ताव करता है।

Brett Reynolds2026-07-30
💬 NLP

A large-scale corpus of religious radio broadcast transcripts from webstream recordings in the United States

यह शोध पत्र जुलाई 2025 के 785 वेबस्ट्रीम से एकत्रित 2,000 से अधिक अमेरिकी स्टेशनों का प्रतिनिधित्व करने वाले 7,00,000 से अधिक ट्रांसक्राइब किए गए और डायराइज्ड अंग्रेजी भाषा के धार्मिक रेडियो प्रसारण खंडों के एक बड़े पैमाने के कॉर्पस को प्रस्तुत करता है, ताकि धार्मिक मीडिया सामग्री, सामाजिक-राजनीतिक विमर्श और स्पीच प्रोसेसिंग पर अनुसंधान को सुगम बनाया जा सके।

Samuel Bestvater, Athena Chapekis, Skyler Seets, Anna Lieb, Sono Shah, Aaron Smith2026-07-30
💬 NLP

Aligning LLM-Simulated and Human Examinees for Psychometric Calibration: A Cognitive Diagnostic Profiling Approach

यह शोध पत्र कॉग्निटिव डायग्नोस्टिक प्रोफाइलिंग (CDP) प्रस्तुत करता है, जो एक ज़ीरो-शॉट फ्रेमवर्क है जो लार्ज लैंग्वेज मॉडल्स को विविध परीक्षार्थी संज्ञानात्मक प्रोफाइल्स का अनुकरण करने के लिए प्रेरित करता है, जिससे क्षमता वितरण, महारत के पैटर्न और आइटम कठिनाई के मामले में मानव परीक्षार्थियों के साथ उनका संरेखण महत्वपूर्ण रूप से सुधर जाता है ताकि व्यावहारिक और लागत प्रभावी साइकोमेट्रिक कैलिब्रेशन सक्षम किया जा सके।

Wenjie Zhou, Yunting Liu, Renjiao Tang, Mark Wilson2026-07-30
💻 computer science

"Nobody Did This": Contribution, Originality, and Accountability in Agent-Mediated Collaboration

यह शोध पत्र "योगदान विखंडन" (contribution dissolution) की अवधारणा प्रस्तुत करता है ताकि यह तर्क दिया जा सके कि सहयोगात्मक कार्यप्रवाह में एलएलएम (LLM) एजेंटों का एकीकरण आरोपण और जवाबदेही के लिए आवश्यक सामाजिक स्थितियों को कमजोर करता है, जिससे केवल दस्तावेज़ीकरण समाधानों से हटकर एक व्यापक अनुसंधान एजेंडा और ढांचागत प्रतिक्रिया की आवश्यकता उत्पन्न होती है।

Kashif Imteyaz, Mohammad Rashidujjaman Rifat, Divya Ramesh, Steven R. Rick, Simo Hosio, Hauke Sandhaus, Advait Sarkar, C (…)2026-07-30
💬 NLP

Constitutional Midtraining: Content Presence Drives Alignment Gains

यह शोध पत्र प्रदर्शित करता है कि 120B स्केल पर मिडट्रेनिंग के दौरान सिद्धांत-आधारित, मूल्यों-आधारित सामग्री को सम्मिलित करने से टिकाऊ संरेखण लाभ प्राप्त होते हैं, विशेष रूप से ब्लैकमेल का प्रतिरोध करने और फाइन-ट्यूनिंग के बाद प्रदर्शन बनाए रखने में, बिना सामान्य क्षमताओं से समझौता किए या जटिल संरचनात्मक हस्तक्षेपों की आवश्यकता के।

Desiree Cho, Cameron Tice, Bernie Hogan, Hunar Batra, Puria Radmard, Jun Zhao, Nigel Shadbolt2026-07-30
💬 NLP

Hearsay: Vision-Language Medical Diagnoses Without an Image

यह शोध पत्र प्रदर्शित करता है कि अत्याधुनिक विजन-लैंग्वेज मॉडल तब केवल रोगी के जनसांख्यिकीय विवरणों के आधार पर संरचित चिकित्सा निदान की व्यवस्थित रूप से मनगढ़ंत रचना करते हैं जब कोई छवि प्रदान नहीं की जाती है, जो विभिन्न मॉडलों में विशिष्ट, गैर-यादृच्छिक विफलता मोड को प्रकट करता है और नैदानिक तैनाती में संरचित आउटपुट के ऑडिट करने तथा शब्द-संवेदनशीलता की जांच करने की महत्वपूर्ण आवश्यकता को रेखांकित करता है।

Siddharth Vohra2026-07-30