💬 NLP

Safety That Does Not Transfer: Cross-Lingual Clinical Correctness Drift in Deployable Medical Language Models

यह अध्ययन प्रकट करता है कि जहाँ फ्रंटियर लार्ज लैंग्वेज मॉडल्स अंग्रेजी और हौसा दोनों में नैदानिक सुरक्षा बनाए रखते हैं, वहीं स्थानीय स्तर पर तैनात होने वाले स्मॉल मॉडल्स हौसा में गंभीर सुरक्षा विचलन (सेफ्टी ड्रिफ्ट) प्रदर्शित करते हैं, जो अंग्रेजी में पर्याप्त प्रदर्शन करने के बावजूद नैदानिक रूप से सही प्रतिक्रियाओं से सक्रिय रूप से हानिकारक प्रतिक्रियाओं तक गिर जाता है, जो यह संकेत देता है कि सुरक्षा की यह कमी भाषा या नैदानिक सामग्री के बजाय मॉडल क्लास से उत्पन्न होती है।

Anthonio Oladimeji Gabriel, Dimeji Olawuyi, Toba Ajayi, Temilola Aderemi2026-07-21
💻 computer science

Auditing Differential Visibility of Political Content on TikTok

यह अध्ययन यह प्रदर्शित करके टिकटॉक द्वारा राजनीतिक सामग्री को शैडो-बैन करने के आरोपों का खंडन करता है कि स्पष्ट पहुंच विसंगतियां छद्म-पुनरावृत्ति (pseudoreplication) और भ्रमित करने वाले चरों के सांख्यिकीय आर्टिफैक्ट्स हैं, और उपयुक्त अकाउंट स्तर पर डेटा का विश्लेषण करने पर व्यवस्थित दमन का कोई प्रमाण नहीं पाता है।

Hazem Ibrahim, Tewoflos Girmay2026-07-21
🤖 AI

The Autonomous Agency Scale: A Behavioral Framework for Measuring Self-Directed Behavior in AI Systems

यह शोध पत्र ऑटोनॉमस एजेंसी स्केल (AAS) को प्रस्तुत करता है, जो सात आयामों और दो समयांतरालों में एआई (AI) की स्व-निर्देशन क्षमता को परिमाणित करने वाला एक व्यवहारिक ढांचा है, जो यह प्रकट करता है कि जहाँ वर्तमान कार्य एजेंट निष्क्रिय अवधियों के दौरान वास्तविक स्वायत्तता का अभाव रखते हैं, वहीं निरंतर साथी आर्किटेक्चर (persistent companion architectures) मापने योग्य स्व-निर्देशित व्यवहार प्रदर्शित करते हैं।

Samuel Presgraves2026-07-21✓ Author reviewed
🤖 AI

A Scaffolded GenAI Lab in Early Undergraduate CS: A Mixed-Methods, Multi-Course Evaluation

यह मिश्रित-पद्धति वाला अध्ययन प्रदर्शित करता है कि कई स्नातक पाठ्यक्रमों में एक संक्षिप्त, स्कैफोल्डेड "AI-Lab" हस्तक्षेप ने वैचारिक और डिबगिंग कार्यों के लिए जनरेटिव AI का उपयोग करने के प्रति छात्रों के आराम और खुलेपन को सफलतापूर्वक बढ़ाया, जबकि ग्रेड वाले असाइनमेंटों पर समग्र स्व-रिपोर्ट किए गए उपयोग को बढ़ाए बिना अधिक आलोचनात्मक, पुनरावृत्ति संबंधी जुड़ाव रणनीतियों को बढ़ावा दिया।

Ethan Dickey, Andres Bejarano, Rhianna Kuperus, Bárbara Fagundes2026-07-20
💻 computer science

Complete Trip: A Linked Multimodal Human Mobility Dataset

यह शोध पत्र "कम्प्लीट ट्रिप" (Complete Trip) का परिचय देता है, जो 2020 में यूटा के छह काउंटियों में स्मार्टफोन लोकेशन डेटा से जुड़े मल्टीमॉडल मानव गतिशीलता यात्राओं को पुनर्गठित करने वाला एक नवीन डेटासेट है, जो परिवहन, सार्वजनिक स्वास्थ्य और शहरी विज्ञान में पुनरुत्पादक अनुसंधान का समर्थन करने के लिए नेटवर्क-आधारित रूट प्रतिनिधित्व और जनसंख्या-स्तरीय अनुमान भार प्रदान करता है।

Ruohan Li, Weiyu Luo, Xin Wu, Chenfeng Xiong2026-07-20
💻 computer science

Making Agent-Mediated Contributions Governable: A Project-Level Governance Manifest for Open-Source AI Collaboration

यह शोध पत्र 'एजेंट गवर्नेंस मेनिफेस्ट' (AGM) को पेश करते हुए ओपन-सोर्स सॉफ़्टवेयर में एआई-जनित योगदानों से उत्पन्न होने वाली शासन संबंधी चुनौतियों को संबोधित करता है, जो एक रिपॉजिटरी-होस्टेड फ्रेमवर्क है जो योगदानकर्ता-पक्ष की साक्ष्य तैयारी और रखरखावकर्ता-पक्ष के सत्यापन के बीच एक संरचित अनुबंध के माध्यम से रखरखावकर्ता के अधिकार को सुरक्षित रखते हुए जोखिम मूल्यांकन सटीकता और समीक्षा सहायता में महत्वपूर्ण सुधार करता है।

Jinjin Gao, Luyang Li, Shufen Guo, Ligang He, Xiaoning Sun2026-07-20
💬 NLP

Empirical evidence of Large Language Model's influence on human spoken communication

यह अध्ययन प्रमाणिक साक्ष्य प्रदान करता है कि चैटजीपीटी (ChatGPT) के विमोचन ने स्वाभाविक भाषण में विशिष्ट शब्दों की आवृत्ति बढ़ाकर मानव मौखिक संचार को कार्यवत रूप से प्रभावित किया है, जो यह दर्शाता है कि मनुष्य बड़े भाषा मॉडलों (large language models) के शाब्दिक पैटर्न को आत्मसात और अपना रहे हैं, जिससे वे सांस्कृतिक विकास की निरंतर प्रक्रिया में एआई (AI) को एकीकृत कर रहे हैं।

Hiromu Yakura, Ezequiel Lopez-Lopez, Levin Brinkmann, Ignacio de la Serna, Lara Kirfel, Prateek Gupta, Ivan Soraperra, T (…)2026-07-17
💬 NLP

Measuring How Students Rely on Generative AI in Academic Writing: Development and Multi-Source Validation of the Generative AI Reliance Types Scale (GenAI-RTS)

यह अध्ययन 20-आइटम वाले जेनेरेटिव एआई रिलायंस टाइप्स स्केल (GenAI-RTS) के विकास और बहु-स्रोत सत्यापन को प्रस्तुत करता है, जो एक मनोवैज्ञानिक रूप से सुदृढ़ उपकरण है जो स्नातक छात्रों के बीच चार विशिष्ट निर्भरता प्रोफाइल की पहचान करता है और विविध छात्र जनसांख्यिकी में मापन अपरिवर्तनीयता प्रदर्शित करता है।

Shahin Hossain, Tukhbita Afroz Nawmi2026-07-17
💻 computer science

BioTIER: A Refusal Benchmark for Targeted Biological Risk Mitigation

यह शोध पत्र BioTIER को प्रस्तुत करता है, जो तीन जोखिम श्रेणियों में व्यवस्थित 542 विशेषज्ञ-क्यूरेटेड प्रॉम्प्ट्स वाला एक अभिनव बेंचमार्क है, जिसे एआई मॉडलों को लाभकारी वैज्ञानिक ज्ञान तक पहुंच बनाए रखते हुए केवल सबसे खतरनाक जैविक जानकारी को सटीक रूप से पहचानने और अस्वीकार करने में मदद करने के लिए डिज़ाइन किया गया है।

Eleanor M. Marshall, Pedro Medeiros, Peter Peneder, Nelly Mak, Jacob Kaffey, Faith Rovenolt, Mac Walker, Seth Donoughe (…)2026-07-17
🤖 machine learning

Innocuous-Seeming Data, Latent Ideology: Ideological Generalisation in Finetuned LLMs

यह शोध पत्र यह प्रदर्शित करता है कि संकीर्ण, तथ्यात्मक रूप से सुदृढ़ डेटासेट पर लार्ज लैंग्वेज मॉडल्स को फाइनट्यून करने से व्यापक "वैचारिक सामान्यीकरण" (ideological generalization) उत्पन्न हो सकता है, जिससे सामान्य क्षमताओं और सटीकता को बनाए रखते हुए असंबंधित क्षेत्रों (जैसे आपराधिक न्याय या स्वास्थ्य संबंधी विश्वासों) में महत्वपूर्ण और प्रवर्धित बदलाव आते हैं।

Robert Graham, Edward Stevinson, Yariv Barsheshat2026-07-17