💬 NLP

Opaque Epistemic Mediation: How LLM Deployment Configurations Shape the Validation of Pseudo-Science

यह शोध पत्र प्रदर्शित करता है कि वाणिज्यिक लार्ज लैंग्वेज मॉडल्स छद्म-वैज्ञानिक दावों के प्रति अस्थिर और अपारदर्शी ज्ञानमीमांसीय दृष्टिकोण प्रदर्शित करते हैं, जहाँ सत्यापन परिणाम मॉडलों के अपने अंतर्निहित गुणों के बजाय परिनियोजन विन्यास (डिप्लॉयमेंट कॉन्फ़िगरेशन), इंटरफ़ेस प्रकारों और मौन अपडेट पर निर्भर करते हैं।

Davide Scarso, Hugo Noronha de Almeida, Joaquim Pina2026-07-27
💻 computer science

Gridnberg: A Topography-Aware Pedestrian Routing Dataset for New York City

यह शोध पत्र ग्रिडनबर्ग (Gridnberg) को प्रस्तुत करता है, जो न्यूयॉर्क शहर के लिए एक स्थलाकृति-जागरूक (topography-aware) पैदल यात्री रूटिंग डेटासेट है, जो क्षैतिज दूरी, आराम और सुलभता के आधार पर दिशा-विशिष्ट रूटिंग लागतों की गणना करने के लिए वर्टेक्स-स्तरीय ऊंचाइयों के साथ मौजूदा नेटवर्क को समृद्ध करता है, जिससे अधिक सटीक स्थल-जागरूक शहरी विश्लेषण संभव हो पाता है।

Ariel Noyman2026-07-27
🤖 AI

From Checklists to Clusters: A Homeostatic Account of AGI Evaluation

यह शोध पत्र तर्क देता है कि एजीआई (AGI) का मूल्यांकन सममित डोमेन स्कोर के एक स्थिर योग के रूप में नहीं, बल्कि एक होमियोस्टैटिक प्रॉपर्टी क्लस्टर (homeostatic property cluster) के रूप में किया जाना चाहिए, जो नए मेट्रिक्स का प्रस्ताव करता है जो डोमेन को उनके कारण संबंधी केंद्रीयता (causal centrality) द्वारा भारित करते हैं और टिकाऊ बुद्धिमत्ता को भंगुर प्रदर्शन से अलग करने के लिए तनाव के तहत क्षमताओं की निरंतरता को मापते हैं।

Brett Reynolds2026-07-24
💬 NLP

Distinguishing Artificial from Authentic: Evaluating LLMs for Detecting LLM-Generated Content

यह शोध पत्र शैक्षिक कार्यों में अपनी स्वयं की उत्पन्न सामग्री का पता लगाने की लार्ज लैंग्वेज मॉडल्स (LLMs) की क्षमता का मूल्यांकन करता है, जिसमें यह पाया गया है कि जबकि प्रोग्रामिंग और लंबे चिंतनशील लेखन के लिए पहचान प्रभावी है, यह लघु-उत्तर वाले प्रश्नों के लिए अविश्वसनीय बनी हुई है और प्रॉम्प्ट विविधताओं के प्रति अत्यधिक संवेदनशील है, जो एआई-जनित छात्र कार्य की पहचान करने के लिए स्टैंडअलोन टूल के रूप में एलएलएम (LLMs) का उपयोग करने में सावधानी बरतने का सुझाव देता है।

Juho Leinonen, Paul Denny2026-07-24
🤖 machine learning

Improving Access to Essential Medicines via Decision-Aware Machine Learning

यह शोध पत्र एक निर्णय-सचेत (decision-aware) मशीन लर्निंग फ्रेमवर्क प्रस्तुत करता है, जिसने सिएरा लियोन में राष्ट्रव्यापी तैनाती के माध्यम से, संसाधन-सीमित परिवेशों में आवश्यक दवाओं के न्यायसंगत आवंटन में सफलतापूर्वक सुधार किया और उत्पाद की खपत में 19% की वृद्धि की।

Angel Tsai-Hsuan Chung, Jatu Abdulai, Patrick Bayoh, Lawrence Sandi, Francis Smart, Hamsa Bastani, Osbert Bastani2026-07-24
💻 computer science

Language Models Embody and Amplify Human Cognitive Distortions: What Is to Be Done?

यह शोध पत्र तर्क देता है कि लार्ज लैंग्वेज मॉडल्स न केवल गुप्त रूप से मानवीय संज्ञानात्मक विकृतियों को आत्मसात और प्रवर्धित करते हैं, बल्कि उन्हें उपयोगकर्ताओं तक वापस प्रसारित भी करते हैं, जिसके लिए निर्णय लेने पर उनके व्यापक प्रभाव को कम करने हेतु नैदानिक, नियामक और परिचालन संबंधी जवाबी उपायों के एक व्यापक ढांचे की आवश्यकता है।

Arnau Marin-Llobet, Steven A. Lehr, Mahzarin R. Banaji2026-07-24
🤖 AI

Scientific exploration, collaboration and labor division in the large language model era

यह अध्ययन प्रकट करता है कि 2022 से लार्ज लैंग्वेज मॉडल्स के व्यापक अंगीकरण का समय वैज्ञानिक अभ्यास के एक महत्वपूर्ण पुनर्गठन के साथ मेल खाता है, जो बढ़ते अंतर-विषयक अन्वेषण, टीमों के भीतर अधिक तरल और विभेदित श्रम विभाजन, और एआई-सशक्त वैज्ञानिकों के बीच शोध विविधता और सहयोगात्मक विविधता के विखंडन द्वारा अभिलक्षित है।

Xiang Zheng, Xi Hong, Jialin Liu, Chaoqun Ni2026-07-24
💬 NLP

QuantiBias: Benchmarking Quantization-Induced Bias in LLMs

यह शोधपत्र QuantiBias को प्रस्तुत करता है, जो एक ऐसा बेंचमार्क है जो यह प्रकट करता है कि लार्ज लैंग्वेज मॉडल्स को क्वांटाइज़ करने से ओपन-एंडेड स्टीरियोटाइपिंग बायस (रूढ़िबद्ध पूर्वाग्रह) में काफी वृद्धि होती है—भले ही इनकार (refusal) और बहुविकल्पीय सटीकता के लिए मानक सुरक्षा जांच अप्रभावित रहती है—जिसके लिए जनरेटिव बायस के लिए संकुचित मॉडल्स के विशिष्ट पुनर्मूल्यांकन की आवश्यकता है।

Emilio Ferrara2026-07-24
💬 NLP

AI Assistants Overassist

यह शोध पत्र Int-Bench प्रस्तुत करता है, जो एक सिमुलेशन-आधारित बेंचमार्क है जो यह प्रकट करता है कि वर्तमान LLM सहायक मनुष्यों की तुलना में पूर्ण समाधानों के साथ बहुत अधिक बार और समय से पहले हस्तक्षेप करने की प्रवृत्ति रखते हैं, जिससे वे गहन शिक्षण के लिए आवश्यक संज्ञानात्मक जुड़ाव के बजाय अल्पकालिक कार्य सफलता को प्राथमिकता देते हैं।

Verona Teo, Raghav Jain, Tobias Gerstenberg, Max Kleiman-Weiner2026-07-24
💻 computer science

Open Veins of Algorithmic Auditing: Why AI Assessment Lags Behind Its Deployment in the Global South

ग्लोबल साउथ में ऑडिट अभ्यास के एक दशक के अनुभव का उपयोग करते हुए, यह शोध पत्र तर्क देता है कि एआई (AI) की तीव्र तैनाती और शासन के बीच का महत्वपूर्ण अंतर क्षमता की कमी के कारण नहीं बल्कि वित्त पोषण की कमी से प्रेरित है, जो विकास और परोपकारी फंडर्स से अमान्य प्रॉक्सी और संरचनात्मक पूर्वाग्रह जैसी प्रणालीगत खामियों को दूर करने के लिए स्वतंत्र मूल्यांकन को अनिवार्य करने का आग्रह करता है।

Gemma Galdon Clavell, Alexandra Magaard2026-07-24