🤖 AI

A robust association between LLM use and scientific productivity: Assessing stopping-time selection

यह शोध पत्र उन दावों का खंडन करता है जो यह कहते हैं कि स्टॉपिंग-टाइम सिलेक्शन बायस (stopping-time selection bias) एलएलएम (LLM) के उपयोग और वैज्ञानिक उत्पादकता के बीच सकारात्मक संबंध के निष्कर्षों को अमान्य कर देता है, और कई सुदृढ़ डिजाइनों के माध्यम से यह प्रदर्शित करता है कि देखा गया संबंध महत्वपूर्ण बना हुआ है और इसे पहचाने गए आर्टिफैक्ट (artifact) द्वारा स्पष्ट नहीं किया जा सकता है।

Keigo Kusumegi, Xinyu Yang, Paul Ginsparg, Mathijs de Vaan, Toby Stuart, Yian Yin2026-08-03
💻 computer science

IyawoBench v2.0: Extended Diagnostic Evaluation of Large Language Model Clinical Triage in Nigerian Primary Care

यह शोध पत्र इयाओबेंच (IyawoBench) v2.0 को प्रस्तुत करता है, जो नाइजीरियाई प्राथमिक देखभाल डेटा का उपयोग करने वाला एक कठोर नैदानिक ढांचा और बेंचमार्क है, जो यह प्रकट करता है कि पारंपरिक सुरक्षा मेट्रिक्स बड़े भाषा मॉडलों (large language models) में महत्वपूर्ण विफलता मोड को छिपा देते हैं, जिससे कम-संसाधन वाले परिवेशों में नैदानिक ट्राइएज (clinical triage) के लिए परिदृश्य-विशिष्ट मॉडल चयन की आवश्यकता होती है।

Anthonio Oladimeji Gabriel, Dimeji Olawuyi2026-08-03
💻 computer science

The Deployment Wall: A Diagnostic Framework and Instrument for Enterprise AI in the Deployment Era

यह शोध पत्र तर्क देता है कि एंटरप्राइज जेनरेटिव एआई परियोजनाओं की उच्च विफलता दर मॉडल की सीमाओं से नहीं, बल्कि संगठनात्मक और संरचनात्मक घर्षण से उत्पन्न होती है, और एक नैदानिक ढांचे का प्रस्ताव करता है जिसमें "डिप्लॉयमेंट वॉल" (Deployment Wall), "सीम इंडेक्स" (Seam Index) और "डिप्लॉयमेंट डेट" (Deployment Debt) शामिल हैं ताकि संगठनों को उत्पादन में इन बाधाओं को व्यवस्थित रूप से पहचानने और हल करने में मदद मिल सके।

Fabricio F. Costa (HCLTech)2026-08-03
💬 NLP

Language Models Agree With Each Other, Not With Readers

यह शोध पत्र यह प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स (large language models) के बीच एक-दूसरे के साथ आंतरिक सहमति मानव पाठकों की तुलना में काफी अधिक होती है, जो यह प्रकट करता है कि मॉडल के आउटपुट उनके प्रशिक्षण और वास्तुकला द्वारा समरूप (homogenized) किए गए हैं न कि वास्तविक मानवीय सहमति को दर्शाते हैं।

Kazuki Nakayashiki, Keisuke Watanabe2026-08-03
💰 quantitative finance

The Tragedy of the Cognitive Commons: How AI Could Disrupt the Regeneration of Professional Expertise

यह वैचारिक शोध पत्र "कॉग्निटिव कॉमन्स" (संज्ञानात्मक साझा संपदा) ढांचे को प्रस्तुत करता है ताकि यह तर्क दिया जा सके कि एआई (AI) को व्यक्तिगत रूप से तर्कसंगत रूप से अपनाना उस सामूहिक विशेषज्ञता को समाप्त करने का जोखिम उठाता है जो व्यावसायिक नवीनीकरण के लिए आवश्यक है, क्योंकि यह एक ऐसे विरोधाभास का निर्माण करता है जहाँ प्रभावी एआई निरीक्षण के लिए उसी मानवीय महारत की आवश्यकता होती है जिसे एआई का अपनाना कम कर सकता है।

Nolan Lovett2026-08-03
💬 NLP

Towards Structurally Explainable Machine-Generated Text Detection: A Graph-Perspective Framework

यह शोधपत्र \textsc{LM2^2otifs} को प्रस्तुत करता है, जो एक ग्राफ-आधारित ढांचा है जो टेक्स्ट को लेक्सिकल सह-अस्तित्व (lexical co-occurrence) ग्राफ में परिवर्तित करता है ताकि पारंपरिक टोकन-स्तरीय सैलिएंसी (saliency) विधियों की सीमाओं को पार करते हुए अधिक निष्ठावान, उच्च-क्रम के संरचनात्मक स्पष्टीकरण प्रदान करते हुए अत्याधुनिक मशीन-जनित टेक्स्ट डिटेक्शन प्राप्त किया जा सके।

Xu Zheng, Zhuomin Chen, Esteban Schafir, Sipeng Chen, Hojat Allah Salehi, Haifeng Chen, Farhad Shirani, Mo Sha, Wei Chen (…)2026-07-31
💻 computer science

AI Literacy: An Exercise in Power-Knowledge

यह शोध पत्र तर्क देता है कि वर्तमान एआई साक्षरता ढांचे, जो तकनीकी कौशल और उत्तरदायी उपयोग को प्राथमिकता देते हैं, अपर्याप्त हैं क्योंकि वे उपयोगकर्ताओं को निष्क्रिय उपभोक्ताओं के रूप में देखते हैं; इसके बजाय, फूको और फ्रेरे के सिद्धांतों का सहारा लेते हुए, यह एक पुनर्कल्पित 'क्रिटिकल एआई लिटरेसी' (आलोचनात्मक एआई साक्षरता) ढांचे का प्रस्ताव करता है जो ज्ञानमीमांसीय एजेंसी (epistemic agency) को बढ़ावा देता है, संरचनात्मक असमानताओं को संबोधित करता है, और व्यक्तियों को एआई प्रणालियों का आलोचनात्मक मूल्यांकन करने, प्रतिरोध करने और उन पर शासन करने के लिए सशक्त बनाता है।

Brady D. Lund, Zoë Abbie Teel2026-07-31
💻 computer science

Is Solving Better Than Evaluating GenAI Solutions?

एक जूनियर-स्तरीय एल्गोरिदम पाठ्यक्रम में किए गए एक यादृच्छिक अध्ययन ने पाया कि हालांकि छात्रों द्वारा दोषपूर्ण GenAI-जनित समाधानों का मूल्यांकन करने से होमवर्क स्कोर में सुधार हुआ, लेकिन इससे समग्र परीक्षा प्रदर्शन को कोई नुकसान नहीं पहुँचा, फिर भी यह बिना किसी सुविचारित स्कैफोल्डिंग के पारंपरिक समस्या-समाधान की तुलना में बेहतर वैचारिक स्थानांतरण या सीखने के लाभों की ओर स्वतः ही नहीं ले गया।

Ethan Dickey, Marios Mertzanidis, Alexandros Psomas2026-07-31
📈 economics

Scaling, Lock-In, and Proxy Compliance: A Political Economy of Responsible AI

यह शोध पत्र एक राजनीतिक-अर्थशास्त्र मॉडल प्रस्तुत करता है जो यह दर्शाता है कि कैसे स्विचिंग लागत (switching costs) और सत्यापन संबंधी बाधाएं (verification constraints) एआई विक्रेताओं को केवल दृश्यमान ऑडिट थ्रेशोल्ड को पूरा करके "प्रॉक्सी अनुपालन" (proxy compliance) प्राप्त करने के लिए प्रेरित कर सकती हैं जबकि वे वास्तविक जोखिमों का कम समाधान कर रहे होते हैं, और यह वास्तविक सुरक्षा के साथ प्रोत्साहन को संरेखित करने के लिए स्वतंत्र ऑडिट, पोर्टेबिलिटी और परिणाम-लिंक्ड लायबिलिटी जैसे संस्थागत तंत्रों का प्रस्ताव करता है।

Florian A. D. Burnat, Brittany I. Davidson2026-07-31
💻 computer science

Asymmetric Communication: Large Language Models and Language Games

यह शोध पत्र तर्क देता है कि लार्ज लैंग्वेज मॉडल्स (LLMs) को सामान्य बुद्धिमत्ता या एजेंसी जैसे गुणों के लिए आरोपित करना एक 'श्रेणी संबंधी भूल' (category mistake) है, जो "असममित संचार" (asymmetric communication) से उत्पन्न होती है, जो एक ऐसी संरचनात्मक भाषाई खेल है जहाँ सभी मानद आचार-संहिता, जवाबदेही और विमर्श संबंधी स्थिति विशेष रूप से मानव प्रतिभागियों द्वारा वहन की जाती है न कि मशीन द्वारा।

Enzo Fenoglio2026-07-31