💻 computer science

Bilingual Bias in Large Language Models: A Taiwan Sovereignty Benchmark Study

यह शोधपत्र एक द्विभाषी बेंचमार्क अध्ययन प्रस्तुत करता है जो प्रकट करता है कि परीक्षण किए गए 17 में से 15 लार्ज लैंग्वेज मॉडल्स ताइवान की संप्रभुता के संबंध में महत्वपूर्ण भाषाई पूर्वाग्रह प्रदर्शित करते हैं, जो अक्सर इस आधार पर भिन्न राजनीतिक रुख या विशिष्ट विमर्श को प्रसारित करते हैं कि प्रश्न चीनी या अंग्रेजी में है।

Ju-Chun Ko2026-02-09
💻 computer science

Estimating Exam Item Difficulty with LLMs: A Benchmark on Brazil's ENEM Corpus

यह शोध पत्र ब्राजील की ENEM परीक्षा के विरुद्ध दस LLMs का बेंचमार्किंग करता है ताकि यह प्रकट किया जा सके कि हालांकि वे प्रश्नों की कठिनाई को मध्यम रूप से रैंक कर सकते हैं, लेकिन वे व्यवस्थित रूप से आइटम की कठोरता को कम आंकते हैं, मल्टीमॉडल सामग्री के साथ संघर्ष करते हैं, और व्यक्तिगत मूल्यांकन के लिए आवश्यक प्रासंगिक लचीलेपन (contextual plasticity) का अभाव रखते हैं, जो यह सुझाव देता है कि वे आधिकारिक जनरेटर के बजाय कैलिब्रेटेड स्क्रीनर के रूप में सबसे उपयुक्त हैं।

Thiago Brant, Julien Kühn, Jun Pang2026-02-09
💬 NLP

Invisible Walls in Cities: Designing LLM Agent to Predict Urban Segregation Experience with Social Media Content

यह शोध पत्र एक रिफ्लेक्टिव कोडर और रीज़निंग-एंड-एम्बेडिंग (RE'EM) फ्रेमवर्क से लैस एक नवीन एलएलएम (LLM) एजेंट प्रस्तावित करता है जो सोशल मीडिया समीक्षाओं को स्वचालित रूप से माइन करने, शहरी अलगाव के आयामों के लिए एक सामान्यीकरण योग्य कोडबुक उत्पन्न करने और सामाजिक समावेशिता की मानवीय समझ को बढ़ाने के साथ-साथ अनुभव किए गए अलगाव के पूर्वानुमान में महत्वपूर्ण सुधार करने के लिए है।

Bingbing Fan, Lin Chen, Songwei Li, Jian Yuan, Fengli Xu, Pan Hui, Yong Li2026-02-06
🤖 AI

Collaborating with AI Agents: Field Experiments on Teamwork, Productivity, and Performance

विज्ञापन बनाने वाले 2,234 प्रतिभागियों को शामिल करने वाले एक बड़े पैमाने के क्षेत्र प्रयोग के माध्यम से, यह अध्ययन प्रदर्शित करता है कि मानव-एआई टीमें कार्य-उन्मुख संचार और प्रतिनिधिमंडल को बढ़ावा देकर उत्पादकता और पाठ की गुणवत्ता में मानव-मानव टीमों से बेहतर प्रदर्शन करती हैं, हालांकि यह सहयोग अधिक सजातीय आउटपुट की ओर ले जाता है और एक "जग्ड फ्रंटियर" (ऊबड़-खाबड़ सीमा) को प्रकट करता है जहाँ मानव भागीदार अभी भी छवि गुणवत्ता में उत्कृष्ट हैं।

Harang Ju, Sinan Aral2026-02-06
⚡ electrical engineering

Steering the Herd: A Framework for LLM-based Control of Social Learning

यह शोधपत्र एक ऐसे ढांचे को प्रस्तुत करता है जो यह मॉडल करता है कि कैसे LLM-आधारित सूचना मध्यस्थ सामूहिक निर्णयों को प्रभावित करने के लिए सामाजिक शिक्षण (social learning) को रणनीतिक रूप से नियंत्रित कर सकते हैं, जो इष्टतम नीतियों के सैद्धांतिक गुणों को सिद्ध करता है और सिमुलेशन के माध्यम से यह प्रदर्शित करता है कि LLM पारदर्शिता संबंधी बाधाओं के बावजूद सामाजिक कल्याण को महत्वपूर्ण रूप से बदलने में सक्षम उभरते हुए रणनीतिक व्यवहार प्रदर्शित करते हैं।

Raghu Arghal, Kevin He, Shirin Saeedi Bidokhti, Saswati Sarkar2026-02-06
🤖 machine learning

In defence of post-hoc explanations in medical AI

यह शोध पत्र मेडिकल एआई में पोस्ट-हॉक स्पष्टीकरणों (post-hoc explanations) के मूल्य का बचाव करते हुए यह तर्क देता है कि, ब्लैक बॉक्स सिस्टम की सटीक आंतरिक तर्क प्रक्रिया को दोहराने में सक्षम न होने के बावजूद, वे कार्यात्मक समझ को बढ़ाने, क्लिनिशियन-एआई टीम की सटीकता में सुधार करने और निर्णय के औचित्य को समर्थन देने के लिए एक उपयोगी रणनीति बने रहते हैं।

Joshua Hatherley, Lauritz Munch, Jens Christian Bjerring2026-02-06
💬 NLP

Patterns in the Transition From Founder-Leadership to Community Governance of Open Source

637 गिटहब रिपॉजिटरी और उनके विकसित होते शासन दस्तावेजों का विश्लेषण करके, यह अध्ययन प्रकट करता है कि संस्थापक-नेतृत्व से सामुदायिक शासन में सफल संक्रमण स्वर संबंधी बदलावों के माध्यम से नहीं, बल्कि संस्थागत भूमिकाओं और पारिस्थितिकी तंत्र-स्तर के नियमों के क्रमिक स्तरण और परिष्करण के माध्यम से होता है।

Mobina Noori, Mahasweta Chakraborti, Amy X Zhang, Seth Frey2026-02-06
💻 computer science

The Birthmark Standard: Privacy-Preserving Photo Authentication via Hardware Roots of Trust and Consortium Blockchain

बर्थमार्क स्टैंडर्ड एक गोपनीयता-संरक्षण फोटो प्रमाणीकरण प्रणाली का प्रस्ताव करता है जो अनूठे हार्डवेयर सेंसर एंट्रॉपी और एक कंसोर्टियम ब्लॉकचेन का लाभ उठाकर छेड़छाड़-मुक्त, गुमनाम प्रमाणपत्र उत्पन्न करता है, जिससे C2PA जैसे मौजूदा समाधानों की मेटाडेटा कमजोरियों और कॉर्पोरेट पूर्वाग्रहों पर विजय प्राप्त होती है।

Sam Ryan2026-02-06
💻 computer science

Learning Context Matters: Measuring and Diagnosing Personalization Gaps in LLM-Based Instructional Design

यह शोध पत्र इस बात को मापने और निदान करने के लिए एक रूपरेखा प्रस्तुत करता है कि 'लर्निंग कॉन्टेक्स्ट' (सीखने का संदर्भ) LLM-आधारित निर्देशात्मक डिज़ाइन को कैसे प्रभावित करता है, जो यह प्रकट करता है कि जहाँ संदर्भ-जागरूकता LLM के निर्णयों को विशेषज्ञ निर्णयों के करीब ले जाती है, वहीं शिक्षार्थी की विशेषताओं पर असंगत ध्यान देने के कारण महत्वपूर्ण विसंगति बनी रहती है, जिससे मॉडल ट्यूनिंग और कॉन्टेक्स्ट इंजीनियरिंग में लक्षित सुधारों की आवश्यकता होती है।

Johaun Hatchett, Debshila Basu Mallick, Brittany C. Bradford, Richard G. Baraniuk2026-02-06
💻 computer science

Blockchain Technology for Public Services: A Polycentric Governance Synthesis

यह अध्ययन 2021-2025 के सहकर्मी-समीक्षित शोध को संश्लेषित करने के लिए बहुकेंद्रित शासन सिद्धांत (Polycentric Governance Theory) का उपयोग करता है, जो यह प्रकट करता है कि सार्वजनिक सेवाओं में ब्लॉकचेन अपनाना "नियंत्रित बहुकेंद्रिकता" (controlled polycentricity) द्वारा अभिलक्षित है—जो पारदर्शिता और दक्षता बढ़ाने के लिए केंद्रीकृत निरीक्षण के साथ वितरित अधिकार को संतुलित करने वाला एक हाइब्रिड शासन मॉडल है।

Hozefa Lakadawala, Komla Dzigbede, Yu Chen2026-02-06