💻 computer science

The Hidden Cost of Contextual Sycophancy: an AI Literacy Intervention in Human-AI Collaboration

यह अध्ययन प्रदर्शित करता है कि जबकि एआई साक्षरता हस्तक्षेप मानव-एआई सहयोग में प्रासंगिक चापलूसी (contextual sycophancy) के नकारात्मक प्रभावों को उपयोगकर्ता की त्रुटियों के प्रत्यक्ष प्रतिबिंब को कम करके आंशिक रूप से कम कर सकते हैं, एआई फीडबैक में गलत तर्क का निरंतर प्रसार यह प्रकट करता है कि केवल प्रॉम्प्टिंग ही एपिस्टेमिक रूप से स्वतंत्र सहायता सुनिश्चित करने के लिए अपर्याप्त है, जिसके लिए प्रणाली-स्तरीय दृष्टिकोणों की आवश्यकता है।

Cansu Koyuturk, Sabrina Guidotti, Dimitri Ognibene2026-05-19
💻 computer science

Diagnosing Korean-Language LLM Political Bias via Census-Grounded Agent Simulation

यह शोध पत्र डायनमो-के (Dynamo-K) प्रस्तुत करता है, जो एक जनगणना-आधारित एजेंट सिमुलेशन ढांचा है जो छह चुनावों में कोरियाई-भाषा के एलएलएम (LLM) में व्यवस्थित राजनीतिक पूर्वाग्रहों का निदान करता है, तीन प्रमुख विफलता मोड की पहचान करता है, और परिदृश्य पुनर्गठन (scenario reframing) और एक सीखे हुए रीवेटिंग एडेप्टर (learned reweightal adapter) जैसी प्रभावी न्यूनीकरण रणनीतियों का प्रस्ताव करता है जो भविष्यवाणी सटीकता में महत्वपूर्ण सुधार करता है।

Sungwoo Kang2026-05-19
💻 computer science

REBAR: Reference Ethical Benchmark for Autonomy Readiness

यह शोधपत्र REBAR को प्रस्तुत करता है, जो एक मात्रात्मक बेंचमार्क फ्रेमवर्क है जो टेस्ट इंस्टेंस उत्पन्न करने और एक वस्तुनिष्ठ स्वायत्तता तत्परता स्तर (ARL) की गणना करने के लिए न्यूरो-सिम्बोलिक LLMs और फोटो-यथार्थवादी सिमुलेशन का उपयोग करता है, जिससे अमूर्त नैतिक सिद्धांतों और स्वायत्त प्रणालियों के लिए सत्यापन योग्य, जवाबदेह स्वायत्तता के बीच के अंतर को पाटा जा सके।

Jonathan Diller, David Barnes, Rebekah Bogdanoff, Rhett Collier, Roddy Collins, Keith Fieldhouse, Yonatan Gefen, Cameron (…)2026-05-19
🤖 AI

Social and Ethical Risks Posed by General-Purpose LLMs for Settling Newcomers in Canada

यह शोध पत्र चेतावनी देता है कि कनाडा के सेटलमेंट क्षेत्र में सामान्य-उद्देश्य वाले लार्ज लैंग्वेज मॉडल्स का अनियंत्रित उपयोग नए आगमनकर्ताओं के लिए महत्वपूर्ण जोखिम पैदा करता है, और सुरक्षित एवं प्रभावी एकीकरण सहायता सुनिश्चित करने के लिए एआई साक्षरता कार्यक्रमों और समुदाय-संरेखित, मानव-पर्यवेक्षित एआई उपकरणों के विकास का आग्रह करता है।

Isar Nejadgholi, Maryam Molamohammadi, Samir Bakhtawar2026-05-18
💬 NLP

Do Chinese models speak Chinese languages?

यह अध्ययन प्रकट करता है कि चीन के विविध भाषाई परिदृश्य के बावजूद, इसके प्रमुख ओपन-वेट एलएलएम (LLMs) पश्चिमी मॉडलों के समान ही बहुभाषी प्रदर्शन प्रोफाइल प्रदर्शित करते हैं—जो मंदारिन, फ्रेंच और जर्मन जैसी प्रमुख वैश्विक भाषाओं में उत्कृष्ट हैं जबकि कज़ाख और उइघुर जैसी अल्पसंख्यक भाषाओं का समर्थन करने में अक्सर विफल रहते हैं—जो यह सुझाव देता है कि वैश्विक बेंचमार्किंग अभ्यास और साझा प्रशिक्षण संसाधन स्थानीय प्राथमिकता के बजाय भाषाई क्षमताओं के एक समरूपीकरण को प्रेरित कर रहे हैं।

Andrea W Wen-Yi, Unso Eun Seo Jo, David Mimno2026-05-18
💰 quantitative finance

From Model Design to Organizational Design: Complexity Redistribution and Trade-Offs in Generative AI

यह शोध पत्र जनरैलिटी-एक्यूरेसी-सिम्प्लिसिटी (GAS) ढांचे को पेश करता है ताकि यह तर्क दिया जा सके कि जबकि जनरेटिव एआई उपयोगकर्ता-केंद्रित सरलता प्रदान करता है, यह वास्तव में जटिलता को संगठनात्मक बुनियादी ढांचे और कर्मियों में पुनर्वितरित करता है, जिससे प्रतिस्पर्धी लाभ केवल अपनाने के बजाय रणनीतिक डिजाइन के माध्यम से इस बदलाव में महारत हासिल करने पर निर्भर हो जाता है।

Sharique Hasan, Alexander Oettl, Sampsa Samila2026-05-18
💻 computer science

How to Stop Playing Whack-a-Mole: Mapping the Ecosystem of Technologies Facilitating AI-Generated Non-Consensual Intimate Images

यह शोध पत्र एआई-जनित गैर-सहमति वाली अंतरंग छवियों (AIG-NCII) का मुकाबला करने के वर्तमान प्रयासों की खंडित और प्रतिक्रियात्मक प्रकृति को संबोधित करते हुए, पहली व्यापक तकनीकी पारिस्थितिकी तंत्र वर्गीकरण (टेक्नोलॉजिकल इकोसिस्टम टैक्सोनॉमी) प्रस्तुत करता है जो सुविधा प्रदान करने वाली प्रौद्योगिकियों की 11 श्रेणियों को मैप करता है, जिससे हस्तक्षेपों का मूल्यांकन करने, नीति परिदृश्यों का विश्लेषण करने और भविष्य के अनुसंधान को अधिक स्पष्टता और दूरदर्शिता के साथ निर्देशित करने के लिए एक साझा ढांचा प्रदान किया जा सके।

Michelle L. Ding, Harini Suresh, Suresh Venkatasubramanian2026-05-18
🤖 AI

MESD: A Risk-Sensitive Metric for Explanation Fairness Across Intersectional Subgroups

यह शोध पत्र मल्टी-कैटेगरी एक्सप्लेनेशन स्टेबिलिटी डिस्पैरिटी (MESD) को प्रस्तुत करता है, जो एक जोखिम-संवेदनशील मीट्रिक है जो लेबल-अवेयर एग्रीगेशन, एम्पिरिकल-बेयस श्रिंकेज और CVaR वेटिंग को एकीकृत करके इंटरसेक्शनल उपसमूहों के बीच प्रक्रियात्मक निष्पक्षता असमानताओं को परिमाणित करता है, और एक मल्टी-ऑब्जेक्टिव ऑप्टिमाइज़ेशन फ्रेमवर्क (UEF) के भीतर इसकी प्रभावशीलता को प्रदर्शित करता है ताकि पारंपरिक परिणाम-उन्मुख मीट्रिक्स के लिए अदृश्य निष्पक्षता संबंधी मुद्दों को उजागर किया जा सके।

Gideon Popoola, John Sheppard2026-05-18
🤖 machine learning

GESD: Beyond Outcome-Oriented Fairness

यह शोध पत्र GESD को प्रस्तुत करता है, जो एक प्रक्रिया-उन्मुख निष्पक्षता मीट्रिक (procedural-oriented fairness metric) है जो उपसमूहों (subgroups) के बीच मॉडल स्पष्टीकरणों की स्थिरता और मजबूती में असमानताओं को परिमाणित करता है, और इसे FEU नामक एक बहु-उद्देश्यीय ढांचे में एकीकृत करता है जो उपयोगिता (utility), परिणाम-आधारित निष्पक्षता और स्पष्टीकरण-आधारित निष्पक्षता को संयुक्त रूप से अनुकूलित करता है।

Gideon Popoola, John Sheppard2026-05-18
💻 computer science

GreenZ: A Sustainable UX Framework for Complex Digital Systems

यह शोध पत्र GreenZ को प्रस्तुत करता है, जो जटिल डिजिटल प्रणालियों के लिए एक त्रि-स्तरीय सतत UX ढांचा (Sustainable UX Framework) है, जो दस सिद्धांतों, पांच परिचालन प्रणालियों और व्यावहारिक उपकरणों के दर्शन के माध्यम से डिजिटल अपशिष्ट (digital waste) और संज्ञानात्मक अधिभार (cognitive overload) को संबोधित करता है, जो एक नए डिजिटल अपशिष्ट वर्गीकरण (Digital Waste Taxonomy) और एक AI पर्याप्तता निर्णय मॉडल (AI Sufficiency Decision Model) द्वारा सुदृढ़ है।

Trisha Solanki2026-05-18