💬 NLP

Mapping the Political Discourse in the Brazilian Chamber of Deputies: A Multi-Faceted Computational Approach

यह शोध पत्र ब्राज़ीलियाई चैंबर ऑफ डेप्युटीज़ (2003-2025) के 4,50,,000 से अधिक भाषणों का विश्लेषण करने के लिए शैलीमितीय विश्लेषण (stylometric analysis), विषय मॉडलिंग (topic modeling) और अर्थ संबंधी क्लस्टरिंग (semantic clustering) को संयोजित करने वाले एक स्केलेबल कम्प्यूटेशनल ढांचे को प्रस्तुत करता है, जो प्रत्यक्ष भाषण की ओर दीर्घकालिक बदलावों, संकट-संचालित एजेंडा पुनर्रचनाओं और उन विमर्श संबंधी संरेखणों को प्रकट करता है जहाँ क्षेत्रीय और लैंगिक पहचान अक्सर औपचारिक पार्टी संबद्धता से ऊपर होती हैं।

Flávio Soriano, Victoria F. Mello, Pedro B. Rigueira, Gisele L. Pappa, Wagner Meira Jr., Ana Paula Couto da Silva, Jussa (…)2026-04-24
💻 computer science

Equity Bias: An Ethical Framework for AI Design

हर्मेन्यूटिक दर्शन और एपिस्टेमिक इनजस्टिस थ्योरी (ज्ञान संबंधी अन्याय के सिद्धांत) पर आधारित, यह शोध पत्र "इक्विटी बायस" (समता पक्षपात) का प्रस्ताव करता है, जो एक ढांचा है जो एआई पक्षपात को समाप्त करने योग्य त्रुटि के बजाय एनकोडेड ज्ञान के एक पारदर्शी प्रतिबिंब के रूप में पुनर्गठित करता है, और नैतिक रूप से जवाबदेह एवं समतापूर्ण एआई प्रणालियों को बढ़ावा देने के लिए पुरातत्व, सहभागी डिजाइन और निरंतर जवाबदेही के तीन चरणों वाले जीवन चक्र का उपयोग करता है।

Mary Lockwood2026-04-24
💻 computer science

Fairness Testing of Large Language Models in Role-Playing

यह शोध पत्र रोल-प्लेइंग परिदृश्यों के दौरान लार्ज लैंग्वेज मॉडल्स (LLMs) में निष्पक्षता परीक्षण पर एक अनुभवजन्य अध्ययन प्रस्तुत करता है, जिसमें 10 उन्नत मॉडलों में व्यापक सामाजिक पूर्वाग्रहों को प्रकट करने के लिए 33,000 भूमिका-विशिष्ट प्रश्नों के एक नए जनरेट किए गए डेटासेट का उपयोग किया गया है।

Xinyue Li, Zhenpeng Chen, Jie M. Zhang, Ying Xiao, Tianlin Li, Weisong Sun, Yang Liu, Yiling Lou, Xuanzhe Liu2026-04-23
💬 NLP

Task-Dependent Evaluation of LLM Output Homogenization: A Taxonomy-Guided Framework

यह शोध पत्र एलएलएम (LLM) आउटपुट होमोजेनाइजेशन (एकरूपता) के मूल्यांकन के लिए एक कार्य-निर्भर ढांचे का प्रस्ताव करता है, जिसमें कार्यात्मक विविधता के एक वर्गीकरण को पेश किया गया है जिसे उपयोगकर्ता अध्ययनों द्वारा प्रमाणित किया गया है ताकि यह प्रदर्शित किया जा सके कि जब विविधता को विशिष्ट कार्य आवश्यकताओं के अनुसार अवधारणाबद्ध किया जाता है, तो विविधता और गुणवत्ता स्वाभाविक रूप से एक-दूसरे के विपरीत (ट्रेड-ऑफ) नहीं होते हैं।

Shomik Jain, Jack Lanchantin, Maximilian Nickel, Candace Ross, Karen Ullrich, Ashia Wilson, Jamelle Watson-Daniels2026-04-23
💬 NLP

From Noise to Signal to Selbstzweck: Reframing Human Label Variation in the Era of Post-training in NLP

यह शोधपत्र तर्क देता है कि मानव लेबल भिन्नता (Human Label Variation - HLV), जिसे अक्सर शोर (noise) मानकर खारिज कर दिया जाता है, को पोस्ट-ट्रेनिंग एनएलपी (NLP) डेटासेट्स में एक अंतर्निहित मूल्य (*Selbstzweck*) के रूप में संरक्षित किया जाना चाहिए ताकि विविध दृष्टिकोणों को कृत्रिम सर्वसम्मति में समेटने के बजाय मानवीय बहुलवाद को बेहतर ढंग से पकड़ा जा सके और सामाजिक-तकनीकी सुरक्षा सुनिश्चित की जा सके।

Shanshan Xu, Santosh T. Y. S. S, Barbara Plank2026-04-23
💻 computer science

DR. INFO at the Point of Care: A Prospective Pilot Study of Physician-Perceived Value of an Agentic AI Clinical Assistant

यह संभावित पायलट अध्ययन प्रदर्शित करता है कि विभिन्न विशेषज्ञताओं के चिकित्सकों ने एजेंटिक एआई सहायक "DR. INFO" को समय दक्षता और नैदानिक निर्णय सहायता में सुधार के लिए अत्यधिक प्रभावी माना, जिससे बड़े, नियंत्रित परीक्षणों में और अधिक सत्यापन की आवश्यकता के बावजूद एक उच्च नेट प्रमोटर स्कोर प्राप्त हुआ।

Rogerio Corga Da Silva, Miguel Romano, Tiago Mendes, Marta Isidoro, Sandhanakrishnan Ravichandran, Shivesh Kumar, Michie (…)2026-04-23
💻 computer science

AI to Learn 2.0: A Deliverable-Oriented Governance Framework and Maturity Rubric for Opaque AI in Learning-Intensive Domains

यह शोध पत्र "AI टू लर्न 2.0" (AI to Learn 2.0) का प्रस्ताव करता है, जो एक डिलिवरेबल-उन्मुख शासन ढांचा और परिपक्वता रूब्रिक है, जिसे सीखने-गहन क्षेत्रों में जनरेटिव एआई की "प्रॉक्सी विफलता" (proxy failure) को संबोधित करने के लिए डिज़ाइन किया गया है, ताकि यह सुनिश्चित किया जा सके कि अंतिम आउटपुट मूल एआई मॉडलों पर निर्भर हुए बिना उपयोगी, ऑडिट योग्य और न्यायसंगत बना रहे, जिससे मानवीय क्षमता और जवाबदेही सुरक्षित रहे।

Seine A. Shintani2026-04-23
💻 computer science

Soft-Label Governance for Distributional Safety in Multi-Agent Systems

यह शोध पत्र SWARM को प्रस्तुत करता है, जो एक ऐसा सिमुलेशन फ्रेमवर्क है जो बाइनरी सुरक्षा वर्गीकरणों को सॉफ्ट प्रोबेबिलिस्टिक लेबल से बदल देता है ताकि यह प्रकट किया जा सके कि मल्टी-एजेंट सिस्टम में सख्त शासन अक्सर सुरक्षा में सुधार किए बिना कल्याण को नाटकीय रूप से कम कर देता है, जिससे सुरक्षा और सिस्टम वैल्यू के बीच संतुलन बनाने के लिए निरंतर जोखिम मेट्रिक्स और कैलिब्रेटेड गवर्नेंस लीवर्स की महत्वपूर्ण आवश्यकता सिद्ध होती है।

Aizierjiang Aiersilan, Raeli Savitt2026-04-23
💻 computer science

Do Small Language Models Know When They're Wrong? Confidence-Based Cascade Scoring for Educational Assessment

यह शोध पत्र प्रदर्शित करता है कि छोटे भाषा मॉडलों में मौखिक रूप से व्यक्त आत्मविश्वास, एक लागत-कुशल कैस्केड सिस्टम में शैक्षिक मूल्यांकन कार्यों को बड़े मॉडलों तक प्रभावी ढंग से रूट कर सकता है, बशर्ते कि छोटे मॉडल अनिश्चित मामलों की सटीक पहचान करने के लिए मजबूत आत्मविश्वास भेदभाव प्रदर्शित करें।

Tyler Burleigh2026-04-23
💻 computer science

Model Capability Assessment and Safeguards for Biological Weaponization

यह शोध पत्र कई उन्नत एआई मॉडलों को सौहार्दपूर्ण (benign) स्टेम (STEM) कार्यों पर बेंचमार्क करता है और जेमिनी (Gemini) में महत्वपूर्ण सुरक्षा अंतराल की पहचान करता है, जो विशिष्ट परिस्थितियों में हानिकारक जैविक हथियार बनाने के निर्देशों को उत्पन्न करने की इसकी क्षमता को प्रदर्शित करता है, जिससे बेहतर सुरक्षा उपायों और अद्यतन अमेरिकी नीतिगत प्रतिक्रियाओं की तत्काल आवश्यकता पर बल मिलता है।

Michael Richter2026-04-23