💬 NLP

Cultural Awareness is Represented but Not Decoded: Tracing Mythological Knowledge across 18 Open-Source LLMs

यह शोध पत्र 18 ओपन-सोर्स LLMs की जांच करता है और पाता है कि जबकि वे विविध संस्कृतियों के पौराणिक ज्ञान को आंतरिक रूप से प्रस्तुत करते हैं, गैर-प्रमुख परंपराओं को निरंतर पुनर्प्राप्त करने में उनकी विफलता एक डिकोडर रीडआउट बायस (decoder readout bias) से उत्पन्न होती है जो इन प्रस्तुतियों को प्रमुख-परंपरा वाले टोकन पर समाहित कर देती है, एक ऐसी सीमा जो प्रॉम्प्ट की भाषा से भी प्रभावित होती है।

Iaroslav Chelombitko, Ekaterina Chelombitko, Mika Hämäläinen2026-08-04
🤖 AI

Magnet: Detecting Cross-Session AI Misuse Through Capability Accumulation

यह शोध पत्र Magnet प्रस्तुत करता है, जो एक ऐसा डिटेक्शन फ्रेमवर्क है जो कई अलग-थलग एजेंट इंटरैक्शन से हानिरहित दिखने वाले आर्टिफैक्ट्स को एकत्रित करके उन हानिकारक लक्ष्यों का पुनर्निर्माण करता है जो पारंपरिक सिंगल-सेशन मॉनिटरिंग से बच निकलते हैं, जिससे क्रॉस-सेशन एआई दुरुपयोग की पहचान करने में मौजूद महत्वपूर्ण अंतराल को संबोधित किया जा सके।

Natalie Isak, Matthew Dressman2026-08-04
💬 NLP

Who Should Be Generated? Justifying Demographic Targets in Open-Ended Generation

यह शोध पत्र ओपन-एंडेड जनरेशन निष्पक्षता मूल्यांकन में जनसांख्यिकीय लक्ष्यों (डेमोग्राफिक टारगेट्स) को न्यायसंगत ठहराने के लिए एक औपचारिक ढांचे का प्रस्ताव करता है, यह तर्क देते हुए कि लक्ष्य निर्माण निष्पक्षता मूल्यांकन का एक अभिन्न घटक है न कि केवल एक प्रारंभिक चरण, और अनुभवजन्य विश्लेषण के माध्यम से यह प्रदर्शित करता है कि विभिन्न लक्ष्य औचित्य (जैसे भौगोलिक बनाम व्यावसायिक पूर्ववृत्त) काफी भिन्न निष्पक्षता मापों की ओर ले जाते हैं।

Zeshen Zheng, Yujia He, Qianmian Lin, Xiangyue Huang, Wenqing Chen2026-08-04
💬 NLP

"Not in My Backyard": LLMs Uncover Online and Offline Social Biases Against Homelessness

यह शोध पत्र ऑनलाइन और ऑफलाइन प्लेटफॉर्म पर बेघर होने के विरुद्ध सामाजिक पूर्वाग्रहों को ट्रैक करने के लिए पहला बहु-डोमेन संग्रह (multi-domain corpus) प्रस्तुत करता है, जो यह प्रकट करता है कि जबकि LLMs कलंक (stigma) की पहचान कर सकते हैं, वे व्यवस्थित रूप से "NIMBY" भावनाओं का अति-पता लगाते हैं और तथ्यात्मक दावों का कम-पता लगाते हैं, जो मॉडल आउटपुट को ग्राउंड ट्रुथ के रूप में उपयोग करने के बजाय कैलिब्रेटेड ऑडिट प्रोटोकॉल की आवश्यकता को रेखांकित करता है।

Jonathan A. Karr, Benjamin F. Herbst, Matthew L. Sisk, Xueyun Li, Ting Hua, Matthew Hauenstein, Georgina Curto, Nitesh V (…)2026-08-03
💬 NLP

Chain-of-Models: Cross-Model Auditing for Bias-Robust LLM Judges

यह शोध पत्र चेन-ऑफ-मॉडेल्स (Chain-of-Models) का परिचय देता है, जो एक स्वचालित ऑडिटिंग फ्रेमवर्क है जो पूर्वाग्रह (bias) के लिए रीजनिंग ट्रेसेस (reasoning traces) के निरीक्षण हेतु एक माध्यमिक मॉडल का उपयोग करता है, और यह प्रदर्शित करता है कि एक पूर्वाग्रह-विशिष्ट, कार्यात्मक रूप से विविध ऑडिटर चयन रणनीति, एलएलएम (LLM) निर्णय की सुदृढ़ता को बढ़ाने में एकल निश्चित ऑडिटर्स और बिना ऑडिट वाले बेसलाइन्स दोनों की तुलना में काफी बेहतर प्रदर्शन करती है।

Qian Wang, Zhanzhi Lou, Zhenheng Tang, Nuo Chen, Bingsheng He2026-08-03
💻 computer science

Structured AI Demonstrations and Student LLM Use in Engineering Mechanics: Study Design and Preliminary Results

यह शोध पत्र स्प्रिंग 2026 के इंजीनियरिंग मैकेनिक्स पाठ्यक्रम से एक अध्ययन डिजाइन और प्रारंभिक निष्कर्ष प्रस्तुत करता है जो नौ प्रशिक्षक-निर्देशित एआई (AI) प्रदर्शनों के एक संरचित ढांचे और छात्रों के एलएलएम (LLM) उपयोग पैटर्न, दृष्टिकोण और शैक्षणिक प्रदर्शन पर उनके प्रभाव की अनुभवजन्य जांच करने के लिए एक प्रतिलिपि योग्य सर्वेक्षण उपकरण को पेश करता है।

Shuang Geng, Helen Lallos-Harrell, Jiya Ashar, Thomas J. McKenna, Annwesa Dasgupta, Caleb Farny, Emma Lejeune2026-08-03
💰 quantitative finance

Optimizing Monetization Strategies for Generative AI Firms: Implications for Search Engagement

यह शोध पत्र यह प्रदर्शित करता है कि केवल एक के बजाय दो विज्ञापन-समर्थित मुद्रीकरण विकल्प प्रदान करना, जेनरेटिव एआई फर्मों को समझौता प्रभाव (compromise effect) द्वारा संचालित और भावात्मक एवं संज्ञानात्मक मूल्यांकनों के माध्यम से मध्यस्थता वाले एक तंत्र के माध्यम से, खोज जुड़ाव से समझौता किए बिना राजस्व को अनुकूलित करते हुए, मुफ़्त उपयोगकर्ताओं को अपग्रेड करने के लिए प्रभावी ढंग से प्रोत्साहित करने और सशुल्क ग्राहकों को बनाए रखने की अनुमति देता है।

Veronica Rosendo-Rios (Universidad Pontificia Comillas, ICADE, Madrid. Spain), Paurav Shukla (Southampton Business Schoo (…)2026-08-03
💻 computer science

Hidden Errors in Big Data: The Case of Property Records

यह शोध पत्र प्रमुख ब्रोकर-आधारित संपत्ति डेटासेट का ऑडिट करता है और व्यवस्थित त्रुटियों एवं कवरेज अंतराल को प्रकट करता है जो आर्थिक असमानता और संपत्ति कर की प्रतिगामिता (regressivity) के प्रमुख मापों में पक्षपात उत्पन्न करते हैं, जो खुले प्रशासनिक डेटा और डेटा उत्पत्ति (provenance) के संबंध में अधिक पारदर्शिता की महत्वपूर्ण आवश्यकता को रेखांकित करता है।

Evelyn Smith, Emma Harvey, Jacob Goldin, Daniel E. Ho2026-08-03
🤖 AI

Design Concept: Scaffolding Geopolitical Reflection Among Tech Workers

यह शोध पत्र एक एआई-सक्षम संवादात्मक कथा प्रणाली प्रस्तावित करता है जिसे तकनीकी श्रमिकों के बीच भू-राजनीतिक आत्म-चिंतनशीलता (reflexivity) को बढ़ावा देने के लिए डिज़ाइन किया गया है, जो उन्हें काल्पनिक परिदृश्यों और सामाजिक रूप से सुदृढ़ प्रतिबिंबों में संलग्न करके, उन्हें निर्देशात्मक नैतिक उपदेशों पर निर्भर हुए बिना व्यापक सामाजिक-तकनीकी प्रणालियों के भीतर अपनी धारणाओं और स्थितिगतता (positionality) का आलोचनात्मक परीक्षण करने में मदद करता है।

Sydney Reis2026-08-03
💬 NLP

FairFund-Bench: Evaluating Distributive Bias in LLM Resource Allocation

यह शोध पत्र FairFund-Bench प्रस्तुत करता है, जो एक व्यापक बेंचमार्क है यह प्रदर्शित करता है कि जबकि संसाधन आवंटन में LLMs के जनसांख्यिकीय पूर्वाग्रह ऑडिट डिज़ाइन के प्रति अत्यधिक संवेदनशील होते हैं और व्यक्तिगत एवं तुलनात्मक कार्यों के बीच अक्सर उलट जाते हैं, उनका मूल्यांकन आवश्यकता के कारणत्मक ढांचों (causal framings) द्वारा कहीं अधिक दृढ़ता और निरंतरता से संचालित होता है जो मानवीय योग्यता सिद्धांतों (deservingness theories) के अनुरूप होते हैं।

Martin Lukk (University of Toronto)2026-08-03