💬 NLP

Vision-Language Models Suppress Female Representations Under Ambiguous Input

यह शोध पत्र यह प्रकट करता है कि जहाँ विजन-लैंग्वेज मॉडल अक्सर अस्पष्ट छवियों के लिए आंतरिक रूप से महिला संघों को एनकोड करते हैं, वहीं उनके आउटपुट व्यवस्थित रूप से पुरुष निरूपणों की ओर डिफ़ॉल्ट होते हैं क्योंकि एक विषम फ़िल्टरिंग तंत्र जनरेशन के दौरान पुरुष संकेतों को बढ़ाता है और महिला संकेतों को दबा देता है।

Arnau Marin-Llobet, Simon Henniger, Mahzarin R. Banaji2026-06-01
💬 NLP

Language Models Learn Constructional Semantics, Not To Mention Syntax: Investigating LM Understanding of Paired-Focus Constructions

यह शोध पत्र प्रदर्शित करता है कि मध्यम आकार के ओपन-सोर्स भाषा मॉडल दुर्लभ युग्मित-केंद्रित (paired-focus) संरचनाओं के अर्थों को प्रभावी ढंग से समझ सकते हैं, जिसमें यह समझ सिंटैक्टिक ज्ञान की तुलना में प्रशिक्षण के बाद उभरती है और विश्व ज्ञान के विशिष्ट क्षेत्रों में होने वाली वृद्धि के साथ सह-संबंधित है।

Wesley Scivetti, Ethan Wilcox, Nathan Schneider, Kanishka Misra, Leonie Weissweiler2026-06-01
🤖 AI

A Survey on Recent Advances in Conversational Data Generation

यह शोध पत्र सिंथेटिक संवादात्मक डेटा जनरेशन में हालिया प्रगति का एक व्यापक सर्वेक्षण प्रस्तुत करता है, जो ओपन-डोमेन, कार्य-उन्मुख और सूचना-खोज प्रणालियों में मल्टी-टर्न संवादों को बनाने की विधियों की व्यवस्थित रूप से समीक्षा करता है, साथ ही एक सामान्य ढांचे, मूल्यांकन मेट्रिक्स, वर्तमान चुनौतियों और भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।

Heydar Soudani, Roxana Petcu, Evangelos Kanoulas, Faegheh Hasibi2026-05-29
🤖 machine learning

Early Detection of Misinformation for Infodemic Management: A Domain Adaptation Approach

यह शोध पत्र इन्फोडेमिक्स के दौरान गलत सूचनाओं का शीघ्र पता लगाने के लिए एक नवीन डोमेन अनुकूलन दृष्टिकोण प्रस्तावित करता है जो सैद्धांतिक और अनुभवजन्य रूप से मौजूदा अत्याधुनिक विधियों से बेहतर प्रदर्शन करने के लिए कोवेरिएट और कॉन्सेप्ट दोनों बदलावों को संबोधित करने की आवश्यकता को प्रदर्शित करता है।

Minjia Mao, Xiaohang Zhao, Xiao Fang2026-05-29
💻 computer science

CriticalKV: Optimizing KV Cache Eviction from an Output Perturbation Perspective

यह शोधपत्र CriticalKV को प्रस्तुत करता है, जो एक औपचारिक रूप से आधारित, प्लग-एंड-प्ले एल्गोरिदम है जो आउटपुट परटर्बेशन (output perturbation) का विश्लेषण करके महत्वपूर्ण प्रविष्टियों की पहचान करने द्वारा KV कैश इविक्शन (eviction) को अनुकूलित करता है, जिससे विभिन्न लॉन्ग-कॉन्टेक्स्ट बेंचमार्क में नगण्य कम्प्यूटेशनल ओवरहेड के साथ संपीड़न हानि (compression loss) को काफी कम किया जा सकता है।

Yuan Feng, Junlin Lv, Haoyu Guo, Yukun Cao, S Kevin Zhou, Xike Xie2026-05-29
💬 NLP

Towards Detecting Persuasion on Social Media: From Model Development to Insights on Persuasion Strategies

यह शोध पत्र ऑस्ट्रेलियाई चुनाव फेसबुक विज्ञापनों पर फाइन-ट्यून किए गए एक हल्के, अत्याधुनिक मॉडल को प्रस्तुत करता है जो फंडिंग, जनसांख्यिकी और समय के माध्यम से विशिष्ट अनुनय रणनीतियों (persuasion strategies) को प्रकट करने के लिए है, जिससे डिजिटल अभियानों में पारदर्शिता और मतदाता जागरूकता बढ़ती है।

Elyas Meguellati, Stefano Civelli, Pietro Bernardelle, Shazia Sadiq, Irwin King, Gianluca Demartini2026-05-29
⚡ electrical engineering

Survey of End-to-End Multi-Speaker Automatic Speech Recognition for Monaural Audio

यह सर्वेक्षण एकल-चैनल बहु-वक्ता स्वचालित भाषण पहचान (मोनोरल मल्टी-स्पीकर एएसआर) के लिए एंड-टू-एंड न्यूरल दृष्टिकोणों की एक व्यापक समीक्षा और व्यवस्थित वर्गीकरण प्रदान करता है, जो वास्तुशिल्प प्रतिमानों, हालिया एल्गोरिदम सुधारों, दीर्घ-रूप भाषण विस्तारों और बेंचमार्क प्रदर्शन का विश्लेषण करते हुए भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।

Xinlu He, Jacob Whitehill2026-05-29
🤖 AI

PersonaAgent: Bridging Memory and Action for Personalized LLM Agents

यह शोध पत्र PersonaAgent प्रस्तुत करता है, जो एक नवीन ढांचा है जो गतिशील उपयोगकर्ता व्यक्तित्वों (dynamic user personas) द्वारा निर्देशित व्यक्तिगत स्मृति और क्रिया मॉड्यूल को एकीकृत करके लार्ज लैंग्वेज मॉडल एजेंटों को उन्नत करता है, जिससे एक टेस्ट-टाइम ऑप्टिमाइज़ेशन रणनीति के माध्यम से बेहतर वास्तविक समय प्राथमिकता संरेखण और अनुकूलित प्रदर्शन प्राप्त होता है।

Weizhi Zhang, Xinyang Zhang, Chenwei Zhang, Liangwei Yang, Jingbo Shang, Zhepei Wei, Henry Peng Zou, Zijie Huang, Zhengy (…)2026-05-29
🤖 AI

Position: Text Embeddings Should Capture Implicit Semantics, Not Just Surface Meaning

यह स्थिति पत्र (position paper) तर्क देता है कि टेक्स्ट एम्बेडिंग अनुसंधान को भाषाई रूप से आधारित डेटा, गहरे मूल्यांकन बेंचमार्क और एक मुख्य मॉडलिंग उद्देश्य को अपनाकर सतही अर्थों (surface-level semantics) से हटकर निहित अर्थों—जैसे कि प्रासंगिकता (pragmatics) और वक्ता के इरादे—को पकड़ने पर अपना ध्यान केंद्रित करना चाहिए जो वास्तविक दुनिया की भाषाई जटिलता को बेहतर ढंग से प्रतिबिंबित करता हो।

Yiqun Sun, Qiang Huang, Anthony K. H. Tung, Jun Yu2026-05-29
🤖 AI

GroundAct: Can LLM Agents Ground Actions in Environmental States?

यह शोधपत्र GroundAct प्रस्तुत करता है, जो एक व्यापक बेंचमार्क है यह प्रदर्शित करता है कि जब निर्देश व्यवहार्यता विवरणों को छोड़ देते हैं, तो LLM एजेंट पर्यावरणीय अवस्थाओं में कार्यों को ग्राउंड करने में संघर्ष करते हैं, जिससे यह उजागर होता है कि इस बहुआयामी चुनौती को केवल स्केलिंग के माध्यम से हल नहीं किया जा सकता है और इसके लिए विशेषता (attribute), टूल और समन्वय (coordination) तर्क में विशिष्ट क्षमताओं की आवश्यकता होती है।

Zixuan Wang, Dingming Li, Hongxing Li, Yanrui Miao, Shuo Chen, Yuchen Yan, Wenqi Zhang, Yongliang Shen, Weiming Lu, Jun (…)2026-05-29