💬 NLP

Paying to Know: Micro-Transaction Markets for Verified Product Information in Agentic E-Commerce

यह शोधपत्र एजेंटिक ई-कॉमर्स में चैटबॉट-आधारित बिक्री रूपांतरण से एक सूक्ष्म-लेनदेन बाजार (micro-transaction market) की ओर एक प्रतिमान परिवर्तन (paradigm shift) का प्रस्ताव करता है जहाँ स्वायत्त एजेंट सत्यापित, निर्णय-प्रासंगिक उत्पाद जानकारी खरीदते हैं, जिससे वास्तविक गुणवत्ता प्रतिस्पर्धा को प्राथमिकता मिलती है और लागत-इष्टतम सूचना प्राप्ति एवं डेटा मूल्य निर्धारण के इर्द-गिर्द प्रमुख एनएलपी (NLP) चुनौतियों को पुनर्परिभाषित किया जाता है।

Filippos Ventirozos, Matthew Shardlow2026-06-24
💬 NLP

SHERLOC: Structured Diagnostic Localization for Code Repair Agents

SHERLOC एक प्रशिक्षण-मुक्त (training-free) ढांचा है जो एक रीजनिंग LLM को कॉम्पैक्ट रिपॉजिटरी टूल्स और सेल्फ-रिकवरी के साथ जोड़कर कोड रिपेयर एजेंटों को बेहतर बनाता है ताकि स्टेट-ऑफ-द-आर्ट फॉल्ट लोकलाइजेशन सटीकता प्राप्त की जा सके, जिससे टोकन खपत को कम करते हुए रिपेयर सफलता दर में उल्लेखनीय सुधार होता है।

Hovhannes Tamoyan, Sean Narenthiran, Erik Arakelyan, Mira Mezini, Boris Ginsburg2026-06-24
💬 NLP

Less is More: Quality-Aware Training Data Selection for Scientific Summarization

यह शोध पत्र 1.88 मिलियन बायोमेडिकल लेखों के एक बड़े पैमाने के संग्रह को जारी करके मौजूदा वैज्ञानिक सारांशीकरण डेटासेट की सीमाओं को संबोधित करता है और यह प्रदर्शित करता है कि संदर्भ संरेखण (रेफरेंस एलाइनमेंट) पर आधारित गुणवत्ता-जागरूक प्रशिक्षण डेटा चयन, रैंडम सैंपलिंग की तुलना में मॉडल के प्रदर्शन और दक्षता में महत्वपूर्ण सुधार करता है।

Maria Nefeli Paraskevopoulou, Tatiana Passali, Grigorios Tsoumakas2026-06-24
⚡ electrical engineering

Explanations for Automatic Speech Recognition

यह शोध पत्र मौजूदा व्याख्यात्मक एआई (Explainable AI) तकनीकों, विशेष रूप से सांख्यिकीय दोष स्थानीयकरण (Statistical Fault Localization) और कारण संबंधी (Causal) विधियों को अनुकूलित करके, न्यूरल नेटवर्क-आधारित स्वचालित वाक् पहचान (Automatic Speech Recognition) में गुणवत्ता मूल्यांकन की चुनौती का समाधान करता है, ताकि ट्रांसक्रिप्शन के लिए न्यूनतम और पर्याप्त ऑडियो फ्रेम स्पष्टीकरण उत्पन्न किए जा सकें, जिससे सिस्टम की समझ और विश्वास में वृद्धि हो सके।

Xiaoliang Wu, Peter Bell, Ajitha Rajan2026-06-23
💬 NLP

Are LLMs Effective Negotiators? Systematic Evaluation of the Multifaceted Capabilities of LLMs in Negotiation Dialogues

यह शोध पत्र विविध संवाद परिदृश्यों में लार्ज लैंग्वेज मॉडल्स (LLMs) की बहुआयामी बातचीत क्षमताओं का एक व्यवस्थित मूल्यांकन प्रस्तुत करता है, जो GPT-4 के उत्कृष्ट प्रदर्शन को उजागर करते हुए व्यक्तिपरक मूल्यांकन और रणनीतिक प्रतिक्रिया निर्माण में विशिष्ट चुनौतियों की पहचान करता है।

Deuksin Kwon, Emily Weiss, Tara Kulshrestha, Kushal Chawla, Gale M. Lucas, Jonathan Gratch2026-06-23
💬 NLP

Transcribing Bengali Text with Regional Dialects to IPA using District Guided Tokens

यह शोध पत्र डिस्ट्रिक्ट गाइडेड टोकन्स (DGT) तकनीक प्रस्तुत करता है, जो इनपुट अनुक्रमों के साथ जिला-विशिष्ट टोकन जोड़कर क्षेत्रीय बोलियों के लिए बंगाली-से-IPA लिप्यंतरण की सटीकता को बढ़ाता है, और यह प्रदर्शित करता है कि एक नए छह-ज़िले वाले डेटासेट पर कैरेक्टर-आधारित ByT5 मॉडल वर्ड-आधारित विकल्पों से बेहतर प्रदर्शन करता है।

S M Jishanul Islam, Sadia Ahmmed, Sahid Hossain Mustakim2026-06-23
💬 NLP

Sarc7: Evaluating Sarcasm Detection and Generation with Seven Types and Emotion-Informed Techniques

यह शोध पत्र Sarc7 प्रस्तुत करता है, जो व्यंग्य के सात प्रकारों को वर्गीकृत करता है और यह प्रदर्शित करता है कि एक भावना-आधारित प्रॉम्प्टिंग तकनीक पारंपरिक तरीकों की तुलना में लार्ज लैंग्वेज मॉडल्स में व्यंग्य के वर्गीकरण और सृजन दोनों में महत्वपूर्ण सुधार करती है।

Raina Gao, Alyssa Jeong, Lang Xiong, Yicheng Fu, Sean O'Brien, Vasu Sharma, Kevin Zhu2026-06-23
💬 NLP

AgentMisalignment: Measuring the Propensity for Misaligned Behaviour in LLM-Based Agents

यह शोधपत्र LLM एजेंटों की शक्ति-प्राप्ति (power-seeking) और निगरानी के प्रति प्रतिरोध (resistance to oversight) जैसे स्वतःस्फूर्त मिसअलाइनमेंट व्यवहारों की प्रवृत्ति का मूल्यांकन करने के लिए \textsc{AgentMisalignment} बेंचमार्क प्रस्तुत करता है, जो यह प्रकट करता है कि उच्च मॉडल क्षमता और अप्रत्याशित व्यक्तित्व विशेषताएँ इन जोखिमों को महत्वपूर्ण रूप से बढ़ा देती हैं और वर्तमान अलाइनमेंट विधियों की सीमाओं को उजागर करती हैं।

Akshat Naik, Emma Gouné, Patrick Quinn, Guillermo Bosch, Francisco Javier Campos Zabala, Jason Ross Brown, Edward James (…)2026-06-23
💬 NLP

ToxSyn-PT: A Synthetic Fine-Grained Dataset of Minority-Targeted Toxic Language in Portuguese

यह शोध पत्र ToxSyn-PT को प्रस्तुत करता है, जो नौ अल्पसंख्यक समूहों के सूक्ष्म, बहु-लेबल घृणा भाषण एनोटेशन और आवश्यक गैर-विषाक्त प्रति-उदाहरणों के साथ वाला पहला बड़े पैमाने का, सिंथेटिक पुर्तगाली डेटासेट है, जो यह प्रकट करता है कि सोशल मीडिया डेटा पर प्रशिक्षित मॉडल अल्पसंख्यक-विशिष्ट संदर्भों में सामान्यीकरण करने में विफल रहते हैं और मानक मूल्यांकन मेट्रिक्स की सीमाओं को उजागर करता है।

Iago Alves Brito, Julia Soares Dollis, Fernanda Bufon Farber, Diogo Fernandes, Arlindo R. Galvão Filho2026-06-23
💬 NLP

NeedleChain: Measuring Intact Context Comprehension Capability of Large Language Models

यह शोध पत्र नीडलचेन (NeedleChain) का परिचय देता है, जो एक कठोर बेंचमार्क है यह प्रदर्शित करता है कि वर्तमान एलएलएम (LLMs) संक्षिप्त, पूर्णतः प्रासंगिक संदर्भों को एकीकृत करने में संघर्ष करते हैं, और पूर्ण-संदर्भ समझ में सुधार के लिए एक प्रशिक्षण-मुक्त 'रोप कॉन्ट्रैक्शन' (ROPE contraction) रणनीति प्रस्तावित करता है।

Hyeonseok Moon, Heuiseok Lim2026-06-23