⚡ electrical engineering

Task-Lens: Cross-Task Utility Based Speech Dataset Profiling for Low-Resource Indian Languages

यह शोध पत्र 'टास्क-लेंस' (Task-Lens) प्रस्तुत करता है, जो एक व्यापक क्रॉस-टास्क सर्वेक्षण है जो अनछुए मेटाडेटा की पहचान करने, सुधारों का प्रस्ताव देने और कम-संसाधन वाली स्पीच टेक्नोलॉजी संसाधनों में महत्वपूर्ण कमियों को उजागर करने के लिए 26 भाषाओं और नौ डाउनस्ट्रीम कार्यों के across 50 भारतीय स्पीच डेटासेट का प्रोफाइल तैयार करता है।

Swati Sharma, Divya V. Sharma, Anubha Gupta2026-03-02
💬 NLP

FHIRPath-QA: Executable Question Answering over FHIR Electronic Health Records

यह शोधपत्र FHIRPath-QA प्रस्तुत करता है, जो एक खुला डेटासेट और बेंचमार्क है जो बड़े भाषा मॉडल (LLM) की तर्क प्रक्रिया को मुक्त-पाठ निर्माण (free-text generation) से निष्पादन योग्य FHIRPath क्वेरी के संश्लेषण की ओर स्थानांतरित करके इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड पर सुरक्षित और कुशल रोगी-विशिष्ट प्रश्न उत्तर सक्षम बनाता है।

Michael Frew, Nishit Bheda, Bryan Tripp2026-03-02
💬 NLP

Humans and LLMs Diverge on Probabilistic Inferences

यह शोध पत्र ProbCOPA को प्रस्तुत करता है, जो मानव निर्णयों के साथ एनोटेट की गई संभाव्य अनुमानों (probabilistic inferences) का एक डेटासेट है, यह प्रदर्शित करने के लिए कि अत्याधुनिक रीजनिंग वाले LLMs निरंतर मानव संभाव्य तर्क की क्रमिक और विविध प्रकृति की नकल करने में विफल रहते हैं, जो नियतात्मक कार्यों (deterministic tasks) से परे मॉडलों के मूल्यांकन के लिए एक महत्वपूर्ण अंतर को उजागर करता है।

Gaurav Kamath, Sreenath Madathil, Sebastian Schuster, Marie-Catherine de Marneffe, Siva Reddy2026-03-02
💬 NLP

France or Spain or Germany or France: A Neural Account of Non-Redundant Redundant Disjunctions

यह शोध पत्र संदर्भ-संवेदनशील गैर-अनावश्यक विसंयोजकों (non-redundant disjunctions) का एक तंत्रिका संबंधी विवरण (neural account) प्रदान करता है, जो व्यवहार संबंधी साक्ष्यों और भाषा मॉडलों के विश्लेषण के माध्यम से यह प्रदर्शित करता है कि पुनरावृत्त शाब्दिक वस्तुओं के प्रासंगिक बंधन (contextual binding) और ट्रांसफॉर्मर इंडक्शन हेड्स (Transformer induction heads) द्वारा चयनात्मक ध्यान के बीच की अंतःक्रिया से अनावश्यकता परिहार (redundancy avoidance) उत्पन्न होता है।

Sasha Boguraev, Qing Yao, Kyle Mahowald2026-03-02
💬 NLP

LFQA-HP-1M: A Large-Scale Human Preference Dataset for Long-Form Question Answering

यह शोध पत्र LFQA-HP-1M प्रस्तुत करता है, जो लॉन्ग-फॉर्म क्वेश्चन आंसरिंग के लिए 1.3 मिलियन मानव प्राथमिकता एनोटेशन का एक बड़े पैमाने का डेटासेट है, साथ ही एक रूब्रिक-संचालित ढांचा भी प्रदान करता है जो सरल रैखिक मॉडलों को अत्याधुनिक LLM मूल्यांकनकर्ताओं के बराबर लाने में सक्षम बनाता है और साथ ही पूर्वाग्रहों और प्रतिकूल हमलों के प्रति बाद वाले की कमजोरियों को भी उजागर करता है।

Rafid Ishrak Jahan, Fahmid Shahriar Iqbal, Sagnik Ray Choudhury2026-03-02
💬 NLP

LLM-Driven Multi-Turn Task-Oriented Dialogue Synthesis for Realistic Reasoning

यह शोध पत्र एक LLM-संचालित ढांचे का प्रस्ताव करता है जो यथार्थवादी, बहु-चरणीय कार्य-उन्मुख संवादों और पुनरावृत्ति रूप से परिष्कृत तर्क कार्यों को संश्लेषित करने के लिए त्रि-स्तरीय अनुकूलन (trilevel optimization) का उपयोग करता है, जिससे बड़े भाषा मॉडलों की तार्किक तर्क क्षमताओं के मूल्यांकन और संवर्धन में मौजूदा बेंचमार्क की सीमाओं को संबोधित किया जा सके।

Yu Zhu, Kai Yang2026-03-02
💬 NLP

TRIZ-RAGNER: A Retrieval-Augmented Large Language Model for TRIZ-Aware Named Entity Recognition in Patent-Based Contradiction Mining

यह शोधपत्र TRIZ-RAGNER का प्रस्ताव करता है, जो एक रिट्रीवल-ऑगमेंटेड लार्ज लैंग्वेज मॉडल फ्रेमवर्क है जो पेटेंट ग्रंथों से विरोधाभास युग्मों (contradiction pairs) को निकालने की सटीकता और निरंतरता में महत्वपूर्ण सुधार करने के लिए एक TRIZ ज्ञान आधार पर डेंस रिट्रीवल और स्ट्रक्चर्ड प्रॉम्प्टिंग को एकीकृत करता है, जो मौजूदा नियम-आधारित, पारंपरिक मशीन लर्निंग और मानक LLM दृष्टिकोणों से बेहतर प्रदर्शन करता है।

Zitong Xu, Yuqing Wu, Yue Zhao2026-03-02
💬 NLP

From Static Benchmarks to Dynamic Protocol: Agent-Centric Text Anomaly Detection for Evaluating LLM Reasoning

यह शोध पत्र एक एजेंट-केंद्रित बेंचमार्किंग प्रतिमान (पैराडाइम) प्रस्तावित करता है जो स्थिर डेटासेट को स्वायत्त शिक्षक, ऑर्केस्ट्रेटर और छात्र एजेंटों वाले एक गतिशील प्रोटोकॉल से बदल देता है ताकि टेक्स्ट विसंगति पहचान (टेक्स्ट एनोमली डिटेक्शन) समस्याओं को पुनरावृत्ति के साथ उत्पन्न, मान्य और हल किया जा सके, जिससे एलएलएम (LLM) तर्क क्षमताओं के स्केलेबल और प्रगतिशील मूल्यांकन को सक्षम बनाया जा सके जो पारंपरिक बेंचमार्क द्वारा छूटी हुई कोने-केस त्रुटियों (कॉर्नर-केस एरर्स) को उजागर करता है।

Seungdong Yoa, Sanghyu Yoon, Suhee Yoon, Dongmin Kim, Ye Seul Sim, Junhyun Lee, Woohyung Lim2026-03-02
💬 NLP

Divide and Conquer: Accelerating Diffusion-Based Large Language Models via Adaptive Parallel Decoding

यह शोध पत्र DiCo को प्रस्तुत करता है, जो एक अनुकूली समानांतर डिकोडिंग ढांचा (adaptive parallel decoding framework) है जो डिफ्यूजन-आधारित लार्ज लैंग्वेज मॉडल्स में सैद्धांतिक और व्यावहारिक समानांतरता के बीच के अंतर को पाटने के लिए तीन-चरणीय विभाजित-और-जीतें (divide-and-conquer) रणनीति का उपयोग करता है ताकि जनरेशन की गुणवत्ता से समझौता किए बिना महत्वपूर्ण इन्फरेंस स्पीडअप प्राप्त किया जा सके।

Xiangzhong Luo, Yilin An, Zhicheng Yu, Weichen Liu, Xu Yang2026-03-02
💬 NLP

CLFEC: A New Task for Unified Linguistic and Factual Error Correction in paragraph-level Chinese Professional Writing

यह शोध पत्र CLFEC प्रस्तुत करता है, जो चीनी पेशेवर लेखन में एकीकृत भाषाई और तथ्यात्मक त्रुटि सुधार के लिए एक नया कार्य और डेटासेट है, जो व्यवस्थित LLM-आधारित प्रयोगों के माध्यम से यह प्रदर्शित करता है कि संयुक्त सुधार विखंडित दृष्टिकोणों की तुलना में बेहतर प्रदर्शन करता है और विश्वसनीय स्वचालित प्रूफरीडिंग सिस्टम बनाने के लिए एजेंटिक वर्कफ़्लो की प्रभावशीलता को रेखांकित करता है।

Jian Kai, Zidong Zhang, Jiwen Chen, Zhengxiang Wu, Songtao Sun, Fuyang Li, Yang Cao, Qiang Liu2026-03-02