⚡ electrical engineering

A Baseline Multimodal Approach to Emotion Recognition in Conversations

यह शोध पत्र SemEval-2024 टास्क 3 डेटासेट का उपयोग करके बातचीत में मल्टीमॉडल इमोशन रिकग्निशन के लिए एक हल्का, सुलभ बेसलाइन प्रस्तुत करता है, जो भविष्य की तुलनाओं के लिए एक पारदर्शी संदर्भ स्थापित करने हेतु लेट-फ्यूजन के माध्यम से एक ट्रांसफार्मर-आधारित टेक्स्ट क्लासिफायर और एक सेल्फ-सुपरवाइज्ड स्पीच मॉडल को जोड़ता है।

Víctor Yeste, Rodrigo Rivas-Arévalo2026-02-03
💬 NLP

Verification Required: The Impact of Information Credibility on AI Persuasion

यह शोध पत्र MixTalk प्रस्तुत करता है, जो LLM एजेंटों के बीच संभाव्य सूचना विश्वसनीयता (probabilistic information credibility) को मॉडल करने वाला एक रणनीतिक संचार ढांचा है, और उच्च-दांव वाले निर्णय लेने की स्थितियों में प्रलोभन (persuasion) के विरुद्ध रिसीवर की मजबूती को महत्वपूर्ण रूप से बढ़ाने के लिए टूर्नामेंट ओरैकल पॉलिसी डिस्टिलेशन (TOPD) का प्रस्ताव करता है।

Saaduddin Mahmud, Eugene Bagdasarian, Shlomo Zilberstein2026-02-03
💬 NLP

Trust in One Round: Confidence Estimation for Large Language Models via Structural Signals

यह शोध पत्र स्ट्रक्चरल कॉन्फिडेंस (Structural Confidence) को प्रस्तुत करता है, जो एक सिंगल-पास, मॉडल-अग्नोस्टिक फ्रेमवर्क है जो विविध डोमेन में मजबूत और कुशल कॉन्फिडेंस एस्टीमेशन प्रदान करने के लिए LLM हिडन स्टेट्स से मल्टी-स्केल स्ट्रक्चरल सिग्नल्स का लाभ उठाता है, और पारंपरिक प्रोबेबिलिटी-आधारित और सैंपलिंग-इंटेंसिव बेसलाइन्स से बेहतर प्रदर्शन करता है।

Pengyue Yang, Jiawen Wen, Haolin Jin, Linghan Huang, Huaming Chen, Ling Chen2026-02-03
💬 NLP

DeALOG: Decentralized Multi-Agents Log-Mediated Reasoning Framework

DeALOG एक विकेंद्रीकृत मल्टी-एजेंट फ्रेमवर्क है जो टेक्स्ट, टेबल्स और इमेजेस के माध्यम से टेक्स्ट, टेबल्स और इमेजेस में सुदृढ़, व्याख्या योग्य और प्रतिस्पर्धी मल्टीमॉडल प्रश्नोत्तर प्राप्त करने के लिए एक साझा प्राकृतिक-भाषा लॉग के माध्यम से संचारित होने वाले विशिष्ट एजेंटों का लाभ उठाता है।

Abhijit Chakraborty, Ashish Raj Shekhar, Shiven Agarwal, Vivek Gupta2026-02-03
⚡ electrical engineering

Adapting Where It Matters: Depth-Aware Adaptation for Efficient Multilingual Speech Recognition in Low-Resource Languages

यह शोध पत्र DAMA का प्रस्ताव करता है, जो एक डेप्थ-अवेयर अडैप्टेशन फ्रेमवर्क है जो कम-संसाधन वाली भाषाओं में अत्याधुनिक बहुभाषी स्पीच रिकग्निशन सटीकता प्राप्त करने के लिए एक U-आकार के लेयर एडेप्टेबिलिटी पैटर्न और SVD-आधारित इनिशियलाइजेशन का लाभ उठाता है, जो मौजूदा विधियों की तुलना में काफी कम प्रशिक्षित मापदंडों और बेहतर दक्षता के साथ आता है।

Yang Xiao, Eun-Jung Holden, Ting Dang2026-02-03
💬 NLP

HalluHard: A Hard Multi-Turn Hallucination Benchmark

यह शोध पत्र HalluHard को प्रस्तुत करता है, जो चार उच्च-जोखिम वाले डोमेन में एक चुनौतीपूर्ण मल्टी-टर्न हैलुसिनेशन बेंचमार्क है, जो एक स्वचालित वेब-सर्च-आधारित जजिंग पाइपलाइन का उपयोग करता है ताकि यह प्रकट किया जा सके कि सबसे उन्नत भाषा मॉडल भी जटिल संवाद सेटिंग्स में महत्वपूर्ण रूप से गैर-आधारित तथ्यात्मक दावे करना जारी रखते हैं।

Dongyang Fan, Sebastien Delsad, Nicolas Flammarion, Maksym Andriushchenko2026-02-03
💬 NLP

Discovering Process-Outcome Credit in Multi-Step LLM Reasoning

यह शोध पत्र एक नवीन सुदृढीकरण शिक्षण (reinforcement learning) ढांचे का प्रस्ताव करता है जो निरंतर पुरस्कार संकेतों के लिए स्टेप-वाइज मार्जिनल इंफॉर्मेशन गेन तंत्र, विलगित क्रेडिट असाइनमेंट के लिए एक डिकपल्ड मास्किंग रणनीति और एक ड्यूल-गेटेड एसएफटी (SFT) उद्देश्य को पेश करके मल्टी-स्टेप एलएलएम (LLM) तर्क को बढ़ाता है, जो सामूहिक रूप से GRPO जैसे बेसलाइन की तुलना में बेहतर सैंपल दक्षता, सटीकता और आउट-ऑफ-डिस्ट्रीब्यूशन मजबूती प्राप्त करता है।

Xiangwei Wang, Wei Wang, Ken Chen, Nanduni Nimalsiri, Saman Halgamuge2026-02-03
💬 NLP

From Utterance to Vividity: Training Expressive Subtitle Translation LLM via Adaptive Local Preference Optimization

यह शोध पत्र एक बहुदिशीय सबटाइटल समानांतर कॉर्पस और एडेप्टिव लोकल प्रेफरेंस ऑप्टिमाइज़ेशन (ALPO) पद्धति को पेश करके वर्टिकल डोमेन अनुवाद में लार्ज लैंग्वेज मॉडल्स की सीमाओं को संबोधित करता है, ताकि अभिव्यंजक और जीवंत सबटाइटल अनुवाद मॉडल प्रशिक्षित किए जा सकें जो बहुआयामी गुणवत्ता मूल्यांकनों में बेहतर प्रदर्शन प्राप्त करते हैं।

Chaoqun Cui, Shijing Wang, Liangbin Huang, Qingqing Gu, Zhaolong Huang, Xiao Zeng, Wenji Mao2026-02-03
💬 NLP

Tendem: A Hybrid AI+Human Platform

टेंडेम (Tendem) एक हाइब्रिड AI-मानव प्लेटफॉर्म है जो संरचित कार्यों के लिए स्वचालित एजेंटों और सत्यापन के लिए विशेषज्ञ मानव हस्तक्षेप का लाभ उठाता है, जिससे AI-मात्र या मानव-मात्र वर्कफ़्लो की तुलना में बेहतर गुणवत्ता और गति प्राप्त होती है, जबकि परिचालन लागत भी तुलनीय बनी रहती है।

Konstantin Chernyshev, Ekaterina Artemova, Viacheslav Zhukov, Maksim Nerush, Mariia Fedorova, Iryna Repik, Olga Shapoval (…)2026-02-03
💬 NLP

MarkovScale: Towards Optimal Sequential Scaling at Inference Time

यह शोधपत्र MarkovScale प्रस्तुत करता है, जो एक सिद्धांत-आधारित ढांचा है जो सैद्धांतिक इष्टतमता सीमाओं (optimality bounds) को प्राप्त करने के लिए अनुक्रमिक स्केलिंग को दो-अवस्था वाले मार्कोव प्रक्रिया के रूप में मॉडल करता है और सटीकता एवं दक्षता के बीच एक बेहतर संतुलन प्राप्त करता है, जो कई बेंचमार्क और मॉडलों में मौजूदा अत्याधुनिक विधियों से बेहतर प्रदर्शन करता है।

Youkang Wang, Jian Wang, Rubing Chen, Tianyi Zeng, Xiao-Yong Wei, Qing Li2026-02-03