💬 NLP

SPARTA: Scalable and Principled Benchmark of Tree-Structured Multi-hop QA over Text and Tables

यह शोध पत्र SPARTA को प्रस्तुत करता है, जो एक स्केलेबल और सिद्धांतवादी ढांचा है जो गहरे मल्टी-हॉप रीजनिंग और जटिल एग्रीगेशन के साथ बड़े पैमाने पर, उच्च-निष्ठा वाले टेबल-टेक्स्ट प्रश्न उत्तर बेंचमार्क को स्वचालित रूप से उत्पन्न करता है, जो मौजूदा बेंचमार्क की तुलना में वर्तमान अत्याधुनिक मॉडलों के प्रदर्शन में महत्वपूर्ण अंतराल को प्रकट करता है।

Sungho Park, Jueun Kim, Wook-Shin Han2026-02-27
⚡ electrical engineering

A Mixture-of-Experts Model for Multimodal Emotion Recognition in Conversations

यह शोध पत्र MiSTER-E का प्रस्ताव करता है, जो एक मॉड्यूलर मिक्सचर-ऑफ-एक्सपर्ट्स फ्रेमवर्क है जो फाइन-ट्यून्ड स्पीच और टेक्स्ट एलएलएम (LLMs) का उपयोग करके मोडैलिटी-विशिष्ट संदर्भ मॉडलिंग को मल्टीमॉडल फ्यूजन से अलग करता है, और स्पीकर आइडेंटिटी पर निर्भर हुए बिना तीन बेंचमार्क इमोशन रिकग्निशन डेटासेट्स पर स्टेट-ऑफ-द-आर्ट प्रदर्शन प्राप्त करता है।

Soumya Dutta, Smruthi Balaji, Sriram Ganapathy2026-02-27
💬 NLP

Scale Can't Overcome Pragmatics: The Impact of Reporting Bias on Vision-Language Reasoning

यह शोध पत्र तर्क देता है कि विजन-लैंग्वेज मॉडल्स की तर्क करने की सीमाएं प्रशिक्षण डेटा में मौजूद एक रिपोर्टिंग बायस (reporting bias) से उत्पन्न होती हैं जो अंतर्निहित सूचनाओं को छोड़ देता है, यह प्रदर्शित करते हुए कि केवल मॉडल या डेटा के आकार को बढ़ाना इस समस्या को दूर नहीं कर सकता और सुधार के लिए ऐसे विवरणों को कैप्चर करने वाले एनोटेशन का जानबूझकर क्यूरेशन करना आवश्यक है।

Amita Kamath, Jack Hessel, Khyathi Chandu, Jena D. Hwang, Kai-Wei Chang, Ranjay Krishna2026-02-27
💬 NLP

The Dark Side of ChatGPT: Legal and Ethical Challenges from Stochastic Parrots and Hallucination

यह शोध पत्र तर्क देता है कि जबकि यूरोपीय संघ एआई विनियमन में अग्रणी है, इसका वर्तमान प्रतिमान लार्ज लैंग्वेज मॉडल के मतिभ्रम (hallucinations) और स्टोकेस्टिक पैरट (stochastic parrot) व्यवहारों से उत्पन्न कानूनी और नैतिक जोखिमों को कम आंकता है, जिसके लिए इन उभरती चुनौतियों को प्रभावी ढंग से कम करने हेतु और अधिक विकास की आवश्यकता है।

Zihao Li2026-02-26
💬 NLP

Emergence of a phonological bias in ChatGPT

यह शोध पत्र यह प्रदर्शित करता है कि ChatGPT एक मानव-समान ध्वन्यात्मक पूर्वाग्रह प्रदर्शित करता है, जिसमें वह विभिन्न भाषाओं में शब्दों की पहचान करने के लिए स्वरों की तुलना में व्यंजनों का प्राथमिकता से उपयोग करता है, जो यह सुझाव देता है कि मानव भाषा अधिग्रहण की तुलना में अपने भिन्न प्रशिक्षण तंत्र के बावजूद ऐसे संज्ञानात्मक गुण बड़े भाषा मॉडलों (large language models) में उभर सकते हैं।

Juan Manuel Toro2026-02-26
💬 NLP

Breaking the HISCO Barrier: Automatic Occupational Standardization with OccCANINE

यह शोध पत्र OccCANINE को प्रस्तुत करता है, जो 15.8 मिलियन बहुभाषी डेटा युग्मों (data pairs) पर फाइन-ट्यून किया गया एक ओपन-सोर्स टूल है जो 96% सटीकता के साथ व्यावसायिक विवरणों को HISCO और अन्य वर्गीकरण प्रणालियों में मैप करने की प्रक्रिया को स्वचालित करता है, जिससे धीमी मैनुअल कोडिंग का स्थान मिलता है और आर्थिक अनुसंधान के लिए उच्च-गुणवत्ता वाले व्यावसायिक डेटा तक पहुंच का लोकतंत्रीकरण होता है।

Christian Møller Dahl, Torben Johansen, Christian Vedel2026-02-26
💬 NLP

PACE: Procedural Abstractions for Communicating Efficiently

यह शोध पत्र PACE को प्रस्तुत करता है, जो एक न्यूरो-सिंबोलिक फ्रेमवर्क है जो लाइब्रेरी लर्निंग, न्यूरल कम्युनिकेशन और बैंडिट एल्गोरिदम को संयोजित करता है ताकि AI एजेंटों को कार्य-उन्मुख संचार के लिए कुशल, मानव-समान प्रक्रियात्मक अमूर्तता (procedural abstractions) विकसित करने में सक्षम बनाया जा सके।

Jonathan D. Thomas, Andrea Silvi, Devdatt Dubhashi, Moa Johansson2026-02-26
💬 NLP

Renaissance: Investigating the Pretraining of Vision-Language Encoders

यह शोध पत्र 'रेनेसां' (Renaissance) का परिचय देता है, जो एक लचीला विजन-लैंग्वेज मूल्यांकन ढांचा है, ताकि मेटा-विश्लेषण के माध्यम से यह प्रदर्शित किया जा सके कि प्रीट्रेनिंग के दौरान मॉडल के बड़े हिस्सों को फ्रीज करने से प्रदर्शन पर न्यूनतम प्रभाव के साथ कंप्यूट लागत में काफी कमी आती है और यह जांचा जा सके कि विजन या टेक्स्ट मॉडल्स में से किसी एक से विजन-लैंग्वेज ट्रांसफॉर्मर्स को इनिशियलाइज़ करने के क्या प्रभाव होते हैं।

Clayton Fields, Casey Kennington2026-02-26
💬 NLP

MathFimer: Enhancing Mathematical Reasoning by Expanding Reasoning Steps through Fill-in-the-Middle Task

यह शोध पत्र MathFimer को प्रस्तुत करता है, जो एक नवीन ढांचा है जो बड़े भाषा मॉडलों (large language models) की गणितीय तर्क क्षमता को एक "फिल-इन-द-मिडल" (Fill-in-the-middle) कार्य के माध्यम से लुप्त मध्यवर्ती चरणों को पुनर्गठित करने के लिए प्रशिक्षित करके बढ़ाता है, जिससे विस्तारित डेटासेट उत्पन्न होते हैं जो शक्तिशाली बाहरी मॉडलों या उच्च कम्प्यूटेशनल लागतों पर निर्भर किए बिना GSM8K और MATH जैसे बेंचमार्क पर प्रदर्शन में सुधार करते हैं।

Yuchen Yan, Yongliang Shen, Yang Liu, Jin Jiang, Xin Xu, Mengdi Zhang, Jian Shao, Yueting Zhuang2026-02-26
💬 NLP

VOILA: Evaluation of MLLMs For Perceptual Understanding and Analogical Reasoning

यह शोध पत्र VOILA को प्रस्तुत करता है, जो एक गतिशील बेंचमार्क है जो दृश्य उपमाओं (visual analogies) के माध्यम से अमूर्त संबंधात्मक तर्क करने की मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स की क्षमता का मूल्यांकन करता है, और यह प्रकट करता है कि मल्टी-स्टेप प्रॉम्प्टिंग रणनीतियों से सुधार के बावजूद, वर्तमान मॉडल मानव प्रदर्शन की तुलना में छवियों के बीच के संबंधों को समझने में काफी संघर्ष करते हैं।

Nilay Yilmaz, Maitreya Patel, Yiran Lawrence Luo, Tejas Gokhale, Chitta Baral, Suren Jayasuriya, Yezhou Yang2026-02-26