💬 NLP

LeWiDi-2025 at NLPerspectives: Third Edition of the Learning with Disagreements Shared Task

NLPerspectives में LeWiDi साझा कार्य (shared task) का तीसरा संस्करण चार विविध NLP कार्यों के साथ बेंचमार्क का विस्तार करके, नवीन मेट्रिक्स के साथ सॉफ्ट-लेबल और पर्सपेक्टिविस्ट मूल्यांकन प्रतिमानों को पेश करके, और मानव निर्णय भिन्नता के मॉडलिंग में नए संसाधनों और अंतर्दृष्टि प्रदान करके असहमति-जागरूक AI के विकास को आगे बढ़ाता है।

Elisa Leonardelli, Silvia Casola, Siyao Peng, Giulia Rizzi, Valerio Basile, Elisabetta Fersini, Diego Frassinelli, Hyewo (…)2026-02-09
💬 NLP

Personalized Learning Path Planning with Goal-Driven Learner State Modeling

यह शोध पत्र Pxplore प्रस्तुत करता है, जो एक नवीन ढांचा है जो शिक्षार्थी की अवस्थाओं को मॉडल करने और सुपरवाइज्ड फाइन-ट्यूनिंग एवं ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइज़ेशन के माध्यम से नीतियों को अनुकूलित करके व्यक्तिगत, लक्ष्य-संचालित शिक्षण पथ उत्पन्न करने के लिए सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) को बड़े भाषा मॉडलों के साथ जोड़ता है।

Joy Jia Yin Lim, Ye He, Jifan Yu, Xin Cong, Daniel Zhang-Li, Zhiyuan Liu, Huiqin Liu, Lei Hou, Juanzi Li, Bin Xu2026-02-09
💬 NLP

Quantifying the Effect of Test Set Contamination on Generative Evaluations

यह शोध पत्र मात्रात्मक रूप से प्रदर्शित करता है कि टेस्ट सेट संदूषण (contamination) जनरेटिव मूल्यांकन प्रदर्शन को महत्वपूर्ण रूप से बढ़ा देता है क्योंकि यह मॉडलों को याद रखने (memorization) के माध्यम से अपरिहार्य त्रुटि (irreducible error) से ऊपर जाने में सक्षम बनाता है, जबकि यह भी प्रकट करता है कि मॉडल का आकार, प्रशिक्षण की अवधि और इन्फरेंस तापमान जैसे कारक इन प्रभावों को उन तरीकों से महत्वपूर्ण रूप से नियंत्रित करते हैं जो डिस्क्रिमिनेटिव मूल्यांकन से भिन्न हैं।

Rylan Schaeffer, Joshua Kazdan, Baber Abbasi, Ken Ziyu Liu, Brando Miranda, Ahmed Ahmed, Fazl Berez, Abhay Puri, Stella (…)2026-02-09
💬 NLP

Think-Augmented Function Calling: Improving LLM Parameter Accuracy Through Embedded Reasoning

यह शोध पत्र थिंक-ऑगमेंटेड फंक्शन कॉलिंग (TAFC) का प्रस्ताव करता है, जो एक नवीन ढांचा है जो बिना किसी आर्किटेक्चरल संशोधन की आवश्यकता के, पैरामीटर जनरेशन में सीधे स्पष्ट, गतिशील तर्क को समाहित करके LLM फंक्शन कॉलिंग की सटीकता और व्याख्यात्मकता को बढ़ाता है।

Lei Wei, Xiao Peng, Jinpeng Ou, Bin Wang2026-02-09
💬 NLP

FadeMem: Biologically-Inspired Forgetting for Efficient Agent Memory

यह शोध पत्र FadeMem को प्रस्तुत करता है, जो एक जैविक रूप से प्रेरित एजेंट मेमोरी आर्किटेक्चर है जो अप्रासंगिक जानकारी को चुनिंदा रूप से भूलने के लिए एडेप्टिव एक्सपोनेंशियल डिके (adaptive exponential decay) और एक द्वि-स्तरीय पदानुक्रम का उपयोग करता है, जिससे पारंपरिक बाइनरी रिटेंशन रणनीतियों की तुलना में भंडारण में 45% की कमी के साथ बेहतर मल्टी-हॉप रीजनिंग और रिट्रीवल प्रदर्शन प्राप्त होता है।

Lei Wei, Xiao Peng, Xu Dong, Niantao Xie, Bin Wang2026-02-09
💬 NLP

DimStance: Multilingual Datasets for Dimensional Stance Analysis

यह शोध पत्र DimStance को प्रस्तुत करता है, जो पांच भाषाओं में 7,365 ग्रंथों के लिए वैलेंस-अराउज़ल (valence-arousal) एनोटेशन वाला पहला बहुभाषी डेटासेट है, ताकि सूक्ष्म-स्तरीय आयामी रुख (dimensional stance) विश्लेषण को सक्षम बनाया जा सके और इन भावनात्मक अवस्थाओं की भविष्यवाणी करने में विभिन्न मॉडलों के प्रदर्शन को बेंचमार्क किया जा सके।

Jonas Becker, Liang-Chih Yu, Shamsuddeen Hassan Muhammad, Jan Philip Wahle, Terry Ruas, Idris Abdulmumin, Lung-Hao Lee (…)2026-02-09
💬 NLP

MAGIC: A Co-Evolving Attacker-Defender Adversarial Game for Robust LLM Safety

यह शोध पत्र MAGIC को प्रस्तुत करता है, जो एक नवीन मल्टी-टर्न मल्टी-एजेंट सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो एक सह-विकसित (co-evolving) प्रतिकूल खेल के माध्यम से लार्ज लैंग्वेज मॉडल की सुरक्षा को बढ़ाता है, जहाँ एक हमलावर एजेंट कमजोरियों को उजागर करने के लिए गतिशील रूप से नवीन संयोजी रणनीतियाँ उत्पन्न करता है, जिससे एक डिफेंडर एजेंट को अनदेखी प्रतिकूल इनपुट को सामान्य बनाने और मजबूती से अस्वीकार करने के लिए प्रेरित किया जाता है।

Xiaoyu Wen, Zhida He, Han Qi, Ziyu Wan, Zhongtian Ma, Ying Wen, Tianhang Zheng, Xingcheng Xu, Chaochao Lu, Qiaosheng Zha (…)2026-02-09
⚡ electrical engineering

Benchmarking Automatic Speech Recognition for Indian Languages in Agricultural Contexts

यह शोध पत्र हिंदी, तेलुगु और ओडिया में कृषि संदर्भों में स्वचालित वाक् पहचान (ऑटोमैटिक स्पीच रिकग्निशन) के लिए एक बेंचमार्किंग ढांचा स्थापित करता है, जो डोमेन-विशिष्ट मेट्रिक्स पेश करता है और यह प्रदर्शित करता है कि स्पीकर डायराइजेशन प्रदर्शन में महत्वपूर्ण सुधार करता है, जबकि कम-संसाधन वाली भाषाओं और फील्ड ऑडियो की गुणवत्ता की चुनौतियों को भी उजागर करता है।

Chandrashekar M S, Vineet Singh, Lakshmi Pedapudi2026-02-09
💬 NLP

Back to Basics: Revisiting Exploration in Reinforcement Learning for LLM Reasoning via Generative Probabilities

यह शोध पत्र ProGRPO का प्रस्ताव करता है, जो एक नवीन सुदृढीकरण शिक्षण (Reinforcement Learning) दृष्टिकोण है जो विविध सही समाधानों के बीच आत्मविश्वास को संतुलित करने के लिए रिवॉर्ड संकेतों को गतिशील रूप से नया आकार देकर मोड कोलैप्स (mode collapse) को कम करने और LLM तर्क क्षमता में अन्वेषण (exploration) को बढ़ाने के लिए एक एडवांटेज री-वेटिंग मैकेनिज्म (Advantage Re-weighting Mechanism) का उपयोग करता है, जिससे गणितीय और कोडिंग बेंचमार्क पर सटीकता और जनरेटिव विविधता दोनों में महत्वपूर्ण सुधार होता है।

Pengyi Li, Elizaveta Goncharova, Andrey Kuznetsov, Ivan Oseledets2026-02-09
💬 NLP

Causal Front-Door Adjustment for Robust Jailbreak Attacks on LLMs

यह शोध पत्र कॉज़ल फ्रंट-डोर एडजस्टमेंट अटैक (CFA²) का प्रस्ताव करता है, जो एक नवीन जेलब्रेकिंग फ्रेमवर्क है जो सुरक्षा तंत्रों को अनऑब्जर्व्ड कन्फाउंडर्स के रूप में मॉडल करता है और पर्ल के फ्रंट-डोर क्राइटेरियन के माध्यम से डिफेंस फीचर्स को हटाने के लिए स्पार्स ऑटोएनकोडर्स का उपयोग करता है, जिससे कम इन्फरेंस कॉम्प्लेक्सिटी के साथ स्टेट-ऑफ-द-आर्ट अटैक सक्सेस रेट प्राप्त होता है।

Yao Zhou, Zeen Song, Wenwen Qiang, Fengge Wu, Shuyi Zhou, Changwen Zheng, Hui Xiong2026-02-09