💬 NLP

Reinforced Curriculum Pre-Alignment for Domain-Adaptive VLMs

यह शोध पत्र रिइन्फोर्स्ड करिकुलम प्री-अलाइनमेंट (RCPA) का प्रस्ताव करता है, जो एक नवीन पोस्ट-ट्रेनिंग प्रतिमान (पैराडाइम) है जो विजन-लैंग्वेज मॉडल्स को विशिष्ट डोमेन के अनुकूल बनाने के लिए एक करिकुलम-अवेयर प्रोग्रेसिव मॉड्यूलेशन मैकेनिज्म का उपयोग करता है, जबकि कैटास्ट्रोफिक फॉरगेटिंग और ऑप्टिमाइजेशन कोलैप्स को रोकता है।

Yuming Yan, Shuo Yang, Kai Tang, Sihong Chen, Yang Zhang, Ke Xu, Dan Hu, Qun Yu, Pengfei Hu, Edith C. H. Ngai2026-02-12
💬 NLP

Beyond Confidence: The Rhythms of Reasoning in Generative Models

यह शोध पत्र टोकन कंस्ट्रेंट बाउंड (δTCB\delta_{\mathrm{TCB}}) का परिचय देता है, जो एक नया मीट्रिक है जो यह मापने के माध्यम से एक LLM की आंतरिक भविष्य कहने वाली प्रतिबद्धता (predictive commitment) की स्थिरता को परिमाणित करता है कि एक मॉडल का शीर्ष टोकन अनुमान बदलने से पहले वह कितना इनपुट व्यवधान (input perturbation) सहन कर सकता है, जो पारंपरिक मेट्रिक्स जैसे कि परप्लेक्सिटी (perplexity) की तुलना में प्रासंगिक विश्वसनीयता का आकलन करने का एक अधिक सुदृढ़ तरीका प्रदान करता है।

Deyuan Liu, Zecheng Wang, Zhanyue Qin, Zhiying Tu, Dianhui Chu, Dianbo Sui2026-02-12
💬 NLP

Diagnosing Structural Failures in LLM-Based Evidence Extraction for Meta-Analysis

यह शोध पत्र एक नैदानिक ढांचे (diagnostic framework) को प्रस्तुत करता है जो यह प्रदर्शित करता है कि यद्यपि LLMs बुनियादी इकाई निष्कर्षण (entity extraction) करने में सक्षम हैं, फिर भी वे मेटा-विश्लेषण के लिए आवश्यक जटिल संबंधात्मक बंधन (relational binding) और संख्यात्मक ग्राउंडिंग (numerical grounding) में काफी विफल रहते हैं, जिससे व्यवस्थित संरचनात्मक त्रुटियां उत्पन्न होती हैं जो स्वचालित साक्ष्य निष्कर्षण को अविश्वसनीय बना देती हैं।

Zhiyin Tan, Jennifer D'Souza2026-02-12
💬 NLP

The CLEF-2026 FinMMEval Lab: Multilingual and Multimodal Evaluation of Financial AI Systems

CLEF-2026 FinMMEval Lab विविध भाषाओं और प्रारूपों में तर्क (reasoning), प्रश्नोत्तर (question answering) और निर्णय लेने (decision-making) की क्षमताओं का आकलन करने के लिए डिज़ाइन किए गए तीन परस्पर जुड़े कार्यों के माध्यम से वित्तीय लार्ज लैंग्वेज मॉडल्स (LLMs) के लिए पहला बहुभाषी और बहुआयामी (multimodal) मूल्यांकन ढांचा प्रस्तुत करता है।

Zhuohan Xie, Rania Elbadry, Fan Zhang, Georgi Georgiev, Xueqing Peng, Lingfei Qian, Jimin Huang, Dimitar Dimitrov, Vansh (…)2026-02-12
💬 NLP

Rotary Positional Embeddings as Phase Modulation: Theoretical Bounds on the RoPE Base for Long-Context Transformers

यह शोध पत्र रोटरी पोजीशनल एम्बेडिंग्स (RoPE) को फेज मॉड्यूलेशन के रूप में पुनर्व्याख्या करता है ताकि RoPE बेस पैरामीटर पर सैद्धांतिक निम्नतम और उच्चतम सीमाएँ प्राप्त की जा सकें, जो परिशुद्धता और गहराई के एक "गोल्डिलॉक्स ज़ोन" को स्थापित करता है जो दीर्घ-संदर्भ मॉडलिंग (long-context modeling) की व्यवहार्यता को निर्धारित करता है।

Feilong Liu2026-02-12
💬 NLP

Can Large Language Models Make Everyone Happy?

यह शोध पत्र **MisAlign-Profile** को प्रस्तुत करता है, जो **MISALIGNTRADE** डेटासेट से युक्त एक एकीकृत बेंचमार्क है, जिसे लार्ज लैंग्वेज मॉडल्स (Large Language Models) में सुरक्षा, मूल्य और सांस्कृतिक आयामों के बीच जटिल ट्रेड-ऑफ्स को व्यवस्थित रूप से मापने और उनका लक्षण वर्णन करने के लिए डिज़ाइन किया गया है।

Usman Naseem, Gautam Siddharth Kashyap, Ebad Shabbir, Sushant Kumar Ray, Abdullah Mohammad, Rafiq Ali2026-02-12
💬 NLP

Can LLMs Automate Fact-Checking Article Writing?

यह शोध पत्र QRAFT को प्रस्तुत करता है, जो एक LLM-आधारित एजेंटिक फ्रेमवर्क है जिसे मानव कार्यप्रवाहों की नकल करके पूर्ण तथ्य-जांच (fact-checking) लेखों के निर्माण को स्वचालित करने के लिए डिज़ाइन किया गया है, और विशेषज्ञ मानव मूल्यांकन के माध्यम से इसके प्रदर्शन का मूल्यांकन करता है।

Dhruv Sahnan, David Corney, Irene Larraz, Giovanni Zagni, Ruben Miguez, Zhuohan Xie, Iryna Gurevych, Elizabeth Churchill (…)2026-02-11
💬 NLP

Cochain: Balancing Insufficient and Excessive Collaboration in LLM Agent Workflows

कोचेन (Cochain) एक सहयोगपूर्ण प्रॉम्प्टिंग फ्रेमवर्क है जो एक बहु-चरणीय नॉलेज ग्राफ और एक प्रॉम्प्ट ट्री को एकीकृत करके व्यावसायिक वर्कफ़्लो को अनुकूलित करता है, जो प्रभावी रूप से टोकन लागत और जटिलता को कम करते हुए चेन-ऑफ-थॉट की तर्क गहराई और मल्टी-एजेंट सिस्टम की सामूहिक बुद्धिमत्ता के बीच संतुलन बनाता है।

Jiaxing Zhao, Hongbin Xie, Yuzhen Lei, Xuan Song, Zhuoran Shi, Lianxin Li, Shuangxue Liu, Linguo Xie, Haoran Zhang2026-02-11
💬 NLP

Decoding Phone Pairs from MEG Signals Across Speech Modalities

यह अध्ययन प्रदर्शित करता है कि मैग्नेटोएन्सेफालोग्राफी (MEG) संकेत निष्क्रिय श्रवण की तुलना में प्रत्यक्ष वाक् उत्पादन के दौरान ध्वन्यात्मक युग्मों को अधिक सटीक रूप से डिकोड कर सकते हैं, जिसमें निम्न-आवृत्ति दोलन और इलास्टिक नेट जैसे नियमितीकृत रैखिक मॉडल डिकोडिंग के लिए सबसे प्रभावी सिद्ध होते हैं।

Xabier de Zuazo, Eva Navas, Ibon Saratxaga, Mathieu Bourguignon, Nicola Molinaro2026-02-11
💬 NLP

MAPS: A Multilingual Benchmark for Agent Performance and Security

MAPS एक नया बहुभाषी बेंचमार्क सुइट है जो चार प्रमुख बेंचमार्क (GAIA, SWE-Bench, MATH, और Agent Security) से कार्यों का अनुवाद करके ग्यारह भाषाओं में एजेंटिक एआई प्रणालियों के प्रदर्शन और सुरक्षा का मूल्यांकन करता है, जिससे यह प्रकट होता है कि अंग्रेजी से अन्य भाषाओं में संक्रमण करने से अक्सर विश्वसनीयता में गिरावट आती है और सुरक्षा जोखिम बढ़ जाते हैं।

Omer Hofman, Jonathan Brokman, Oren Rachmil, Shamik Bose, Vikas Pahuja, Toshiya Shimizu, Trisha Starostina, Kelly Marchi (…)2026-02-11