💬 NLP

Echoes as Anchors: Probabilistic Costs and Attention Refocusing in LLM Reasoning

यह शोध पत्र एक ऐसे ढांचे को प्रस्तुत करता है जो बड़े तर्क मॉडल (large reasoning models) में स्वतःस्फूर्त "प्रॉम्प्ट की गूँज" (Echo of Prompt) घटना का उपयोग एक संभाव्य एंकर (probabilistic anchor) के रूप में करता है, इसकी लागत को औपचारिक रूप देता है और इस पुनरावृत्ति का लाभ उठाने के लिए प्रशिक्षण एवं प्रॉम्प्टिंग रणनीतियों को विकसित करता है, जिससे ध्यान को पुनः केंद्रित (attention refocusing) करने में मदद मिलती है, और इस प्रकार गणितीय बेंचमार्क में तर्क की सटीकता में सुधार होता है।

Zhuoyuan Hao, Zhuo Li, Wu Li, Fangming Liu, Min Zhang, Jing Li2026-02-09
💬 NLP

Not All Layers Need Tuning: Selective Layer Restoration Recovers Diversity

यह शोध पत्र सेलेक्टिव लेयर रेस्टोरेशन (SLR) का प्रस्ताव करता है, जो एक प्रशिक्षण-मुक्त विधि है जो विशिष्ट परतों को उनके प्री-ट्रेंड वेट्स में चुनिंदा रूप से पुनर्स्थापित करके पोस्ट-ट्रेंड लार्ज लैंग्वेज मॉडल्स में जनरेशन डाइवर्सिटी को पुनः प्राप्त करती है, जिससे विभिन्न कार्यों और मॉडल परिवारों में आउटपुट क्वालिटी को बनाए रखते हुए मोड कोलैप्स को कम किया जा सके।

Bowen Zhang, Meiyi Wang, Harold Soh2026-02-09
💬 NLP

compar:IA: The French Government's LLM arena to collect French-language human prompts and preference data

यह शोध पत्र compar:IA को प्रस्तुत करता है, जो एक ओपन-सोर्स फ्रांसीसी सरकारी प्लेटफॉर्म है जो लार्ज लैंग्वेज मॉडल्स (LLMs) को प्रशिक्षित करने और उनका मूल्यांकन करने के लिए गैर-अंग्रेजी डेटासेट की कमी को दूर करने हेतु ब्लाइंड पेयरवाइज तुलनाओं के माध्यम से बड़े पैमाने पर, फ्रांसीसी-भाषा के मानव वरीयता डेटा को एकत्र करता है।

Lucie Termignon, Simonas Zilinskas, Hadrien Pélissier, Aurélien Barrot, Nicolas Chesnais, Elie Gavoty2026-02-09
💬 NLP

Table-as-Search: Formulate Long-Horizon Agentic Information Seeking as Table Completion

यह शोध पत्र टेबल-एज़-सर्च (TaS) प्रस्तुत करता है, जो एक संरचित ढांचा है जो खोज की सुसंगतता और स्टेट ट्रैकिंग बनाए रखने के लिए लंबी अवधि की सूचना प्राप्ति को एक टेबल पूर्णता कार्य के रूप में पुनर्गठित करता है, जिससे विविध खोज रणनीतियों का एकीकरण होता है और मजबूती एवं दक्षता में अत्याधुनिक बेसलाइनों से काफी बेहतर प्रदर्शन होता है।

Tian Lan, Felix Henry, Bin Zhu, Qianghuai Jia, Junyang Ren, Qihang Pu, Haijun Li, Longyue Wang, Zhao Xu, Weihua Luo2026-02-09
💬 NLP

Generating Data-Driven Reasoning Rubrics for Domain-Adaptive Reward Modeling

यह शोध पत्र एक डेटा-संचालित विधि प्रस्तावित करता है जो स्वचालित रूप से सूक्ष्म तर्क त्रुटि वर्गीकरण (reasoning error taxonomies) उत्पन्न करती है जो जटिल तकनीकी डोमेन के लिए LLM-as-judge रिवॉर्ड मॉडलिंग को महत्वपूर्ण रूप से उन्नत करती है, और काफी कम गोल्ड लेबल्स के साथ लगभग 'वेरिफिएबल-रिवॉर्ड' प्रदर्शन प्राप्त करती है।

Kate Sanders, Nathaniel Weir, Sapana Chaudhary, Kaj Bostrom, Huzefa Rangwala2026-02-09
💬 NLP

Visual Word Sense Disambiguation with CLIP through Dual-Channel Text Prompting and Image Augmentations

यह शोध पत्र एक व्याख्यात्मक विज़ुअल वर्ड सेंस डिसैम्बिगुएशन फ्रेमवर्क प्रस्तुत करता है जो लेक्सिकल अस्पष्टता को हल करने के लिए ड्यूल-चैनल टेक्स्ट प्रॉम्प्टिंग और इमेज ऑगमेंटेशन के साथ CLIP का लाभ उठाता है, जो SemEval-2023 डेटासेट पर महत्वपूर्ण प्रदर्शन सुधार प्राप्त करता है और यह प्रदर्शित करता है कि सटीक, CLIP-संरेखित प्रॉम्प्ट शोर वाले बाहरी संकेतों की तुलना में अधिक प्रभावी हैं।

Shamik Bhattacharya, Daniel Perkins, Yaren Dogan, Vineeth Konjeti, Sudarshan Srinivasan, Edmon Begoli2026-02-09
💬 NLP

Halluverse-M^3: A multitask multilingual benchmark for hallucination in LLMs

यह शोध पत्र Halluverse-M^3 प्रस्तुत करता है, जो एक बहुभाषी और बहु-कार्य बेंचमार्क डेटासेट है जो अंग्रेजी, अरबी, हिंदी और तुर्की को कवर करता है और बड़े भाषा मॉडलों (large language models) में एंटिटी, रिलेशन और सेंटेंस-लेवल के मतिभ्रम (hallucinations) के बीच व्यवस्थित रूप से मूल्यांकन और अंतर करता है, जो भाषाओं और कार्यों के बीच महत्वपूर्ण प्रदर्शन अंतराल को प्रकट करता है।

Samir Abdaljalil, Parichit Sharma, Erchin Serpedin, Hasan Kurban2026-02-09
💬 NLP

PASH at TREC 2021 Deep Learning Track: Generative Enhanced Model for Multi-stage Ranking

यह शोध पत्र TREC 2021 डीप लर्निंग ट्रैक में PASH की भागीदारी को प्रस्तुत करता है, जो एक बहु-चरणीय रैंकिंग फ्रेमवर्क का विवरण देता है जो स्पार्स (sparse) और डेंस (dense) रिट्रीवल को एकीकृत करता है, पॉइंट-वाइज (point-wise) और पेयर-वाइज (pair-wise) रैंकिंग के लिए निरंतर प्री-ट्रेनिंग करता है, और पिछले वर्ष की तुलना में प्रदर्शन में सुधार करने के लिए जनरेटिव T5 मॉडल का नवीन समावेश करता है।

Yixuan Qiao, Shanshan Zhao, Jun Wang, Hao Chen, Tuozhen Liu, Xianbin Ye, Xin Tang, Rui Fang, Peng Gao, Wenfeng Xie, Guot (…)2026-02-06
💬 NLP

AccentBox: Towards High-Fidelity Zero-Shot Accent Generation

यह शोध पत्र AccentBox का प्रस्ताव करता है, जो एक नवीन दो-चरणीय ज़ीरो-शॉट फ्रेमवर्क है जो फॉरेन एक्सेंट कन्वर्जन, एक्सेंटेड टीटीएस (TTS), और ज़ीरो-शॉट टीटीएस (ZS-TTS) को एकीकृत करता है ताकि एक अत्याधुनिक एक्सेंट आइडेंटिफिकेशन मॉडल से प्राप्त स्पीकर-एग्नोस्टिक एक्सेंट एम्बेडिंग्स पर एक टीटीएस सिस्टम को कंडीशन करके उच्च-सटीकता वाली एक्सेंट जनरेशन और नियंत्रण प्राप्त किया जा सके।

Jinzuomu Zhong, Korin Richmond, Zhiba Su, Siqi Sun2026-02-06
💬 NLP

Invisible Walls in Cities: Designing LLM Agent to Predict Urban Segregation Experience with Social Media Content

यह शोध पत्र एक रिफ्लेक्टिव कोडर और रीज़निंग-एंड-एम्बेडिंग (RE'EM) फ्रेमवर्क से लैस एक नवीन एलएलएम (LLM) एजेंट प्रस्तावित करता है जो सोशल मीडिया समीक्षाओं को स्वचालित रूप से माइन करने, शहरी अलगाव के आयामों के लिए एक सामान्यीकरण योग्य कोडबुक उत्पन्न करने और सामाजिक समावेशिता की मानवीय समझ को बढ़ाने के साथ-साथ अनुभव किए गए अलगाव के पूर्वानुमान में महत्वपूर्ण सुधार करने के लिए है।

Bingbing Fan, Lin Chen, Songwei Li, Jian Yuan, Fengli Xu, Pan Hui, Yong Li2026-02-06