💬 NLP

CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models

यह शोधपत्र CARE-RFT को प्रस्तुत करता है, जो एक नवीन सुदृढीकरण फाइनट्यूनिंग (reinforcement finetuning) विधि है जो तर्क क्षमता (reasoning performance) और मॉडल की विश्वसनीयता (trustworthiness) के बीच के संतुलन को हल करने के लिए स्क्यू रिवर्स KL डाइवर्जेंस (skew reverse KL divergence) का उपयोग करती है, जिससे अनियंत्रित RFT की उच्च तर्क क्षमताओं को प्राप्त करते हुए बेस मॉडल के अंशांकन (calibration) और विश्वसनीयता को बनाए रखा जा सकता है।

Shuozhe Li, Jincheng Cao, Bodun Hu, Aryan Mokhtari, Leqi Liu, Amy Zhang2026-02-03
💬 NLP

Interpreting and Controlling Model Behavior via Constitutions for Atomic Concept Edits

यह शोध पत्र एक ब्लैक-बॉक्स व्याख्यात्मकता ढांचे (interpretability framework) को प्रस्तुत करता है जो प्रॉम्प्ट्स पर परमाणु अवधारणा संपादन (atomic concept edits) को व्यवस्थित रूप से लागू करके सत्यापन योग्य प्राकृतिक भाषा "संविधानों" को सीखता है, जिससे टेक्स्ट-टू-इमेज जनरेशन और गणितीय तर्क जैसे कार्यों में मॉडल के व्यवहारों की गहरी अंतर्दृष्टि और प्रभावी नियंत्रण सक्षम होता है।

Neha Kalibhat, Zi Wang, Prasoon Bajpai, Drew Proud, Wenjun Zeng, Been Kim, Mani Malek2026-02-03
💬 NLP

Reversible Diffusion Decoding for Diffusion Language Models

यह शोधपत्र रिवर्सिबल डिफ्यूजन डिकोडिंग (RDD) का प्रस्ताव करता है, जो एक ऐसा फ्रेमवर्क है जो अपरिवर्तनीय टोकन प्रतिबद्धताओं के कारण होने वाले ठहराव से उबरने के लिए बैकट्रैकिंग और कॉन्फिडेंस-गाइडेड री-मास्किंग को पेश करके डिफ्यूजन लैंग्वेज मॉडल्स को उन्नत करता है, जिससे न्यूनतम कम्प्यूटेशनल ओवरहेड के साथ जनरेशन की मजबूती और गुणवत्ता में सुधार होता है।

Xinyun Wang, Min Zhang, Sen Cui, Zhikang Chen, Bo Jiang, Kun Kuang, Mingbao Lin2026-02-03
💬 NLP

DIVERGE: Diversity-Enhanced RAG for Open-Ended Information Seeking

यह शोध पत्र DIVERGE को प्रस्तुत करता है, जो एक नवीन एजेंटिक RAG फ्रेमवर्क है जो मानक प्रणालियों की विविधता संबंधी सीमाओं को दूर करने के लिए रिफ्लेक्शन-गाइडेड जनरेशन और मेमोरी-ऑगमेंटेड इटरेटिव रिफाइनमेंट का उपयोग करता है, जिससे ओपन-एंडेड सूचना अन्वेषण के लिए एक बेहतर विविधता-गुणवत्ता ट्रेड-ऑफ प्राप्त होता है।

Tianyi Hu, Niket Tandon, Akhil Arora2026-02-03
💬 NLP

Faithful-Patchscopes: Understanding and Mitigating Model Bias in Hidden Representations Explanation of Large Language Models

यह शोध पत्र पैचस्कोप्स (Patchscopes) ढांचे में एक व्यवस्थित अविश्वसनीयता की पहचान करता है जहाँ लार्ज लैंग्वेज मॉडल्स (Large Language Models) प्रासंगिक हिडन रिप्रेजेंटेशन्स (contextual hidden representations) के बजाय अंतर्निहित भाषाई पूर्वाग्रहों पर निर्भर करते हैं, और लॉजिट्स (logits) को पुन: कैलिब्रेट करने तथा स्पष्टीकरण की विश्वसनीयता को महत्वपूर्ण रूप से सुधारने के लिए बालोर (BALOR) पद्धति का प्रस्ताव करता है।

Xilin Gong, Shu Yang, Zehua Cao, Lynne Billard, Di Wang2026-02-03
💬 NLP

Segment-Level Attribution for Selective Learning of Long Reasoning Traces

यह शोध पत्र एक सेगमेंट-स्तरीय चयनात्मक शिक्षण ढांचे का प्रस्ताव करता है जो उच्च-प्रभाव वाले, चिंतनशील तर्क संबंधी सेगमेंट की पहचान करने और उन पर प्रशिक्षण देने के लिए एकीकृत ग्रेडिएंट एट्रिब्यूशन मेट्रिक्स का लाभ उठाता है, जबकि गैर-सूचनात्मक सामग्री को मास्क करता है, जिससे लार्ज रीजनिंग मॉडल्स की सटीकता और दक्षता दोनों में सुधार होता है।

Siyuan Wang, Yanchen Liu, Xiang Ren2026-02-03
💬 NLP

Culturally-Grounded Governance for Multilingual Language Models: Rights, Data Boundaries, and Accountable AI Design

यह शोध पत्र बहुभाषी भाषा मॉडलों के लिए एक सांस्कृतिक रूप से आधारित शासन ढांचे का प्रस्ताव करता है जो डेटा में प्रणालीगत असमानताओं, स्थानीय मानदंडों के साथ मिसअलाइनमेंट और जवाबदेही की कमियों को संबोधित करता है, और एआई गवर्नेंस को विशुद्ध रूप से तकनीकी चुनौती के बजाय एक सामाजिक-सांस्कृतिक और अधिकार-आधारित चुनौती के रूप में पुनर्परिभाषित करता है।

Hanjing Shi, Dominic DiFranzo2026-02-03
💬 NLP

Reasoning by Commented Code for Table Question Answering

यह शोध पत्र एक टिप्पणीयुक्त चरण-दर-चरण कोड-जेनरेशन फ्रेमवर्क प्रस्तावित करता है जो प्राकृतिक भाषा तर्क के साथ निष्पादन योग्य प्रोग्रामों में टेबल क्वेश्चन अनswering को विघटित करता है, जो संख्यात्मक सटीकता और व्याख्यात्मकता को बढ़ाकर WikiTableQuestions बेंचमार्क पर 84.3% की अत्याधुनिक सटीकता प्राप्त करता है।

Seho Pyo, Jiheon Seok, Jaejin Lee2026-02-03
💬 NLP

A Hierarchical and Attentional Analysis of Argument Structure Constructions in BERT Using Naturalistic Corpora

यह अध्ययन प्रदर्शित करता है कि BERT तर्क संरचना निर्माणों (Argument Structure Constructions) को एक पदानुक्रमित प्रतिनिधित्व संरचना के माध्यम से संसाधित करता है जहाँ निर्माण-विशिष्ट जानकारी प्रारंभिक परतों में उभरती है, मध्य परतों में अधिकतम पृथकरणीयता प्राप्त करती है, और बाद के चरणों में बनी रहती है, जैसा कि आयामी कमी (dimensionality reduction), क्लस्टरिंग मेट्रिक्स और अटेंशन विश्लेषण को संयोजित करने वाले एक बहु-आयामी विश्लेषणात्मक ढांचे द्वारा प्रकट किया गया है।

Liu Kaipeng, Wu Ling2026-02-03
💬 NLP

The French Drama Revolution: Political Economy and Literary Production, 1700-1900

यह शोध पत्र यह प्रदर्शित करने के लिए कम्प्यूटेशनल विधियों का उपयोग करता है कि फ्रांसीसी क्रांति और उसके बाद के औद्योगीकरण ने 1700 और 1900 के बीच फ्रांसीसी नाटक को गहराई से नया रूप दिया, जो बुर्जुआ विषयों में महत्वपूर्ण वृद्धि और आर्थिक विकास के साथ सह-विकास द्वारा चिह्नित है।

Thiago Dumont Oliveira2026-02-03