💬 NLP

Death of the Novel(ty): Beyond n-Gram Novelty as a Metric for Textual Creativity

यह शोध पत्र तर्क देता है कि n-gram नवीनता (novelty) पाठ्य रचनात्मकता के लिए एक अपर्याप्त स्टैंडअलोन मीट्रिक है क्योंकि यह उपयुक्तता को ध्यान में रखने में विफल रहती है, जो व्यापक मानव एनोटेशन के माध्यम से यह प्रदर्शित करती है कि जहाँ उच्च नवीनता अक्सर AI-जनित पाठ में व्यावहारिक मूल्य की कमी दर्शाती है, वहीं फ्रंटियर LLMs को पारंपरिक n-gram विधियों की तुलना में रचनात्मक और गैर-व्यावहारिक अभिव्यक्तियों को बेहतर ढंग से पहचानने के लिए फाइन-ट्यून किया जा सकता है।

Arkadiy Saakyan, Najoung Kim, Smaranda Muresan, Tuhin Chakrabarty2026-03-04
💬 NLP

ManagerBench: Evaluating the Safety-Pragmatism Trade-off in Autonomous LLMs

यह शोधपत्र ManagerBench को प्रस्तुत करता है, जो स्वायत्त LLMs की परिचालन लक्ष्यों और मानवीय सुरक्षा के बीच संतुलन बनाने की क्षमता का मूल्यांकन करने वाला एक बेंचमार्क है, जो यह प्रकट करता है कि अत्याधुनिक मॉडल अक्सर या तो उद्देश्यों को प्राप्त करने के लिए हानिकारक कार्यों को प्राथमिकता देकर या अत्यधिक सुरक्षित और अप्रभावी होकर विफल हो जाते हैं, भले ही वे संबंधित जोखिमों को सटीक रूप से देख पा रहे हों।

Adi Simhi, Jonathan Herzig, Martin Tutek, Itay Itzhak, Idan Szpektor, Yonatan Belinkov2026-03-04
💬 NLP

AccurateRAG: A Framework for Building Accurate Retrieval-Augmented Question-Answering Applications

यह शोधपत्र AccurateRAG प्रस्तुत करता है, जो डेटा प्रोसेसिंग, मॉडल फाइन-ट्यूनिंग और मूल्यांकन के लिए एक व्यापक पाइपलाइन के माध्यम से उच्च-प्रदर्शन वाले रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) अनुप्रयोगों के विकास को सुव्यवस्थित करने वाला एक नवीन ढांचा है, जो अंततः बेंचमार्क डेटासेट पर अत्याधुनिक परिणाम प्राप्त करता है।

Linh The Nguyen, Chi Tran, Dung Ngoc Nguyen, Van-Cuong Pham, Hoang Ngo, Dat Quoc Nguyen2026-03-04
💬 NLP

LaDiR: Latent Diffusion Enhances LLMs for Text Reasoning

यह शोध पत्र LaDiR का प्रस्ताव करता है, जो एक नवीन तर्क ढांचा (reasoning framework) है जो टेक्स्ट रीजनिंग को एक संरचित लेटेंट स्पेस में एनकोड करके और समग्र, पुनरावृत्ति सुधार (iterative refinement) तथा विविध तर्क प्रक्षेप पथों (reasoning trajectories) के समानांतर निर्माण को सक्षम करने के लिए द्विदिश ध्यान (bidirectional attention) वाले एक लेटेंट डिफ्यूजन मॉडल का उपयोग करके लार्ज लैंग्वेज मॉडल्स को उन्नत करता है, जिससे यह गणितीय और योजना संबंधी बेंचमार्क पर मौजूदा ऑटोरिग्रेसिव और डिफ्यूजन-आधारित विधियों से बेहतर प्रदर्शन करता है।

Haoqiang Kang, Yizhe Zhang, Nikki Lijing Kuang, Nicklas Majamaki, Navdeep Jaitly, Yi-An Ma, Lianhui Qin2026-03-04
📊 statistics

Mitigating Over-Refusal in Aligned Large Language Models via Inference-Time Activation Energy

यह शोध पत्र एनर्जी लैंडस्केप स्टीयरिंग (ELS) को प्रस्तुत करता है, जो एक फाइन-ट्यूनिंग-मुक्त, इन्फरेंस-टाइम फ्रेमवर्क है जो एक हल्के एनर्जी-बेस्ड मॉडल का उपयोग करके लार्ज लैंग्वेज मॉडल एक्टिवेशन्स को गतिशील रूप से निर्देशित करता है, जिससे हानिकारक प्रॉम्प्ट्स के विरुद्ध मजबूत सुरक्षा बनाए रखते हुए निर्दोष अनुरोधों के अत्यधिक इनकार (over-refusal) को प्रभावी रूप से कम किया जा सके।

Eric Hanchen Jiang, Weixuan Ou, Run Liu, Shengyuan Pang, Guancheng Wan, Ranjie Duan, Wei Dong, Kai-Wei Chang, XiaoFeng W (…)2026-03-04
💬 NLP

Are Language Models Borrowing-Blind? A Multilingual Evaluation of Loanword Identification across 10 Languages

यह शोध पत्र दस भाषाओं में ऋणशब्दों (loanwords) को मूल शब्दावली से अलग करने की बहुभाषी भाषा मॉडलों की क्षमता का मूल्यांकन करता है और पाता है कि, निर्देशों और संदर्भ के बावजूद, ये मॉडल खराब प्रदर्शन करते हैं और ऋणशब्दों के प्रति एक पूर्वाग्रह प्रदर्शित करते हैं, जो अल्पसंख्यक भाषा संरक्षण के लिए एनएलपी (NLP) उपकरणों की महत्वपूर्ण चुनौतियों को उजागर करता है।

Mérilin Sousa Silva, Sina Ahmadi2026-03-04
💬 NLP

Are We Asking the Right Questions? On Ambiguity in Natural Language Queries for Tabular Data Analysis

यह शोध पत्र एक सहयोगात्मक ढांचे का प्रस्ताव करता है जो सारणीबद्ध डेटा (tabular data) के लिए प्राकृतिक भाषा संबंधी प्रश्नों में अस्पष्टता को उपयोगकर्ता-प्रणाली संपर्क की एक इच्छित विशेषता के रूप में पुनर्गठित करता है, और इस परिप्रेक्ष्य का उपयोग वर्तमान मूल्यांकन प्रथाओं की आलोचना करने और भविष्य के अनुसंधान दिशाओं को निर्देशित करने के लिए करता है।

Daniel Gomm, Cornelius Wolff, Madelon Hulsebos2026-03-04
💬 NLP

TransactionGPT

यह शोधपत्र TransactionGPT को प्रस्तुत करता है, जो एक विशेष 3D-Transformer आर्किटेक्चर पर निर्मित एक नवीन फाउंडेशन मॉडल है जो विसंगति का पता लगाने (anomaly detection) और भविष्य के लेनदेन के सृजन में मौजूदा प्रोडक्शन मॉडलों से बेहतर प्रदर्शन करने के लिए अरबों पैमाने के लेनदेन डेटा का लाभ उठाता है, जबकि फाइन-ट्यून किए गए लार्ज लैंग्वेज मॉडल्स की तुलना में बेहतर दक्षता प्रदान करता है।

Yingtong Dou, Zhimeng Jiang, Tianyi Zhang, Mingzhi Hu, Zhichao Xu, Shubham Jain, Uday Singh Saini, Xiran Fan, Jiarui Sun (…)2026-03-04
💬 NLP

From Passive to Persuasive: Steering Emotional Nuance in Human-AI Negotiation

यह शोध पत्र प्रदर्शित करता है कि लक्षित सक्रियण इंजीनियरिंग (targeted activation engineering), जो प्रमुख घटकों की पहचान करने के लिए एट्रिब्यूशन पैचिंग (attribution patching) और भावनात्मक वेक्टर्स प्राप्त करने के लिए विरोधाभासी पाठ युग्मों (contrastive text pairs) का उपयोग करती है, व्यापक फाइन-ट्यूनिंग के बिना LLaMA 3.1-8B को वार्ताओं में अधिक सूक्ष्म, मानव-समान भावनात्मक अभिव्यक्ति और व्यक्तिगत जुड़ाव प्रदर्शित करने के लिए प्रभावी ढंग से निर्देशित कर सकती है।

Niranjan Chebrolu, Gerard Christopher Yeo, Kokil Jaidka2026-03-04
💬 NLP

GUMBridge: a Corpus for Varieties of Bridging Anaphora

यह शोध पत्र GUMBridge प्रस्तुत करता है, जो ब्रिजिंग एनाफोरा (bridging anaphora) उपप्रकारों के लिए सूक्ष्म एनोटेशन के साथ 16 विविध अंग्रेजी शैलियों (genres) वाला एक नया कॉर्पस है, साथ ही यह प्रदर्शित करता है कि ब्रिजिंग रेजोल्यूशन (bridging resolution) और उपप्रकार वर्गीकरण दोनों ही समकालीन लार्ज लैंग्वेज मॉडल्स के लिए चुनौतीपूर्ण कार्य बने हुए हैं।

Lauren Levine, Amir Zeldes2026-03-04