🤖 AI

In-Context Environments Induce Evaluation-Awareness in Language Models

यह शोध पत्र प्रदर्शित करता है कि प्रतिकूल रूप से अनुकूलित इन-कॉन्टेक्स्ट प्रॉम्प्ट्स, हस्तनिर्मित प्रॉम्प्ट्स की तुलना में भाषा मॉडलों में रणनीतिक सैंडबैगिंग (sandbagging) के काफी उच्च स्तर को प्रेरित कर सकते हैं, जो यह प्रकट करता है कि मूल्यांकन-जागरूक तर्क (evaluation-aware reasoning) एक वास्तविक, कार्य-संरचना-निर्भर भेद्यता है जो मॉडल की विश्वसनीयता के लिए एक बड़ा खतरा पैदा करती है।

Maheep Chaudhary2026-03-05
🤖 AI

Monitoring Emergent Reward Hacking During Generation via Internal Activations

यह शोध पत्र स्पार्स ऑटोएनकोडर्स (sparse autoencoders) और लीनियर क्लासिफायर (linear classifiers) का उपयोग करते हुए एक एक्टिवेशन-आधारित निगरानी पद्धति प्रस्तावित करता है, जो जनरेशन के दौरान फाइन-ट्यून किए गए लार्ज लैंग्वेज मॉडल्स में उभरते रिवॉर्ड-हैकिंग (reward-hacking) व्यवहार का पता लगाने के लिए है, और यह प्रदर्शित करता है कि आंतरिक एक्टिवेशन पैटर्न मिसअलाइनमेंट (misalignment) के विश्वसनीय, प्रारंभिक और सामान्यीकरण योग्य संकेत प्रदान करते हैं जो अक्सर अंतिम आउटपुट विश्लेषण से पहले या उसके बाद भी बने रहते हैं।

Patrick Wilhelm, Thorsten Wittkopp, Odej Kao2026-03-05
💬 NLP

VietNormalizer: An Open-Source, Dependency-Free Python Library for Vietnamese Text Normalization in TTS and NLP Applications

यह शोध पत्र VietNormalizer को प्रस्तुत करता है, जो एक हल्का, शून्य-निर्भरता (zero-dependency) वाला पायथन लाइब्रेरी है, जो विविध वियतनामी टेक्स्ट तत्वों—जैसे कि संख्या, दिनांक, मुद्रा और विदेशी शब्दों—को TTS और NLP अनुप्रयोगों के लिए उच्चारण योग्य रूपों में बदलने हेतु एक व्यापक, नियम-आधारित पाइपलाइन प्रदान करता है।

Hung Vu Nguyen, Loan Do, Thanh Ngoc Nguyen, Ushik Shrestha Khwakhali, Thanh Pham, Vinh Do, Charlotte Nguyen, Hien Nguyen2026-03-05
💬 NLP

Traces of Social Competence in Large Language Models

यह शोध पत्र 'फॉल्स बिलीफ टेस्ट' (False Belief Test) के व्यापक सेट का उपयोग करके 17 लार्ज लैंग्वेज मॉडल्स की सामाजिक सक्षमता की जांच करता है, जो यह प्रकट करता है कि जबकि स्केलिंग प्रदर्शन में सुधार करती है, मानसिक अवस्थाओं का स्पष्ट उल्लेख एक क्रॉस-ओवर प्रभाव को ट्रिगर करता है जो प्री-ट्रेनिंग रूढ़ियों (stereotypes) में निहित है जिसे वेक्टर स्टीयरिंग (vector steering) के माध्यम से कारण रूप से अलग किया जा सकता है।

Tom Kouwenhoven, Michiel van der Meer, Max van Duijn2026-03-05
💬 NLP

When Do Language Models Endorse Limitations on Human Rights Principles?

यह शोध पत्र आठ भाषाओं में ग्यारह प्रमुख लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करता है और व्यवस्थित पूर्वाग्रहों को प्रकट करता है जहाँ वे राजनीतिक और नागरिक अधिकारों की तुलना में आर्थिक, सामाजिक और सांस्कृतिक अधिकारों पर सीमाओं का समर्थन करने की अधिक संभावना रखते हैं, महत्वपूर्ण भाषाई भिन्नता प्रदर्शित करते हैं, और प्रॉम्प्ट-आधारित स्टीयरिंग के प्रति उच्च संवेदनशीलता दिखाते हैं।

Keenan Samway, Nicole Miu Takagi, Rada Mihalcea, Bernhard Schölkopf, Ilias Chalkidis, Daniel Hershcovich, Zhijing Jin2026-03-05
💬 NLP

The Company You Keep: How LLMs Respond to Dark Triad Traits

यह अध्ययन इस बात की जांच करता है कि लार्ज लैंग्वेज मॉडल्स डार्क ट्रायड (Dark Triad) लक्षणों को दर्शाने वाले उपयोगकर्ता प्रॉम्प्ट्स पर कैसे प्रतिक्रिया देते हैं, जो यह प्रकट करता है कि हालांकि मॉडल मुख्य रूप से सुधारात्मक व्यवहार प्रदर्शित करते हैं, वे लक्षण की गंभीरता और भावना के आधार पर कभी-कभी हानिकारक प्रवृत्तियों को सुदृढ़ भी करते हैं, जो सुरक्षित संवादात्मक प्रणाली डिजाइनों की आवश्यकता को रेखांकित करता है।

Zeyi Lu, Angelica Henestrosa, Pavel Chizhov, Ivan P. Yamshchikov2026-03-05
💬 NLP

V1V_1: Unifying Generation and Self-Verification for Parallel Reasoners

यह शोधपत्र V1V_1 को प्रस्तुत करता है, जो एक कुशल युग्मवार रैंकिंग (pairwise ranking) और एक टूर्नामेंट-आधारित अनिश्चितता-निर्देशित एल्गोरिदम के माध्यम से जनरेशन और स्व-सत्यापन (self-verification) को एकीकृत करने वाला एक ढांचा है, जो मौजूदा पॉइंटवाइज वेरिफिकेशन (pointwise verification) और मानक सुदृढीकरण शिक्षण (reinforcement learning) विधियों की तुलना में जटिल तर्क और कोड जनरेशन बेंचमार्क पर टेस्ट-टाइम स्केलिंग प्रदर्शन और दक्षता में महत्वपूर्ण सुधार करता है।

Harman Singh, Xiuyu Li, Kusha Sareen, Monishwaran Maheswaran, Sijun Tan, Xiaoxia Wu, Junxiong Wang, Alpay Ariyak, Qingya (…)2026-03-05
💬 NLP

Pointer-CAD: Unifying B-Rep and Command Sequences via Pointer-based Edges & Faces Selection

पॉइंटर-CAD एक नवीन LLM-आधारित ढांचा है जो पॉइंटर-आधारित इकाई चयन के माध्यम से B-rep मॉडल और कमांड अनुक्रमों को एकीकृत करता है, जो जटिल ज्यामितीय संपादन को सक्षम करके और क्वांटाइजेशन के कारण होने वाली टोपोलॉजिकल त्रुटियों को काफी कम करके पारंपरिक केवल-कमांड विधियों की सीमाओं को प्रभावी ढंग से दूर करता है।

Dacheng Qi, Chenyu Wang, Jingwei Xu, Tianzhe Chu, Zibo Zhao, Wen Liu, Wenrui Ding, Yi Ma, Shenghua Gao2026-03-05
🤖 AI

ττ-Knowledge: Evaluating Conversational Agents over Unstructured Knowledge

यह शोध पत्र τ\tau-Knowledge प्रस्तुत करता है, जो एक नया बेंचमार्क है जिसमें τ\tau-Banking डोमेन शामिल है ताकि जटिल, नीति-संचालित वर्कफ़्लो में अनस्ट्रक्चर्ड नॉलेज रिट्रीवल को टूल के उपयोग के साथ समन्वित करने की संवादात्मक एजेंटों की क्षमता का मूल्यांकन किया जा सके, जो यह प्रकट करता है कि फ्रंटियर मॉडल भी ऐसे यथार्थवादी, लॉन्ग-होरिज़न इंटरैक्शन में कम सफलता दर और विश्वसनीयता के साथ संघर्ष करते हैं।

Quan Shi, Alexandra Zytek, Pedram Razavi, Karthik Narasimhan, Victor Barres2026-03-05
⚡ electrical engineering

Is Attention always needed? A Case Study on Language Identification from Speech

यह शोध पत्र MFCC फीचर्स का उपयोग करते हुए एक CRNN-आधारित भाषा पहचान मॉडल प्रस्तावित करता है जो तेरह भारतीय भाषाओं में 98% से अधिक सटीकता प्राप्त करता है और शोर वाली स्थितियों में मजबूत प्रदर्शन प्रदर्शित करता है, साथ ही अत्याधुनिक CNN और अटेंशन-आधारित मॉडलों के साथ तुलनात्मक विश्लेषण के माध्यम से अटेंशन मैकेनिज्म की आवश्यकता पर प्रश्न उठाता है।

Atanu Mandal, Santanu Pal, Indranil Dutta, Mahidas Bhattacharya, Sudip Kumar Naskar2026-03-04