💬 NLP

Your Language Model Secretly Contains Personality Subnetworks

यह शोध पत्र प्रदर्शित करता है कि बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) स्वाभाविक रूप से अपने मौजूदा मापदंडों के भीतर व्यक्तित्व-विशिष्ट उप-नेटवर्कों (पर्सोना-स्पेशलाइज्ड सब-नेटवर्क्स) को समाहित करते हैं, जो मास्किंग और कंट्रास्टिव प्रूनिंग रणनीतियों के माध्यम से विशिष्ट व्यवहारों के कुशल, प्रशिक्षण-मुक्त निष्कर्षण की अनुमति देते हैं।

Ruimeng Ye, Zihan Wang, Zinan Ling, Yang Xiao, Manling Li, Xiaolong Ma, Bo Hui2026-02-10
💬 NLP

Steer2Adapt: Dynamically Composing Steering Vectors Elicits Efficient Adaptation of LLMs

Steer2Adapt एक हल्का ढांचा (lightweight framework) है जो जटिल कार्यों को संबोधित करने के लिए पुन: प्रयोज्य, निम्न-आयामी अर्थपूर्ण आधार वेक्टर्स (low-dimensional semantic basis vectors) के रैखिक संयोजन को गतिशील रूप से संयोजित करके कुशल और लचीला LLM अनुकूलन सक्षम बनाता है।

Pengrui Han, Xueqiang Xu, Keyang Xuan, Peiyang Song, Siru Ouyang, Runchu Tian, Yuqing Jiang, Cheng Qian, Pengcheng Jiang (…)2026-02-10
💬 NLP

High Fidelity Textual User Representation over Heterogeneous Sources via Reinforcement Learning

यह शोध पत्र एक सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) ढांचे का प्रस्ताव करता है जो निहित जुड़ाव संकेतों (इम्प्लिसिट एंगेजमेंट सिग्नल्स) और नियम-आधारित बाधाओं को पुरस्कार के रूप में उपयोग करके विषम डेटा स्रोतों से एकीकृत, संक्षिप्त और व्याख्या योग्य पाठ्य उपयोगकर्ता निरूपणों (टेक्स्टुअल यूजर रिप्रेजेंटेशन्स) को संश्लेषित करता है, जिससे एक बड़े पैमाने के जॉब प्लेटफॉर्म पर डाउनस्ट्रीम प्रदर्शन में महत्वपूर्ण सुधार होता है।

Rajat Arora, Ye Tao, Jianqiang Shen, Ping Liu, Muchen Wu, Qianqi Shen, Benjamin Le, Fedor Borisyuk, Jingwei Wu, Wenjing (…)2026-02-10
💬 NLP

Intent Mismatch Causes LLMs to Get Lost in Multi-Turn Conversation

यह शोध पत्र तर्क देता है कि मल्टी-टर्न एलएलएम (LLM) इंटरैक्शन में "लॉस्ट इन कन्वर्सेशन" (Lost in Conversation) की घटना मॉडल क्षमता की कमी के बजाय एक 'इन्टेंट एलाइनमेंट गैप' (intent alignment gap) के कारण होती है, और इसे कम करने के लिए 'इंटेंट क्लेरिफिकेशन' (intent clarification) को 'टास्क एग्जीक्यूशन' (task execution) से अलग करने हेतु एक 'मीडिएटर-असिस्टेंट' (Mediator-Assistant) आर्किटेक्चर का प्रस्ताव करता है।

Geng Liu, Fei Zhu, Rong Feng, Changyi Ma, Shiqi Wang, Gaofeng Meng2026-02-10
💬 NLP

ViHERMES: A Graph-Grounded Multihop Question Answering Benchmark and System for Vietnamese Healthcare Regulations

यह शोध पत्र ViHERMES प्रस्तुत करता है, जो एक नया बेंचमार्क और ग्राफ-जागरूक रिट्रीवल सिस्टम है जिसे जटिल, परस्पर निर्भर वियतनामी स्वास्थ्य सेवा नियमों पर मल्टीहॉप प्रश्न उत्तर देने की चुनौतियों को संबोधित करने के लिए डिज़ाइन किया गया है।

Long S. T. Nguyen, Quan M. Bui, Tin T. Ngo, Quynh T. N. Vo, Dung N. H. Le, Tho T. Quan2026-02-10
💬 NLP

Do Large Language Models Reflect Demographic Pluralism in Safety?

यह शोधपत्र डेमो-सेफ्टीबेंच (Demo-SafetyBench) प्रस्तुत करता है, जो एक ऐसा ढांचा है जिसे मौजूदा डेटासेट को विविध सुरक्षा डोमेन में पुनर्वर्गीकृत करके और इस बात का मूल्यांकन करने के लिए एक स्केलेबल, सुदृढ़ विधि प्रदान करके एलएलएम (LLM) सुरक्षा संरेखण में जनसांख्यिकीय विविधता की कमी को दूर करने के लिए डिज़ाइन किया गया है कि सुरक्षा धारणाएं विभिन्न जनसांख्यिकीय समूहों में कैसे भिन्न होती हैं।

Usman Naseem, Gautam Siddharth Kashyap, Sushant Kumar Ray, Rafiq Ali, Ebad Shabbir, Abdullah Mohammad2026-02-10
💬 NLP

When the Model Said 'No Comment', We Knew Helpfulness Was Dead, Honesty Was Alive, and Safety Was Terrified

"एक्सिस कोलैप्स" (Axis Collapse) की समस्या को संबोधित करने के लिए, जहाँ सहायकता (helpfulness) और सुरक्षा (safety) जैसे परस्पर विरोधी उद्देश्य एक-दूसरे में हस्तक्षेप करते हैं, लेखक **AlignX** का प्रस्ताव करते हैं, जो एक दो-चरणीय ढांचा है जो प्रॉम्प्ट-इंजेक्टेड फाइन-ट्यूनिंग और एक ज्यामिति-कैलिब्रेटेड मिक्सचर-ऑफ-एक्सपर्ट्स (MoCaE) मॉड्यूल का उपयोग करता है ताकि बड़े भाषा मॉडलों के संरेखण (alignment), सत्यता और दक्षता में महत्वपूर्ण सुधार किया जा सके।

Gautam Siddharth Kashyap, Mark Dras, Usman Naseem2026-02-10
💬 NLP

Can LLMs Truly Embody Human Personality? Analyzing AI and Human Behavior Alignment in Dispute Resolution

यह शोध पत्र एक मूल्यांकन ढांचे और डेटासेट को प्रस्तुत करता है ताकि यह जांचा जा सके कि क्या लार्ज लैंग्वेज मॉडल्स (LLMs) विवाद समाधान में मानव व्यक्तित्व-संचालित व्यवहारों की सटीक रूप से नकल कर सकते हैं, जिसका अंततः यह निष्कर्ष निकलता है कि वर्तमान LLMs मानव पैटर्न से काफी भिन्न हैं और मानव सामाजिक व्यवहार के विश्वसनीय प्रॉक्सी नहीं हो सकते हैं।

Deuksin Kwon, Kaleen Shrestha, Bin Han, Spencer Lin, James Hale, Jonathan Gratch, Maja Matarić, Gale M. Lucas2026-02-10
💬 NLP

Secure Code Generation via Online Reinforcement Learning with Vulnerability Reward Model

SecCoderX एक ऑनलाइन सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो कोड उपयोगिता से समझौता किए बिना LLMs को संरेखित करने के लिए संश्लेषित भेद्यता-प्रेरित कार्यों और एक तर्क-आधारित पुरस्कार मॉडल का उपयोग करके कार्यक्षमता-संरक्षण सुरक्षित कोड जनरेशन प्राप्त करता है।

Tianyi Wu, Mingzhe Du, Yue Liu, Chengran Yang, Terry Yue Zhuo, Jiaheng Zhang, See-Kiong Ng2026-02-10
💬 NLP

Measuring cross-language intelligibility between Romance languages with computational tools

यह शोध पत्र पांच मुख्य रोमांस भाषाओं के बीच क्रॉस-लैंग्वेज बोधगम्यता (intelligibility) को मापने और सत्यापित करने के लिए लेक्सिकल, सतही और सिमेंटिक समानता पर आधारित एक नवीन कम्प्यूटेशनल मीट्रिक प्रस्तुत करता है, जिसमें यह पाया गया है कि परिणाम मानव प्रयोगात्मक डेटा और भाषाई अंतर्ज्ञान के अनुरूप हैं।

Liviu P Dinu, Ana Sabina Uban, Bogdan Iordache, Anca Dinu, Simona Georgescu2026-02-10