💬 NLP

From Performance to Purpose: A Sociotechnical Taxonomy for Evaluating Large Language Model Utility

यह शोध पत्र लैंग्वेज मॉडल यूटिलिटी टैक्सोनॉमी (LUX) को प्रस्तुत करता है, जो प्रदर्शन, इंटरेक्शन, ऑपरेशंस और गवर्नेंस डोमेन में व्यवस्थित एक व्यापक ढांचा है, ताकि केवल कार्य-स्तरीय सफलता से परे वास्तविक दुनिया के उच्च-जोखिम वाले अनुप्रयोगों में लार्ज लैंग्वेज मॉडल की उपयोगिता के मूल्यांकन को मानकीकृत किया जा सके।

Gavin Levinson, Keith Feldman2026-02-25
💬 NLP

Inner Speech as Behavior Guides: Steerable Imitation of Diverse Behaviors for Human-AI coordination

यह शोधपत्र MIMIC का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो व्यवहारिक इरादे (behavioral intent) के भाषाई प्रतिनिधित्व के रूप में "इनर स्पीच" (inner speech) उत्पन्न करने के लिए विजन-लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे एक डिफ्यूजन-आधारित पॉलिसी को बिना किसी अतिरिक्त प्रशिक्षण डेटा की आवश्यकता के, अनुमान समय (inference time) पर सूक्ष्म नियंत्रण (fine-grained steerability) के साथ विविध, उच्च-सटीकता वाले मानव-समान व्यवहार प्राप्त करने में सक्षम बनाया जा सके।

Rakshit Trivedi, Kartik Sharma, David C Parkes2026-02-25
💬 NLP

Stop-Think-AutoRegress: Language Modeling with Latent Diffusion Planning

स्टॉप-थिंक-ऑटोरीज्रेस लैंग्वेज डिफ्यूजन मॉडल (STAR-LDM), ऑटोरीज्रेसिव टोकन जनरेशन से पहले ग्लोबल सिमेंटिक प्लानिंग के लिए एक लेटेंट डिफ्यूजन-आधारित "थिंकिंग" चरण को एकीकृत करके भाषा निर्माण को बढ़ाता है, जिसके परिणामस्वरूप पारंपरिक मॉडलों की तुलना में तर्क, सुसंगतता और नियंत्रणीय एट्रीब्यूट स्टीयरिंग में बेहतर प्रदर्शन प्राप्त होता है।

Justin Lovelace, Christian Belardi, Sofian Zalouk, Adhitya Polavaram, Srivatsa Kundurthy, Kilian Q. Weinberger2026-02-25
💬 NLP

Actor-Curator: Co-adaptive Curriculum Learning via Policy-Improvement Bandits for RL Post-Training

यह शोध पत्र ACTOR-CURATOR प्रस्तुत करता है, जो एक स्केलेबल और स्वचालित करिकुलम लर्निंग फ्रेमवर्क है जो LLMs के RL पोस्ट-ट्रेनिंग के लिए प्रशिक्षण समस्याओं को गतिशील रूप से चुनने हेतु पॉलिसी-इम्प्रूवमेंट बैंडिट्स के माध्यम से प्रशिक्षित एक न्यूरल क्यूरेटर का उपयोग करता है, जिससे मौजूदा बेसलाइन्स की तुलना में रीजनिंग बेंचमार्क्स, प्रशिक्षण स्थिरता और दक्षता में महत्वपूर्ण सुधार प्राप्त होता है।

Zhengyao Gu, Jonathan Light, Raul Astudillo, Ziyu Ye, Langzhou He, Henry Peng Zou, Wei Cheng, Santiago Paternain, Philip (…)2026-02-25
💬 NLP

GATES: Self-Distillation under Privileged Context with Consensus Gating

यह शोध पत्र GATES का प्रस्ताव करता है, जो एक सेल्फ-डिस्टिलेशन फ्रेमवर्क है जो डॉक्यूमेंट-ग्राउंडेड रीजनिंग ट्रेसेस पर ट्यूटर कंसेंसस (शिक्षक सहमति) का लाभ उठाकर विश्वसनीय सुपरविजन सिग्नल्स उत्पन्न करता है, जिससे उन सेटिंग्स में डॉक्यूमेंट-फ्री स्टूडेंट मॉडल्स के प्रदर्शन में महत्वपूर्ण सुधार होता है जहाँ ग्राउंड ट्रुथ लेबल्स का अभाव होता है।

Alex Stein, Furong Huang, Tom Goldstein2026-02-25
💬 NLP

Personal Information Parroting in Language Models

यह शोध पत्र एक उन्नत रेगएक्स-आधारित (regex-based) डिटेक्टर सुइट प्रस्तुत करता है जो यह प्रकट करता है कि भाषा मॉडल, विशेष रूप से जैसे-जैसे उनका आकार और प्रशिक्षण अवधि बढ़ती है, अपने प्रीट्रेनिंग डेटा से व्यक्तिगत जानकारी को बार-बार याद करते हैं और शब्दशः पुनरुत्पादित करते हैं, जिससे गोपनीयता जोखिमों को कम करने के लिए डेटासेट के आक्रामक फ़िल्टरिंग और अनामीकरण (anonymization) की आवश्यकता होती है।

Nishant Subramani, Kshitish Ghate, Mona Diab2026-02-25
💬 NLP

CARE: An Explainable Computational Framework for Assessing Client-Perceived Therapeutic Alliance Using Large Language Models

यह शोध पत्र CARE को प्रस्तुत करता है, जो एक व्याख्यात्मक (explainable) LLM-आधारित ढांचा है जो बहु-आयामी क्लाइंट-अनुभूत चिकित्सीय गठबंधन (therapeutic alliance) स्कोर की सटीक भविष्यवाणी करने और परामर्श ट्रांसक्रिप्ट से व्याख्या योग्य तर्क उत्पन्न करने के लिए तर्क-संवर्धित पर्यवेक्षण (rationale-augmented supervision) का लाभ उठाता है, जिससे यह मौजूदा मॉडलों से बेहतर प्रदर्शन करता है और मानसिक स्वास्थ्य देखभाल के लिए व्यावहारिक अंतर्दृष्टि प्रदान करता है।

Anqi Li, Chenxiao Wang, Yu Lu, Renjun Xu, Lizhi Ma, Zhenzhong Lan2026-02-25
💬 NLP

ID-LoRA: Efficient Low-Rank Adaptation Inspired by Matrix Interpolative Decomposition

ID-LoRA एक नवीन पैरामीटर-कुशल फाइन-ट्यूनिंग फ्रेमवर्क है जो क्लस्टर्ड पैरामीटर समूहों को निकालने और पुन: उपयोग करने के लिए मैट्रिक्स इंटरपोलेटिव डिकंपोजिशन का लाभ उठाता है, जिससे मानक LoRA और इसके वेरिएंट की तुलना में प्रशिक्षित पैरामीटर्स को काफी कम करते हुए विविध बेंचमार्क पर बेहतर प्रदर्शन सक्षम होता है।

Xindian Ma, Rundong Kong, Peng Zhang, Ruoxiang Huang, Yongyu Jiang2026-02-25
💬 NLP

RMIT-ADM+S at the MMU-RAG NeurIPS 2025 Competition

यह शोध पत्र RMIT-ADM+S प्रस्तुत करता है, जो एक पुरस्कार विजेता, संसाधन-कुशल रिट्रीवल-ऑगमेंटेड जनरेशन सिस्टम है, जिसमें नवीन रूटिंग-टू-RAG (R2RAG) आर्किटेक्चर है जो कंज्यूमर-ग्रेड हार्डवेयर पर उच्च प्रदर्शन प्राप्त करने के लिए क्वेरी जटिलता के आधार पर रिट्रीवल रणनीतियों को गतिशील रूप से अनुकूलित करता है।

Kun Ran, Marwah Alaofi, Danula Hettiachchi, Chenglong Ma, Khoi Nguyen Dinh Anh, Khoi Vo Nguyen, Sachin Pathiyan Cheruman (…)2026-02-25
💬 NLP

Adaptive Text Anonymization: Learning Privacy-Utility Trade-offs via Prompt Optimization

यह शोध पत्र अनुकूली टेक्स्ट अनाधिक्यीकरण (anonymization) के लिए एक ढांचे को प्रस्तुत करता है जो भाषा मॉडलों के लिए संदर्भ-विशिष्ट निर्देश स्वतः उत्पन्न करने हेतु प्रॉम्प्ट अनुकूलन का उपयोग करता है, जो विविध डोमेन में गोपनीयता और उपयोगिता के बीच प्रभावी ढंग से संतुलन बनाता है और स्थिर बेसलाइन से बेहतर प्रदर्शन करते हुए नवीन अनाधिक्यीकरण रणनीतियों की खोज करता है।

Gabriel Loiseau, Damien Sileo, Damien Riquet, Maxime Meyer, Marc Tommasi2026-02-25