💬 NLP

Modeling Complex Behaviors: Multi-Personality Composition and Dynamic Switching in Vision-Language Models

यह शोध पत्र मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स में स्पष्ट व्यक्तित्व अनुकूलन (personality conditioning) के लिए एक व्यवस्थित ढांचे को प्रस्तुत करता है, जो यह प्रकट करता है कि जबकि व्यक्तित्व प्रेरण (personality induction) इमेज कैप्शनिंग को बेहतर बनाता है, यह तर्क संबंधी कार्यों (reasoning tasks) को बाधित कर सकता है और मल्टी-ट्रे़ट संरचना तथा गतिशील स्विचिंग के दौरान जटिल संतुलन और अवशिष्ट प्रभाव प्रदर्शित करता है, जिससे मजबूत, अनुकूलित प्रेरण विधियों की आवश्यकता पर बल मिलता है।

Peiqi Jia (Xi'an Jiaotong University), Haonan Jia (Beihang University), Ziqi Miao (Beihang University), Linkang Du (Xi'a (…)2026-06-10
💬 NLP

VISTA: A Versatile Interactive User Simulation Toolkit for Agent Evaluation

यह शोध पत्र VISTA को प्रस्तुत करता है, जो एक बहुमुखी टूलकिट है जो UI और API इंटरैक्शन दोनों में सक्षम एक हाइब्रिड यूजर सिम्युलेटर के साथ-साथ सिम्युलेटेड इंटरैक्शन की यथार्थता और कवरेज को व्यापक रूप से मापने के लिए छह मेट्रिक्स का एक समूह प्रदान करके मौजूदा एजेंट मूल्यांकन विधियों की सीमाओं को संबोधित करता है।

Yunan Lu, Ryan Shea, Yusen Zhang, Zhou Yu2026-06-10
💬 NLP

The Shibboleth Effect: Auditing the Cross-Lingual Distributional Skew of Large Language Models

यह अध्ययन एक सिंथेटिक भू-राजनीतिक वॉरगेम का उपयोग यह प्रदर्शित करने के लिए करता है कि फ्रंटियर लार्ज लैंग्वेज मॉडल्स में क्रॉस-लिंगुअल व्यवहार संबंधी झुकाव विषम और आर्किटेक्चर-निर्भर है, जहाँ कुछ मॉडल्स टर्किश बनाम इंग्लिश में संचालित होने पर बाध्यकारी वक्तव्य (coercive rhetoric) में महत्वपूर्ण बदलाव प्रदर्शित करते हैं, जबकि अन्य चेन-ऑफ-थॉट रीजनिंग या मल्टीलिंगुअल अलाइनमेंट जैसे विशिष्ट बफरिंग तंत्रों के कारण स्थिर रहते हैं।

Hakan Mehmetcik2026-06-10
💬 NLP

TRACE: A Unified Rollout Budget Allocation Framework for Efficient Agentic Reinforcement Learning

यह शोध पत्र TRACE को प्रस्तुत करता है, जो एक एकीकृत ढांचा है जो इंटरैक्शन को ट्री-स्ट्रक्चर्ड नोड्स के रूप में मॉडल करके और रिवॉर्ड कंट्रास्ट एवं पॉलिसी लर्निंग दक्षता को बढ़ाने के लिए मिश्रित टर्मिनल रिवार्ड्स के साथ प्रॉम्प्ट रूट्स और इंटरमीडिएट प्रीफिक्स दोनों को गतिशील रूप से लक्षित करके मल्टी-टर्न एजेंटिक सुदृढीकरण शिक्षण (reinforcement learning) में रोलआउट बजट आवंटन को अनुकूलित करता है।

Heming Zou, Qi Wang, Yun Qu, Yuhang Jiang, Lizhou Cai, Yixiu Mao, Ru Peng, Xin Xu, Weijie Liu, Kai Yang, Saiyong Yang, X (…)2026-06-10
💬 NLP

A Unifying Lens on Supervised Fine-Tuning Through Target Distribution Design

यह शोध पत्र प्रस्तावित Q-टारगेट फ्रेमवर्क के माध्यम से सुपरवाइज्ड फाइन-ट्यूनिंग (SFT) को एक लक्षित वितरण डिजाइन समस्या के रूप में पुनर्व्याख्या करता है, जिससे टारगेट-SFT का विकास होता है, जो वांछित वितरणों से सीधे प्रशिक्षण उद्देश्यों का निर्माण करता है और विभिन्न तर्क संबंधी कार्यों (reasoning tasks) में मौजूदा विधियों से लगातार बेहतर प्रदर्शन करता है।

Tong Xie, Yuanhao Ban, Yunqi Hong, Sohyun An, Yihang Chen, Cho-Jui Hsieh2026-06-10
💬 NLP

Greedy Grammar Induction with Indirect Negative Evidence

यह शोध पत्र एक ग्रीडी ग्रामर इंडक्शन एल्गोरिदम प्रस्तुत करता है जो विभिन्न बेंचमार्क भाषाओं में कमजोर रूप से समकक्ष व्याकरणों को पुनः प्राप्त करने में अपनी प्रभावशीलता को प्रदर्शित करने के लिए, एक कंडीशनल वीक-रिकवरी प्रमेय को सिद्ध करने हेतु असमर्थ प्रीटर्मिनल स्ट्रिंग्स से अप्रत्यक्ष नकारात्मक साक्ष्य का उपयोग करता है।

Joseph Potashnik2026-06-09
💬 NLP

OATH-Frames: Characterizing Online Attitudes Towards Homelessness with LLM Assistants

यह शोध पत्र अमेरिका में बेघर होने के प्रति ऑनलाइन दृष्टिकोणों का विश्लेषण करने के लिए एक नौ-श्रेणी वाली वर्गीकरण पद्धति, OATH-Frames, प्रस्तुत करता है, और यह प्रदर्शित करता है कि डोमेन विशेषज्ञों की सहायता के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाने से 2.4 मिलियन ट्विटर पोस्टों के एनोटेशन को 6.5 गुना गति से और न्यूनतम प्रदर्शन हानि के साथ स्केल किया जा सकता है, जिससे विभिन्न जनसांख्यिकीय और क्षेत्रों में सार्वजनिक भावना के बारे में सूक्ष्म अंतर्दृष्टि प्राप्त होती है।

Jaspreet Ranjit, Brihi Joshi, Rebecca Dorn, Laura Petry, Olga Koumoundouros, Jayne Bottarini, Peichen Liu, Eric Rice, Sw (…)2026-06-09
💬 NLP

Assessing the Variety of a Concept Space Using an Unbiased Estimate of Rao's Quadratic Index

यह शोध पत्र डिज़ाइन अवधारणा विविधता के आकलन के लिए मौजूदा मेट्रिक्स की आलोचना करता है, एक नया दूरी-आधारित मीट्रिक और एक निर्देशात्मक ढांचा प्रस्तावित करता है जिसे 'VariAnT' नामक एक सॉफ़्टवेयर टूल में लागू किया गया है ताकि डिज़ाइन अवधारणाओं के बीच वास्तविक-मान्य दूरियों का उपयोग करके अन्वेषित अवधारणा स्थानों की व्यापकता को मापा जा सके।

Anubhab Majumder, Ujjwal Pal, Amaresh Chakrabarti2026-06-09
💬 NLP

ChronoFact: Timeline-based Temporal Fact Verification

यह शोध पत्र ChronoFact प्रस्तुत करता है, जो एक नवीन टाइमलाइन-आधारित फ्रेमवर्क और उसके साथ संलग्न डेटासेट है, जिसे दावों और साक्ष्यों से घटनाओं को निकालने और उन्हें कालानुक्रमिक रूप से संरेखित करने के लिए डिज़ाइन किया गया है ताकि उनकी सटीकता और संबंधों का व्यवस्थित रूप से मूल्यांकन किया जा सके।

Anab Maulana Barik, Wynne Hsu, Mong Li Lee2026-06-09
💬 NLP

Formalizing Learning from Language Feedback with Provable Guarantees

यह शोध पत्र इसकी जटिलता को चित्रित करने के लिए 'ट्रांसफर एलुडर डायमेंशन' (transfer eluder dimension) को पेश करके 'लर्निंग फ्रॉम लैंग्वेज फीडबैक' (LLF) समस्या को औपचारिक रूप देता है, सिद्ध 'नो-रेग्रेट' (no-regret) गारंटी के साथ HELiX\texttt{HELiX} एल्गोरिदम का प्रस्ताव करता है, और यह प्रदर्शित करता है कि समृद्ध भाषाई फीडबैक पारंपरिक रिवॉर्ड-आधारित विधियों की तुलना में तेजी से सीखने में सक्षम बना सकता है।

Wanqiao Xu, Allen Nie, Ruijie Zheng, Aditya Modi, Adith Swaminathan, Ching-An Cheng2026-06-09