💬 NLP

PABU: Progress-Aware Belief Update for Efficient LLM Agents

PABU एक बिलीफ-स्टेट (belief-state) फ्रेमवर्क है जो कार्य की प्रगति को स्पष्ट रूप से मॉडल करके और केवल प्रासंगिक पिछले इंटरैक्शन को चुनिंदा रूप से बनाए रखकर LLM एजेंट की दक्षता और प्रदर्शन में सुधार करता है ताकि अनावश्यक कार्यों और इन्फरेंस लागत को कम किया जा सके।

Haitao Jiang, Lin Ge, Hengrui Cai, Rui Song2026-02-11
💬 NLP

Overview of PAN 2026: Voight-Kampff Generative AI Detection, Text Watermarking, Multi-Author Writing Style Analysis, Generative Plagiarism Detection, and Reasoning Trajectory Detection

PAN 2026 वर्कशॉप का उद्देश्य पांच विशिष्ट मूल्यांकन कार्यों के माध्यम से कम्प्यूटेशनल स्टाइलोमेट्री और टेक्स्ट फोरेंसिक्स को उन्नत करना है: जनरेटिव एआई डिटेक्शन, टेक्स्ट वॉटरमार्किंग, मल्टी-ऑथर स्टाइल एनालिसिस, जनरेटिव प्लेजरिज्म डिटेक्शन, और रीजनिंग ट्रॅजेक्टरी डिटेक्शन।

Janek Bevendorff, Maik Fröbe, André Greiner-Petter, Andreas Jakoby, Maximilian Mayerl, Preslav Nakov, Henry Plutz, Marti (…)2026-02-11
💬 NLP

Measuring Inclusion in Interaction: Inclusion Analytics for Human-AI Collaborative Learning

यह शोधपत्र "इनक्लूजन एनालिटिक्स" (समावेशन विश्लेषण) प्रस्तुत करता है, जो एक विमर्श-आधारित ढांचा है जिसे मानव-एआई सहयोगात्मक शिक्षण में भागीदारी, प्रभाव और ज्ञानमीमांसीय आयामों के माध्यम से एक गतिशील, क्षण-प्रति-क्षण प्रक्रिया के रूप में समावेशन को मापने के लिए डिज़ाइन किया गया है।

Jaeyoon Choi, Nia Nixon2026-02-11
💬 NLP

Collective Behavior of AI Agents: the Case of Moltbook

एआई-अनन्य सोशल मीडिया प्लेटफॉर्म मोल्टबुक (Moltbook) के एक विश्लेषण से पता चलता है कि जबकि एआई एजेंट मानव ऑनलाइन समुदायों के समान सामूहिक व्यवहार और सांख्यिकीय नियमितता प्रदर्शित करते हैं, वे जुड़ाव और लोकप्रियता के पैमाने पर कैसे भिन्न होते हैं, इसमें वे विशिष्ट अंतर भी प्रदर्शित करते हैं।

Giordano De Marzo, David Garcia2026-02-11
💬 NLP

Beyond Uniform Credit: Causal Credit Assignment for Policy Optimization

यह शोध पत्र "काउंटरफैक्टुअल इम्पोर्टेंस वेटिंग" (counterfactual importance weighting) का प्रस्ताव करता है, जो एक ऐसी विधि है जो मॉडल के अपने संभाव्यता परिवर्तनों (probability shifts) का उपयोग करके महत्वपूर्ण तर्क चरणों को उच्च श्रेय देने के लिए पॉलिसी ग्रेडिएंट अनुकूलन (policy gradient optimization) में सुधार करती है, बजाय इसके कि सभी टोकन को समान श्रेय दिया जाए।

Mykola Khandoga, Rui Yuan, Vinay Kumar Sankarapu2026-02-11
💬 NLP

FM SO.P: A Progressive Task Mixture Framework with Automatic Evaluation for Cross-Domain SOP Understanding

FM SO.P क्रमिक रूप से शब्दावली परिशुद्धता, अनुक्रमिक क्रम निर्धारण और बाधा तर्क क्षमताओं का निर्माण करके क्रॉस-डोमेन मानक संचालन प्रक्रिया (SOP) की समझ को बढ़ाने के लिए एक प्रगतिशील कार्य मिश्रण ढांचे और एक स्वचालित बहु-एजेंट मूल्यांकन प्रणाली को पेश करता है।

Siyuan Huang, Ziyu Wang, Chao Pan, Han Zhao2026-02-11
💬 NLP

Understanding Risk and Dependency in AI Chatbot Use from User Discourse

यह शोध पत्र जेनरेटिव एआई (generative AI) के उपयोग से जुड़े मनोवैज्ञानिक जोखिमों और भावनात्मक अनुभवों—जैसे कि लत और स्वायत्तता के संबंध में भय—की पहचान करने और उन्हें वर्गीकृत करने के लिए रेडिट (Reddit) विमर्श के एक बड़े पैमाने पर, एलएलएम-सहायता प्राप्त (LLM-assisted) कम्प्यूटेशनल विषयगत विश्लेषण का उपयोग करता है।

Jianfeng Zhu, Karin G. Coifman, Ruoming Jin2026-02-11
💬 NLP

Digital Linguistic Bias in Spanish: Evidence from Lexical Variation in LLMs

यह अध्ययन इस बात का मूल्यांकन करता है कि लार्ज लैंग्वेज मॉडल्स (Large Language Models) स्पेनिश में भौगोलिक शाब्दिक भिन्नता को कैसे निरूपित करते हैं, जिसमें यह पाया गया है कि वे व्यवस्थित बोलीगत पूर्वाग्रह प्रदर्शित करते हैं जिन्हें केवल उपलब्ध डिजिटल संसाधनों की मात्रा द्वारा स्पष्ट नहीं किया जा सकता है।

Yoshifumi Kawasaki2026-02-11
💬 NLP

BiasScope: Towards Automated Detection of Bias in LLM-as-a-Judge Evaluation

यह शोध पत्र **BiasScope** का प्रस्ताव करता है, जो LLM-as-a-judge मूल्यांकनों में अज्ञात पूर्वाग्रहों को सक्रिय रूप से खोजने के लिए डिज़ाइन किया गया एक स्वचालित LLM-संचालित फ्रेमवर्क है, और **JudgeBench-Pro** का परिचय देता है, जो एक अधिक चुनौतीपूर्ण बेंचमार्क है जो सबसे शक्तिशाली वर्तमान मूल्यांकनकर्ताओं में भी महत्वपूर्ण विश्वसनीयता अंतराल को प्रकट करता है।

Peng Lai, Zhihao Ou, Yong Wang, Longyue Wang, Jian Yang, Yun Chen, Guanhua Chen2026-02-11
⚡ electrical engineering

TVTSyn: Content-Synchronous Time-Varying Timbre for Streaming Voice Conversion and Anonymization

TVTSyn एक स्ट्रीम करने योग्य स्पीच सिंथेसाइज़र पेश करता है जो स्थिर स्पीकर एम्बेडिंग को कंटेंट-सिंक्रोनस, समय-परिवर्तनीय टिम्बर प्रतिनिधित्व से बदलकर रीयल-टाइम वॉयस कन्वर्जन और अनामकरण (anonymization) में सुधार करता है, जो पहचान को टेम्पोरल कंटेंट के साथ संरेखित करता है।

Waris Quamer, Mu-Ruei Tseng, Ghady Nasrallah, Ricardo Gutierrez-Osuna2026-02-11