💬 NLP

Mechanism Shift During Post-training from Autoregressive to Masked Diffusion Language Models

यह शोध पत्र प्रदर्शित करता है कि ऑटोरिग्रेसिव (autoregressive) मॉडलों को मास्क्ड डिफ्यूजन (masked diffusion) मॉडलों में पोस्ट-ट्रेनिंग करना एक कार्य-निर्भर "मैकेनिज्म शिफ्ट" (mechanism shift) उत्पन्न करता है, जहाँ मॉडल अपने आंतरिक सर्किट्स को विशेष रूप से वैश्विक नियोजन (global planning) का समर्थन करने के लिए स्थानीयकृत, कारण-संबंधी प्रसंस्करण (localized, causal processing) से वितरित, द्वि-दिशीय एकीकरण (distributed, bidirectional integration) में पुनर्गठित करते हैं।

Injin Kong, Hyoungjoon Lee, Yohan Jo2026-03-20
💬 NLP

The Flexibility Trap: Why Arbitrary Order Limits Reasoning Potential in Diffusion Language Models

यह शोध पत्र प्रकट करता है कि डिफ्यूजन लैंग्वेज मॉडल्स में मनमाना क्रम निर्माण (arbitrary order generation) अनजाने में उच्च-अनिश्चितता वाले टोकन से बचने के लिए प्रोत्साहित करके तर्क क्षमताओं को संकुचित कर देता है, जो यह प्रदर्शित करता है कि ऑर्डर लचीलेपन को लागू किए बिना मानक ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइजेशन (GRPO) का उपयोग करने वाला एक न्यूनतम दृष्टिकोण समानांतर डिकोडिंग लाभों को बनाए रखते हुए बेहतर प्रदर्शन प्राप्त करता है।

Zanlin Ni, Shenzhi Wang, Yang Yue, Tianyu Yu, Weilin Zhao, Yeguo Hua, Tianyi Chen, Jun Song, Cheng Yu, Bo Zheng, Gao Hua (…)2026-03-20
💬 NLP

Prompt Architecture Determines Reasoning Quality: A Variable Isolation Study on the Car Wash Problem

यह अध्ययन दर्शाता है कि लार्ज लैंग्वेज मॉडल्स द्वारा "कार वॉश समस्या" को हल करने के लिए, एक संरचित STAR रीजनिंग फ्रेमवर्क लागू करना कॉन्टेक्स्ट रिट्रीवल जोड़ने की तुलना में काफी अधिक प्रभावी है, जो अंततः इसे जोड़ने पर 100% सटीकता प्राप्त करता है।

Heejin Jo2026-03-20
💬 NLP

Transformers Remember First, Forget Last: Dual-Process Interference in LLMs

39 लार्ज लैंग्वेज मॉडल्स का परीक्षण करने के लिए संज्ञानात्मक मनोविज्ञान प्रतिमानों (कॉग्निटिव साइकोलॉजी पैराडाइम्स) को अनुकूलित करते हुए, यह अध्ययन प्रकट करता है कि ट्रांसफॉर्मर्स सार्वभौमिक रूप से एक प्रमुख प्रोएक्टिव इंटरफेरेंस प्रभाव प्रदर्शित करते हैं जहाँ प्रारंभिक जानकारी हाल के डेटा पर हावी हो जाती है—एक ऐसा पैटर्न जो मानव स्मृति से भिन्न है और जो पुनर्प्राप्ति (रिट्रीवल) और सुदृढ़ीकरण (कंसोलिडेशन) के लिए अलग-अलग, क्षमता-निर्भर तंत्रों का सुझाव देता है।

Sourav Chattaraj, Kanak Raj2026-03-20
💬 NLP

Harm or Humor: A Multimodal, Multilingual Benchmark for Overt and Covert Harmful Humor

यह शोध पत्र एक नवीन बहुआयामी (multimodal) और बहुभाषी बेंचमार्क प्रस्तुत करता है जिसमें अंग्रेजी और अरबी में 3,000 टेक्स्ट, 6,000 चित्र और 1,200 वीडियो शामिल हैं, जो सुरक्षित, प्रत्यक्ष रूप से हानिकारक और गुप्त रूप से हानिकारक हास्य के बीच अंतर करने की अत्याधुनिक मॉडलों की क्षमता का मूल्यांकन करने के लिए है, जो क्लोज्ड-सोर्स और ओपन-सोर्स मॉडलों के बीच महत्वपूर्ण प्रदर्शन अंतराल को प्रकट करता है और सांस्कृतिक रूप से आधारित सुरक्षा संरेखण (safety alignment) की तत्काल आवश्यकता पर प्रकाश डालता है।

Ahmed Sharshar, Hosam Elgendy, Saad El Dine Ahmed, Yasser Rohaim, Yuxia Wang2026-03-20
💬 NLP

TherapyGym: Evaluating and Aligning Clinical Fidelity and Safety in Therapy Chatbots

यह शोधपत्र TherapyGym को प्रस्तुत करता है, जो एक व्यापक ढांचा है जो स्वचालित CBT फिडेलिटी स्कोरिंग, विशिष्ट जोखिम मूल्यांकन और एक क्लिनिशियन-कैलिब्रेटेड बेंचमार्क के माध्यम से थेरेपी चैटबॉट्स का साक्ष्य-आधारित अभ्यास और सुरक्षा मानकों के साथ मूल्यांकन और संरेखण करता है, जो अंततः उन मॉडलों के प्रशिक्षण को सक्षम बनाता है जो नैदानिक गुणवत्ता और सुरक्षा में महत्वपूर्ण सुधार करते हैं।

Fangrui Huang, Souhad Chbeir, Arpandeep Khatua, Sheng Wang, Sijun Tan, Kenan Ye, Lily Bailey, Merryn Daniel, Ryan Louie (…)2026-03-20
💬 NLP

Agentic Framework for Political Biography Extraction

यह शोध पत्र असंरचित वेब स्रोतों से संरचित राजनीतिक जीवनवृत्त (बायोग्राफी) निकालने को स्वचालित करने के लिए रिकर्सिव एजेंटिक एलएलएम (LLMs) का लाभ उठाते हुए एक स्केलेबल, दो-चरणीय "सिंथेसिस-कोडिंग" ढांचे का प्रस्ताव करता है, जो यह प्रदर्शित करता है कि यह दृष्टिकोण न केवल मानव विशेषज्ञ सटीकता के बराबर या उससे अधिक है, बल्कि क्यूरेटेड, सिग्नल-सघन साक्ष्यों के माध्यम से पूर्वाग्रह को कम करते हुए सूचना कवरेज में मानव सामूहिक बुद्धिमत्ता से भी आगे निकल जाता है।

Yifei Zhu, Songpo Yang, Jiangnan Zhu, Junyan Jiang2026-03-20
💬 NLP

Learned but Not Expressed: Capability-Expression Dissociation in Large Language Models

यह अनुभवजन्य अध्ययन लार्ज लैंग्वेज मॉडल्स में एक व्यवस्थित विच्छेद (dissociation) को प्रदर्शित करता है जहाँ विशिष्ट निष्कर्षण स्थितियों के तहत गैर-कारण समाधानों (non-causal solutions) का सफलतापूर्वक पुनर्निर्माण किया जाता है, फिर भी वे मानक पीढ़ी संदर्भों में पूरी तरह से अनुपस्थित रहते हैं, जो इस धारणा को चुनौती देता है कि प्रशिक्षण डेटा की उपस्थिति सीधे आउटपुट संभाव्यता की भविष्यवाणी करती है।

Toshiyuki Shigemura2026-03-20
💬 NLP

Beyond Accuracy: An Explainability-Driven Analysis of Harmful Content Detection

यह शोध पत्र शैपली एडिटिव एक्सप्लेनेशन्स (Shapley Additive Explanations) और इंटीग्रेटेड ग्रेडिएंट्स (Integrated Gradients) का उपयोग करके एक रोबर्टा-आधारित (RoBERTa-based) हानिकारक सामग्री पहचान मॉडल का विश्लेषण करता है ताकि यह प्रकट किया जा सके कि जबकि सिस्टम उच्च सटीकता प्राप्त करता है, व्याख्यात्मकता विधियाँ प्रासंगिक और राजनीतिक परिदृश्यों में व्यवस्थित विफलताओं के निदान के लिए आवश्यक हैं, जिससे वे केवल एक प्रदर्शन मीट्रिक के बजाय मानव-इन-द-लूप (human-in-the-loop) मॉडरेशन के लिए एक पारदर्शिता उपकरण के रूप में कार्य करती हैं।

Trishita Dhara, Siddhesh Sheth2026-03-20
💬 NLP

MineDraft: A Framework for Batch Parallel Speculative Decoding

यह शोध पत्र MineDraft को प्रस्तुत करता है, जो एक नवीन बैच पैरेलल स्पेक्युलेटिव डिकोडिंग फ्रेमवर्क है जो ड्राफ्टिंग और वेरिफिकेशन चरणों को ओवरलैप करके LLM इन्फरेंस थ्रूपुट और लेटेंसी में महत्वपूर्ण सुधार करता है, और एक vLLM प्लगइन कार्यान्वयन के माध्यम से इसकी व्यावहारिक व्यवहार्यता को प्रदर्शित करता है।

Zhenwei Tang, Arun Verma, Zijian Zhou, Zhaoxuan Wu, Alok Prakash, Daniela Rus, Bryan Kian Hsiang Low2026-03-20