💬 NLP

Hierarchical vs. Flat Iteration in Shared-Weight Transformers

यह शोध पत्र एक अनुभवजन्य अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि फास्ट और स्लो मॉड्यूल वाला एक पदानुक्रमित, साझा-भार पुनरावृत्ति आर्किटेक्चर (HRM-LM), ट्रांसफॉर्मर-आधारित भाषा मॉडलों में स्वतंत्र-परत स्टैकिंग की प्रतिनिधित्व गुणवत्ता से मेल खाने में विफल रहता है, जो पैरामीटर-मैच तुलनाओं में भी एक तीव्र प्रदर्शन अंतराल को प्रकट करता है।

Sang-Il Han2026-04-17
💬 NLP

MARCA: A Checklist-Based Benchmark for Multilingual Web Search

यह शोध पत्र MARCA को प्रस्तुत करता है, जो एक द्विभाषी (अंग्रेजी और पुर्तगाली) बेंचमार्क है जिसमें 14 लार्ज लैंग्वेज मॉडल्स की वेब-सर्च क्षमताओं, ऑर्केस्ट्रेशन रणनीतियों और बहुभाषी प्रदर्शन का मूल्यांकन और तुलना करने के लिए चेकलिस्ट-शैली के रूब्रिक्स के साथ 52 मैन्युअल रूप से क्यूरेट किए गए प्रश्न शामिल हैं।

Thales Sales Almeida, Giovana Kerche Bonás, Ramon Pires, Celio Larcher, Hugo Abonizio, Marcos Piau, Roseval Malaquias Ju (…)2026-04-17
💬 NLP

Filling in the Mechanisms: How do LMs Learn Filler-Gap Dependencies under Developmental Constraints?

यह अध्ययन डिस्ट्रीब्यूटेड अलाइनमेंट सर्च का उपयोग यह प्रदर्शित करने के लिए करता है कि हालांकि सीमित, विकासात्मक रूप से व्यवहार्य डेटा पर प्रशिक्षित भाषा मॉडल विभिन्न वाक्यात्मक संरचनाओं में फिलर-गैप डिपेंडेंसीज़ (filler-gap dependencies) के लिए साझा लेकिन आइटम-संवेदनशील तंत्र विकसित कर सकते हैं, फिर भी उन्हें तुलनीय सामान्यीकरण प्राप्त करने के लिए मनुष्यों की तुलना में काफी अधिक डेटा की आवश्यकता होती है, जो अधिग्रहण मॉडलों (acquisition models) में भाषा-विशिष्ट पूर्वाग्रहों की आवश्यकता को रेखांकित करता है।

Atrey Desai, Sathvik Nair2026-04-17
💬 NLP

Psychological Steering of Large Language Models

यह शोध पत्र एक मनोवैज्ञानिक स्टीयरिंग फ्रेमवर्क प्रस्तुत करता है जो सिमेंटिक रूप से कैलिब्रेटेड और फ्लुएंसी-कंस्ट्रेंड रेसिडुअल-स्ट्रीम इंजेक्शनों का उपयोग करता है, जो एलएलएम (LLM) व्यक्तित्व लक्षणों को नियंत्रित करने में मौजूदा प्रॉम्प्टिंग बेसलाइनों से बेहतर प्रदर्शन करते हैं, साथ ही इन निरूपणों की रैखिक नियंत्रणीयता और मानव मनोवैज्ञानिक मॉडलों से उनके विचलन दोनों को प्रकट करते हैं।

Leonardo Blas, Robin Jia, Emilio Ferrara2026-04-17
💬 NLP

Controlling Authority Retrieval: A Missing Retrieval Objective for Authority-Governed Knowledge

यह शोध पत्र कंट्रोलिंग अथॉरिटी रिट्रीवल (CAR) प्रस्तुत करता है, जो एक औपचारिक ढांचा है जो सिमेंटिक दूरी के बावजूद पिछले दस्तावेजों के स्थान पर प्रभावी होने वाले सक्रिय आधिकारिक दस्तावेजों को खोजने की चुनौती का समाधान करता है, और एक दो-चरणीय रिट्रीवल दृष्टिकोण को मान्य करता है जो कानूनी, नियामक और सुरक्षा डोमेन में मानक डेंस विधियों की तुलना में काफी बेहतर प्रदर्शन करता है।

Andre Bacellar2026-04-17
💬 NLP

CobwebTM: Probabilistic Concept Formation for Lifelong and Hierarchical Topic Modeling

यह शोधपत्र Cobweb™ को प्रस्तुत करता है, जो एक कम-पैरामीटर वाला, आजीवन पदानुक्रमित विषय मॉडल (lifelong hierarchical topic model) है जो निरंतर दस्तावेज़ एम्बेडिंग के लिए वृद्धिशील कोबवेब एल्गोरिदम (incremental Cobweb algorithm) को अनुकूलित करता है, जिससे पूर्व-निर्धारित विषयों की संख्या के बिना अनसुपरवाइज्ड, गतिशील विषय खोज और संगठन सक्षम होता है और यह तंत्रिका (neural) एवं शास्त्रीय संभाव्यता (classical probabilistic) दोनों दृष्टिकोणों की सीमाओं को दूर करता है।

Karthik Singaravadivelan, Anant Gupta, Zekun Wang, Christopher MacLellan2026-04-17
💬 NLP

Learning Adaptive Reasoning Paths for Efficient Visual Reasoning

यह शोध पत्र AVR का प्रस्ताव करता है, जो एक अनुकूलन योग्य विजुअल रीजनिंग फ्रेमवर्क है जो सटीकता बनाए रखते हुए टोकन के उपयोग को महत्वपूर्ण रूप से कम करने और विजुअल रीजनिंग मॉडल्स में ओवरथिंकिंग को कम करने के लिए फुल रीजनिंग, परसेप्शन-ओनली, या डायरेक्ट आंसर फॉर्मेट्स के बीच गतिशील रूप से चयन करता है।

Yixu Huang, Tinghui Zhu, Muhao Chen2026-04-17
💬 NLP

Don't Retrieve, Navigate: Distilling Enterprise Knowledge into Navigable Agent Skills for QA and RAG

यह शोध पत्र Corpus2Skill प्रस्तुत करता है, जो एक ऐसी विधि है जो दस्तावेज़ कॉर्पोरा को पदानुक्रमित (hierarchical), सु navigatable कौशल वृक्षों (skill trees) में परिवर्तित करती है ताकि LLM एजेंटों को एंटरप्राइज ज्ञान संरचनाओं के बारे में सक्रिय रूप से अन्वेषण करने और तर्क करने में सक्षम बनाया जा सके, जिससे वे QA बेंचमार्क पर पारंपरिक पुनर्प्राप्ति-आधारित (retrieval-based) दृष्टिकोणों से बेहतर प्रदर्शन करते हैं।

Yiqun Sun, Pengfei Wei, Lawrence B. Hsieh2026-04-17
💬 NLP

CausalDetox: Causal Head Selection and Intervention for Language Model Detoxification

यह शोध पत्र CausalDetox का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो विषाक्त पीढ़ी (toxic generation) के लिए कारणत: उत्तरदायी विशिष्ट अटेंशन हेड्स की पहचान करता है और उनमें हस्तक्षेप करता है, जिसमें 'प्रोबेबिलिटी ऑफ नेसेसिटी एंड सफिशिएंसी' (PNS) का उपयोग करके भाषाई प्रवाह को बनाए रखते हुए इन्फरेंस-टाइम स्टीयरिंग और फाइन-ट्यूनिंग के माध्यम से महत्वपूर्ण विषाक्तता में कमी प्राप्त की जाती है।

Yian Wang, Yuen Chen, Agam Goyal, Hari Sundaram2026-04-17
🤖 machine learning

ConfLayers: Adaptive Confidence-based Layer Skipping for Self-Speculative Decoding

ConfLayers एक ट्रेनिंग-मुक्त, एडेप्टिव लेयर-स्किपिंग विधि है जो सेल्फ-स्पेक्टिव डेकोडिंग के लिए कॉन्फिडेंस स्कोर के आधार पर स्किप किए जाने वाले लेयर्स को डायनामिक रूप से चुनती है, जिससे आउटपुट क्वालिटी को बनाए रखते हुए वैनिला LLM जनरेशन की तुलना में 1.4x तक की स्पीडअप प्राप्त होती है।

Walaa Amer, Uday das, Fadi Kurdahi2026-04-17