💬 NLP

Toward Reusability of AI Models Using Dynamic Updates of AI Documentation

यह शोध पत्र विकसित होते सर्वोत्तम अभ्यासों के साथ तालमेल बिठाने के लिए एआई मॉडल दस्तावेज़ीकरण को गतिशील रूप से अपडेट करने हेतु एक डेटा-संचालित, समुदाय-आधारित कार्यप्रणाली का प्रस्ताव करता है, जिससे मॉडल कार्डों में होने वाले सामयिक अंतराल (टेम्पोरल लैग) को संबोधित किया जा सके और हगिंग फेस पर दस्तावेज़ीकरण की गुणवत्ता और मॉडल जुड़ाव मेट्रिक्स के बीच सकारात्मक सहसंबंध प्रदर्शित करके एआई मॉडल की पुन: प्रयोज्यता को बढ़ाया जा सके।

Peter Bajcsy, Walid Keyrouz2026-04-21
💬 NLP

Does Welsh media need a review? Detecting bias in Nation.Cymru's political reporting

यह शोध पत्र 2022-2‌026 के दौरान Nation.Cymru की राजनीतिक रिपोर्टिंग का विश्लेषण करने के लिए एक दो-चरणीय एनएलपी (NLP) पाइपलाइन का उपयोग करता है, जो रिफॉर्म यूके (Reform UK) को असमान रूप से नकारात्मक रूप से लक्षित करने और प्लेड सायमरी (Plaid Cymru) को अनुकूल रूप से फ्रेम करने वाले सांख्यिकीय रूप से महत्वपूर्ण विभेदक फ्रेमिंग को प्रकट करता है, जिससे वेल्स के मीडिया में पूर्वाग्रह की व्यापक समीक्षा के लिए अनुभवजन्य साक्ष्य प्रदान करता है।

Cai Parry-Jones2026-04-21
💬 NLP

ThreadSumm: Summarization of Nested Discourse Threads Using Tree of Thoughts

यह शोध पत्र ThreadSumm को प्रस्तुत करता है, जो एक मल्टी-स्टेज LLM फ्रेमवर्क है जो गहराई से नेस्टेड चर्चा थ्रेड्स के तार्किक रूप से संरचित, उच्च-कवरेज सारांश उत्पन्न करने के लिए स्पष्ट पहलू (aspect) और सामग्री इकाई (content unit) निरूपणों पर 'ट्री ऑफ थॉट्स' (Tree of Thoughts) खोज का लाभ उठाता है।

Olubusayo Olabisi, Ekata Mitra, Ameeta Agrawal2026-04-21
💬 NLP

Measuring Distribution Shift in User Prompts and Its Effects on LLM Performance

यह शोध पत्र वास्तविक दुनिया के LLM परिनियोजन (deployments) में प्राकृतिक प्रॉम्प्ट वितरण बदलावों (prompt distribution shifts) को मापने के लिए LENS फ्रेमवर्क प्रस्तुत करता है, जो यह प्रकट करता है कि उपयोगकर्ता व्यवहार, समय या भूगोल में मध्यम बदलाव भी गंभीर प्रदर्शन गिरावट (औसतन 73% की हानि) का कारण बन सकते हैं और विकसित होती आबादी के बीच मॉडल विश्वसनीयता सुनिश्चित करने के लिए डेटा-संचालित निगरानी की महत्वपूर्ण आवश्यकता को रेखांकित करते हैं।

Parker Seegmiller, Sarah Masud Preum2026-04-21
💬 NLP

Video-Robin: Autoregressive Diffusion Planning for Intent-Grounded Video-to-Music Generation

Video-Robin एक अभिनव टेक्स्ट-कंडीशन्ड वीडियो-टू-म्यूजिक जनरेशन मॉडल है जो उच्च-निष्ठा (high-fidelity), अर्थपूर्ण रूप से संरेखित संगीत को सूक्ष्म नियंत्रण क्षमता और अत्याधुनिक विधियों की तुलना में काफी तेज़ इन्फरेंस के साथ उत्पन्न करने के लिए ऑटोरेग्रेसिव प्लानिंग को डिफ्यूजन-आधारित सिंथेसिस के साथ जोड़ता है।

Vaibhavi Lokegaonkar, Aryan Vijay Bhosale, Vishnu Raj, Gouthaman KV, Ramani Duraiswami, Lie Lu, Sreyan Ghosh, Dinesh Man (…)2026-04-21
🤖 machine learning

ATLAS: Constitution-Conditioned Latent Geometry and Redistribution Across Language Models and Neural Perturbation Data

यह शोध पत्र ATLAS को प्रस्तुत करता है, जो एक ज्यामिति-प्रथम (geometry-first) ढांचा है जो यह प्रदर्शित करता है कि संविधान-सशर्त पोस्ट-ट्रेनिंग (constitution-conditioned post-training) एक पुनर्प्राप्य लेटेंट ज्यामितीय संरचना (recoverable latent geometric structure) को प्रेरित करती है जो स्थानीय निर्देशांकों और व्यवहार संबंधी अभिव्यक्ति में बदलाव के बावजूद विभिन्न भाषा मॉडलों और न्यूरल सबस्ट्रेट्स में बनी रहती है।

Gareth Seneque, Lap-Hang Ho, Nafise Erfanian Saeedi, Jeffrey Molendijk, Tim Elson2026-04-21
💬 NLP

Towards Intelligent Legal Document Analysis: CNN-Driven Classification of Case Law Texts

यह शोध पत्र एक हल्के, उच्च-सटीक CNN-आधारित ढांचे का प्रस्ताव करता है जो कानूनी दस्तावेजों में बेहतर साइटेशन-ट्रीटमेंट वर्गीकरण प्राप्त करने के लिए लेमेटाइजेशन, FastText एम्बेडिंग और मल्टी-कर्नेल कनवल्शन को संयोजित करता है, जो सटीकता और अनुमान गति दोनों में BERT जैसे भारी ट्रांसफॉर्मर मॉडल से बेहतर प्रदर्शन करता है।

Moinul Hossain, Sourav Rabi Das, Zikrul Shariar Ayon, Sadia Afrin Promi, Ahnaf Atef Choudhury, Shakila Rahman, Jia Uddin2026-04-21
🤖 machine learning

MoE-nD: Per-Layer Mixture-of-Experts Routing for Multi-Axis KV Cache Compression

MoE-nD एक प्रति-परत मिश्रण-विशेषज्ञ (mixture-of-experts) रूटिंग फ्रेमवर्क पेश करता है जो एक वैश्विक मेमोरी बजट के तहत प्रत्येक ट्रांसफॉर्मर परत को अद्वितीय टोकन इविक्शन अनुपात और क्वांटाइजेशन बिट-चौड़ाई गतिशील रूप से आवंटित करता है, जिससे लंबी-संदर्भ तर्क कार्यों (long-context reasoning tasks) पर अनकंप्रेस्ड बेसलाइन के तुलनीय सटीकता बनाए रखते हुए 14x तक KV कैश संपीड़न प्राप्त किया जाता है।

Libo Sun, Peixiong He, Po-Wei Harn, Xiao Qin2026-04-21
💬 NLP

Before You Interpret the Profile: Validity Scaling for LLM Metacognitive Self-Report

यह शोध पत्र 20 फ्रंटियर एलएलएम (LLMs) के मेटाकॉग्निटिव स्व-रिपोर्ट्स का मूल्यांकन करने के लिए क्लिनिकल वैलिडिटी स्केलिंग फ्रेमवर्क्स (PAI और MMPI-3 से) को अनुकूलित करता है, जिससे यह पहचान होती है कि अमान्य मॉडल में आइटम-संवेदी आत्मविश्वास की कमी होती है और वे वैध मॉडलों की तुलना में विशिष्ट प्रतिक्रिया विरूपण प्रदर्शित करते हैं।

Jon-Paul Cacioli2026-04-21
💬 NLP

DeInfer: Efficient Parallel Inferencing for Decomposed Large Language Models

यह शोध पत्र DeInfer को प्रस्तुत करता है, जो कई अनुकूलनों और अत्याधुनिक तकनीकों के साथ अनुकूलता के माध्यम से डिकम्पोज्ड लार्ज लैंग्वेज मॉडल्स की खराब पैरेलल इन्फरेंस स्केलेबिलिटी को संबोधित करने के लिए डिज़ाइन किया गया एक उच्च-प्रदर्शन वाला इन्फरेंस सिस्टम है।

You-Liang Huang, Xinhao Huang, Chengxi Liao, Zeyi Wen2026-04-21