💬 NLP

TableMaster: A Recipe to Advance Table Understanding with Language Models

यह शोधपत्र TableMaster का परिचय देता है, जो एक व्यापक ढांचा है जो सामग्री निष्कर्षण (content extraction), अर्थपूर्ण संवर्धन (semantic enrichment) और अनुकूलन योग्य तर्क (adaptive reasoning) के माध्यम से प्रमुख चुनौतियों का समाधान करके भाषा मॉडल की तालिका समझ को बढ़ाता है, और WikiTQ डेटासेट पर अत्याधुनिक प्रदर्शन प्राप्त करता है।

Lang Cao, Hanbing Liu2026-04-16
💬 NLP

A closer look at how large language models trust humans: patterns and biases

पाँच मॉडलों और परिदृश्यों में 43,200 सिम्युलेटेड प्रयोगों के माध्यम से, यह अध्ययन प्रकट करता है कि जहाँ LLM-आधारित एजेंट आम तौर पर मानव पैटर्न के समान क्षमता, परोपकार और अखंडता के आधार पर मनुष्यों में विश्वास विकसित करते हैं, वहीं वे आयु, धर्म और लिंग के संबंध में महत्वपूर्ण जनसांख्यिकीय पूर्वाग्रह भी प्रदर्शित करते हैं, विशेष रूप से वित्तीय संदर्भों में।

Valeria Lerman, Yaniv Dover2026-04-16
💬 NLP

Two-Stage Regularization-Based Structured Pruning for LLMs

यह शोध पत्र TRSP को प्रस्तुत करता है, जो एक नवीन दो-चरणीय रेगुलराइजेशन-आधारित स्ट्रक्चर्ड प्रूनिंग विधि है जो परतों के भार (लेयर वेट्स) को पुनरावृत्ति से सीखती है और संरक्षित परतों में ज्ञान परिवर्तन (नॉलेज शिफ्ट) को प्रोत्साहित करती है, जिससे व्यापक पुनरप्रशिक्षण की आवश्यकता के बिना उत्कृष्ट प्रदर्शन प्रतिधारण और एंड-टू-एंड त्वरण के साथ कुशल LLM परिनियोजन सक्षम होता है।

Mingkuan Feng, Jinyang Wu, Siyuan Liu, Shuai Zhang, Ruihan Jin, Feihu Che, Pengpeng Shao, Zhengqi Wen, Jianhua Tao2026-04-16
💬 NLP

Bridging Compositional and Distributional Semantics: A Survey on Latent Semantic Geometry via AutoEncoder

यह सर्वेक्षण इस बात की खोज करता है कि कैसे वेरिएशनल (Variational), वेक्टर क्वांटाइज्ड (Vector Quantised) और स्पार्स ऑटोएनकोडर्स (Sparse Autoencoders) के माध्यम से डिस्ट्रीब्यूशनल सिमेंटिक स्पेस में कंपोजिशनल और सिम्बोलिक गुणों को एकीकृत करना, सिम्बोलिक और डिस्ट्रीब्यूशनल सिमेंटिक्स के बीच के अंतर को पाट सकता है, जिससे ट्रांसफॉर्मर-आधारित लैंग्वेज मॉडल्स की व्याख्यात्मकता (interpretability), नियंत्रणीयता (controllability) और सामान्यीकरण (generalization) क्षमता को बढ़ाया जा सके।

Yingji Zhang, Danilo S. Carvalho, André Freitas2026-04-16
💬 NLP

LLMEval-Fair: A Large-Scale Longitudinal Study on Robust and Fair Evaluation of Large Language Models

LLMEval-Fair एक गतिशील मूल्यांकन ढांचा है जो 220k स्नातक-स्तरीय प्रश्नों के एक प्रोप्रायटरी बैंक और एक स्वचालित, संदूषण-प्रतिरोधी पाइपलाइन का उपयोग करता है ताकि लार्ज लैंग्वेज मॉडल्स का सुदृढ़, निष्पक्ष और अनुदैर्ध्य मूल्यांकन प्रदान किया जा सके जो स्थिर बेंचमार्क की सीमाओं को दूर करते हैं।

Ming Zhang, Yujiong Shen, Jingyi Deng, Yuhui Wang, Huayu Sha, Kexin Tan, Qiyuan Peng, Yue Zhang, Junzhe Wang, Shichun Li (…)2026-04-16
💬 NLP

RadAgents: Multimodal Agentic Reasoning for Chest X-ray Interpretation with Radiologist-like Workflows

RadAgents एक नवीन मल्टी-एजेंट फ्रेमवर्क है जो रेडियोलॉजिस्ट के वर्कफ़्लो का अनुकरण करने के लिए क्लिनिकल प्रायर्स (clinical priors), टास्क-अवेयर मल्टीमॉडल रीजनिंग और ग्राउंडिंग मैकेनिज्म को एकीकृत करके चेस्ट एक्स-रे व्याख्या को बढ़ाता है, जिससे नैदानिक रूप से संरेखित, विजुअली ग्राउंडेड और सत्यापन योग्य डायग्नोस्टिक आउटपुट प्राप्त होता है।

Kai Zhang, Corey D Barrett, Jangwon Kim, Lichao Sun, Tara Taghavi, Krishnaram Kenthapadi2026-04-16
💬 NLP

Native Hybrid Attention for Efficient Sequence Modeling

यह शोध पत्र नेटिव हाइब्रिड अटेंशन (NHA) को प्रस्तुत करता है, जो एक एकीकृत आर्किटेक्चर है जो कुशल, उच्च-सटीक अनुक्रम मॉडलिंग प्राप्त करने के लिए लीनियर RNN-आधारित दीर्घकालिक संदर्भ को स्लाइडिंग विंडो शॉर्ट-टर्म टोकन के साथ जोड़ता है, जो रिकॉल-गहन कार्यों पर मानक ट्रांसफॉर्मर और हाइब्रिड बेसलाइन से बेहतर प्रदर्शन करता है।

Jusen Du, Jiaxi Hu, Tao Zhang, Weigao Sun, Yu Cheng2026-04-16
💬 NLP

SPG: Sandwiched Policy Gradient for Masked Diffusion Language Models

यह शोध पत्र सैंडविचड पॉलिसी ग्रेडिएंट (SPG) प्रस्तुत करता है, जो एक नवीन सुदृढीकरण शिक्षण (reinforcement learning) विधि है जो डिफ्यूजन लैंग्वेज मॉडल्स की जटिलता को दूर करने के लिए लॉग-लाइक्लीहुड के ऊपरी और निचले दोनों बाउंड्स का उपयोग करती है, और गणितीय एवं तार्किक तर्क संबंधी बेंचमार्क पर मौजूदा बेसलाइन्स से काफी बेहतर प्रदर्शन करती है।

Chenyu Wang, Paria Rashidinejad, DiJia Su, Song Jiang, Sid Wang, Siyan Zhao, Cai Zhou, Shannon Zejiang Shen, Feiyu Chen (…)2026-04-16
💬 NLP

Language steering in latent space to mitigate unintended code-switching

यह शोध पत्र 'लेटेंट-स्पेस लैंग्वेज स्टीयरिंग' नामक एक हल्का, इन्फरेंस-टाइम विधि प्रस्तावित करता है जो बहुभाषी एलएलएम (LLMs) में अर्थों को संरक्षित रखते हुए और नगण्य कम्प्यूटेशनल ओवरहेड के साथ अनचाहे कोड-स्विचिंग को प्रभावी ढंग से कम करने के लिए पीसीए-व्युत्पन्न (PCA-derived) भाषा दिशाओं का उपयोग करता है।

Andrey Goncharov, Nikolai Kondusov, Alexey Zaytsev2026-04-16
💬 NLP

Scaling Test-Time Compute to Achieve IOI Gold Medal with Open-Weight Models

यह शोध पत्र GenCluster का परिचय देता है, जो एक स्केलेबल टेस्ट-टाइम कंप्यूट फ्रेमवर्क है जो ओपन-वेट मॉडल्स को पहली बार इंटरनेशनल ओलंपियाड इन इन्फोर्मेटिक्स (IOI) गोल्ड मेडल प्रदर्शन प्राप्त करने में सक्षम बनाता है, जिससे बड़े पैमाने पर जनरेशन, व्यवहार संबंधी क्लस्टरिंग और राउंड-रॉबिन सबमिशन की एक पुनरुत्पादक रणनीति के माध्यम से ओपन और प्रोप्रायटरी एआई सिस्टमों के बीच के अंतर को कम किया जा सकता है।

Mehrzad Samadi, Aleksander Ficek, Sean Narenthiran, Siddhartha Jain, Wasi Uddin Ahmad, Somshubra Majumdar, Vahid Noroozi (…)2026-04-16