💬 NLP

Epistemic orientation in parliamentary discourse is associated with deliberative democracy

यह शोध पत्र सात देशों के 1.5 करोड़ संसदीय भाषणों का विश्लेषण करने के लिए एक स्केलेबल एविडेंस-माइनस-इंट्यूशन (EMI) स्कोर प्रस्तुत करता है, जो यह प्रकट करता है कि साक्ष्य-आधारित तर्क की ओर एक मजबूत झुकाव, समय के साथ उच्च स्तर के विचारशील लोकतंत्र और प्रभावी शासन से सकारात्मक रूप से जुड़ा हुआ है।

Segun Aroyehun, Stephan Lewandowsky, David Garcia2026-04-22
💬 NLP

Attributing Culture-Conditioned Generations to Pretraining Corpora

यह शोध पत्र MEMOed फ्रेमवर्क प्रस्तुत करता है जो यह प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल के जनरेशन में सांस्कृतिक पूर्वाग्रह असमान प्रीट्रेनिंग डेटा वितरण से उत्पन्न होते हैं, जहाँ उच्च-आवृत्ति वाली संस्कृतियाँ रटी-रटाई (मेमोराइज्ड) आउटपुट को ट्रिगर करती हैं जबकि निम्न-आवृत्ति वाली संस्कृतियाँ अक्सर प्रासंगिक सामग्री उत्पन्न करने में विफल रहती हैं।

Huihan Li, Arnav Goel, Keyu He, Xiang Ren2026-04-21
💬 NLP

Estimating Commonsense Plausibility through Semantic Shifts

यह शोध पत्र ComPaSS को प्रस्तुत करता है, जो एक नवीन विभेदक ढांचा (discriminative framework) है जो संवर्द्धनों (augmentations) द्वारा प्रेरित अर्थ संबंधी बदलावों को मापकर सामान्य ज्ञान की संभाव्यता (commonsense plausibility) का अनुमान लगाता है, जो भाषा और दृष्टि-भाषा मॉडलों में जनरेटिव बेसलाइन की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है और कंट्रास्टिव प्री-ट्रेनिंग के लाभों को उजागर करता है।

Wanqing Cui, Wei Huang, Keping Bi, Jiafeng Guo, Xueqi Cheng2026-04-21
💬 NLP

ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition

यह शोधपत्र ResearchBench को प्रस्तुत करता है, जो कि पहला बड़े पैमाने का, संदूषण-मुक्त बेंचमार्क है जो वैज्ञानिक खोज पर LLMs का मूल्यांकन करने के लिए कार्य को प्रेरणा पुनर्प्राप्ति (inspiration retrieval), परिकल्पना संरचना (hypothesis composition) और रैंकिंग में विभाजित करता है, जिससे यह पता चलता है कि मॉडल 12 विषयों में नवीन ज्ञान संबंधों को खोजने में उत्कृष्ट हैं।

Yujie Liu, Zonglin Yang, Tong Xie, Jinjie Ni, Ben Gao, Yuqiang Li, Shixiang Tang, Wanli Ouyang, Erik Cambria, Dongzhan Z (…)2026-04-21
💬 NLP

CROC: Evaluating and Training T2I Metrics with Pseudo- and Human-Labeled Contrastive Robustness Checks

यह शोध पत्र CROC को प्रस्तुत करता है, जो स्वचालित कंट्रास्टिव रोबस्टनेस चेक के लिए एक स्केलेबल फ्रेमवर्क है जो एक बड़ा छद्म-लेबल वाला (pseudo-labeled) डेटासेट और एक मानव-पर्यवेक्षित बेंचमार्क उत्पन्न करता है ताकि टेक्स्ट-टू-इमेज मेट्रिक्स का व्यवस्थित रूप से मूल्यांकन किया जा सके, मौजूदा विधियों में महत्वपूर्ण रोबस्टनेस खामियों को उजागर किया जा सके और अत्याधुनिक ओपन-सोर्स मेट्रिक, CROCScore के प्रशिक्षण को सक्षम बनाया जा सके।

Christoph Leiter, Yuki M. Asano, Margret Keuper, Steffen Eger2026-04-21
💬 NLP

Sense and Sensitivity: Examining the Influence of Semantic Recall on Long Context Code Reasoning

यह शोध पत्र यह प्रकट करता है कि जहाँ बड़े भाषा मॉडल (large language models) लंबे कोड संदर्भों में शब्दशः शाब्दिक पुनस्मरण (verbatim lexical recall) में उत्कृष्ट हैं, वहीं जब प्रासंगिक कोड केंद्रीय रूप से स्थित होता है, तो परिचालन अर्थविज्ञान (operational semantics) को समझने की उनकी क्षमता गंभीर रूप से घट जाती है, जो यह संकेत देता है कि वर्तमान बेंचमार्क काफी हद तक वास्तविक अर्थपूर्ण तर्क के बजाय पैटर्न-मैचिंग शॉर्टकट्स पर निर्भर करते हैं।

Adam Štorek, Mukur Gupta, Samira Hajizadeh, Prashast Srivastava, Suman Jana2026-04-21
💬 NLP

HopWeaver: Cross-Document Synthesis of High-Quality and Authentic Multi-Hop Questions

यह शोध पत्र HopWeaver प्रस्तुत करता है, जो एक स्वचालित क्रॉस-डॉक्यूमेंट फ्रेमवर्क है जो बिना किसी मानवीय हस्तक्षेप के उच्च-गुणवत्ता वाले, प्रामाणिक मल्टी-हॉप प्रश्नों को संश्लेषित करता है, जो प्रश्न-उत्तर मॉडल की तर्क क्षमताओं के मूल्यांकन और सुधार के लिए मैनुअल एनोटेशन के एक लागत प्रभावी विकल्प के रूप में कार्य करता है।

Zhiyu Shen, Jiyuan Liu, Yunhe Pang, Yanghui Rao, Fu Lee Wang, Jianxing Yu2026-04-21
💬 NLP

Frankentext: Stitching random text fragments into long-form narratives

यह शोध पत्र "फ्रैंकेंटेक्स्ट" (Frankentext) को एक कथा निर्माण प्रतिमान के रूप में प्रस्तुत करता है जहाँ एलएलएम (LLMs) मानव द्वारा लिखे गए शब्दों के अंशों को एक सुसंगत लंबी कहानियों में जोड़ते हैं, जो एक ऐसी विधि है जो लेखन की गुणवत्ता और मौलिकता को महत्वपूर्ण रूप से बढ़ाती है और साथ ही एआई (AI) डिटेक्शन सिस्टम्स को चुनौती देती है तथा लेखकत्व और कॉपीराइट के बारे में जटिल प्रश्न खड़े करती है।

Chau Minh Pham, Jenna Russell, Dzung Pham, Mohit Iyyer2026-04-21
💬 NLP

ScienceBoard: Evaluating Multimodal Autonomous Agents in Realistic Scientific Workflows

यह शोध पत्र ScienceBoard पेश करता है, जो एक यथार्थवादी बहु-डोमेन वातावरण और 169 कठोरता से सत्यापित वैज्ञानिक कार्यों का एक बेंचमार्क है जिसे मल्टीमॉडल स्वायत्त एजेंटों का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो यह प्रकट करता है कि वर्तमान अत्याधुनिक मॉडल जटिल वैज्ञानिक वर्कफ़्लो में केवल 15% सफलता दर प्राप्त करते हैं और स्वचालित वैज्ञानिक खोज का समर्थन करने के लिए बेहतर डिज़ाइन सिद्धांतों की आवश्यकता पर प्रकाश डालता है।

Qiushi Sun, Zhoumianze Liu, Chang Ma, Zichen Ding, Fangzhi Xu, Zhangyue Yin, Haiteng Zhao, Zhenyu Wu, Kanzhi Cheng, Zhao (…)2026-04-21
💬 NLP

MUSEG: Reinforcing Video Temporal Understanding via Timestamp-Aware Multi-Segment Grounding

यह शोध पत्र MUSEG का प्रस्ताव करता है, जो एक सुदृढीकरण शिक्षण (reinforcement learning) आधारित विधि है, जो टाइमस्टैम्प-जागरूक बहु-खंड ग्राउंडिंग (timestamp-aware multi-segment grounding) और एक चरणबद्ध पुरस्कार प्रशिक्षण रणनीति (phased reward training strategy) को पेश करके मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स की सूक्ष्म-स्तरीय टेम्पोरल रीजनिंग को बढ़ाता है, जो टेम्पोरल ग्राउंडिंग और समय-संवेदनशील वीडियो QA कार्यों पर मौजूदा दृष्टिकोणों से काफी बेहतर प्रदर्शन करता है।

Fuwen Luo, Shengfeng Lou, Chi Chen, Ziyue Wang, Chenliang Li, Weizhou Shen, Jiyue Guo, Peng Li, Ming Yan, Ji Zhang, Fei (…)2026-04-21