💬 NLP

Claim2Vec: Embedding Fact-Check Claims for Multilingual Similarity and Clustering

यह शोधपत्र Claim2Vec प्रस्तुत करता है, जो एक नवीन बहुभाषी एम्बेडिंग मॉडल है जिसे कंट्रास्टिव लर्निंग के माध्यम से अनुकूलित किया गया है, जो विभिन्न भाषाओं में फैक्ट-चेक दावों के क्लस्टरिंग को महत्वपूर्ण रूप से बढ़ाता है, जिससे स्वचालित दुष्प्रचार पहचान प्रणालियों की दक्षता में सुधार होता है।

Rrubaa Panchendrarajan, Arkaitz Zubiaga2026-04-14
💬 NLP

ProGAL-VLA: Grounded Alignment through Prospective Reasoning in Vision-Language-Action Models

ProGAL-VLA एक 3D एंटिटी-सेंट्रिक ग्राफ, सिम्बोलिक सब-गोल प्लानिंग और ग्राउंडिंग एलाइनमेंट कॉन्ट्रास्टिव लॉस को एकीकृत करके विजन-लैंग्वेज-एक्शन मॉडल्स को उन्नत करता है ताकि बाधाओं और भाषाई बारीकियों को संभालने में मौजूदा तरीकों से काफी बेहतर प्रदर्शन करने वाले मजबूत, निर्देश-संवेदनशील और अस्पष्टता-जागरूक रोबोटिक एजेंट प्राप्त किए जा सकें।

Nastaran Darabi, Amit Ranjan Trivedi2026-04-14
🤖 AI

COMPOSITE-Stem

यह शोधपत्र COMPOSITE-STEM को प्रस्तुत करता है, जो भौतिकी, जीव विज्ञान, रसायन विज्ञान और गणित के 70 ओपन-सोर्स कार्यों का एक नया विशेषज्ञ-क्यूरेटेड बेंचमार्क है, जो लचीले रूब्रिक-आधारित ग्रेडिंग का उपयोग करके यह प्रकट करता है कि वर्तमान सीमावर्ती (फ्रंटियर) एआई एजेंट अभी भी जटिल वैज्ञानिक तर्क में संघर्ष कर रहे हैं, जिसने केवल 21% का शीर्ष स्कोर प्राप्त किया है।

Kyle Waters, Lucas Nuzzi, Tadhg Looram, Alessandro Tomasiello, Ariel Ghislain Kemogne Kamdoum, Bikun Li, Damien Sileo, E (…)2026-04-14
💬 NLP

Spoiler Alert: Narrative Forecasting as a Metric for Tension in LLM Storytelling

यह शोध पत्र "100-Endings" मीट्रिक प्रस्तुत करता है, जो प्रत्येक वाक्य पर एक मॉडल के 100 सिम्युलेटेड कहानी अंतों में भविष्यवाणी विफलताओं की आवृत्ति को मापकर कथात्मक तनाव (narrative tension) को परिमाणित करता है, और यह प्रदर्शित करता है कि यह दृष्टिकोण न केवल मौजूदा बेंचमार्क के विपरीत, मानव साहित्यिक कथा साहित्य को LLM-जनित कहानियों से सही ढंग से ऊपर रैंक करता है, बल्कि एक संरचनात्मक पीढ़ी पाइपलाइन का मार्गदर्शन भी करता है जो EQ-Bench प्रदर्शन को बनाए रखते हुए कथात्मक तनाव में महत्वपूर्ण सुधार करता है।

Peiqi Sui, Yutong Zhu, Tianyi Cheng, Peter West, Richard Jean So, Hoyt Long, Ari Holtzman2026-04-14
💬 NLP

Exploring Structural Complexity in Normative RAG with Graph-based approaches: A case study on the ETSI Standards

यह शोध पत्र ETSI मानकों के लिए एक विशिष्ट ग्राफ RAG पद्धति का प्रस्ताव और मूल्यांकन करता है, जो यह प्रदर्शित करता है कि संरचनात्मक और शाब्दिक जानकारी को रिट्रीवल इंडेक्स में एम्बेड करने से जटिल मानदंडात्मक दस्तावेजों (normative documents) को संसाधित करने के लिए पारंपरिक वेक्टर-आधारित दृष्टिकोणों की तुलना में प्रदर्शन में महत्वपूर्ण सुधार होता है।

Aiman Al Masoud, Marco Arazzi, Simone Germani, Antonino Nocera2026-04-14
💬 NLP

Cross-Cultural Value Awareness in Large Vision-Language Models

यह शोध पत्र इस बात की जांच करता है कि कैसे बड़े विजन-लैंग्वेज मॉडल (LVLMs), काउंटरफैक्चुअल इमेज सेट्स और मोरल फाउंडेशन थ्योरी का उपयोग करके विभिन्न सांस्कृतिक संदर्भों में अपने नैतिक, आचार संबंधी और राजनीतिक निर्णयों का विश्लेषण करते हुए सांस्कृतिक मूल्य पूर्वाग्रह प्रदर्शित करते हैं।

Phillip Howard, Xin Su, Kathleen C. Fraser2026-04-14
💬 NLP

Reproduction Beyond Benchmarks: ConstBERT and ColBERT-v2 Across Backends and Query Distributions

यह शोध पत्र यह प्रदर्शित करता है कि जबकि ConstBERT और ColBERT-v2 मानक बेंचमार्क पर उच्च संख्यात्मक सटीकता प्राप्त करते हैं, MaxSim ऑपरेटर के माध्यम से समान टोकन वेटिंग (uniform token weighting) पर उनकी संरचनात्मक निर्भरता लंबी, वर्णनात्मक क्वेरीज़ पर उनकी मजबूती को मौलिक रूप से सीमित करती है और उन्हें बैकएंड मापदंडों एवं डेटा स्केलिंग के प्रति अत्यधिक संवेदनशील बनाती है, जो यह सिद्ध करता है कि अनुकूलन अकेले इन अंतर्निहित मल्टी-वेक्टर रिट्रीवल बाधाओं को दूर नहीं कर सकता है।

Utshab Kumar Ghosh, Ashish David, Shubham Chatterjee2026-04-14
💬 NLP

CoSToM:Causal-oriented Steering for Intrinsic Theory-of-Mind Alignment in Large Language Models

यह शोध पत्र CoSToM को प्रस्तुत करता है, जो एक ऐसा ढांचा (framework) है जो क्रिटिकल इंटरनल लेयर्स की पहचान करने के लिए कॉज़ल ट्रेसिंग (causal tracing) का उपयोग करके और आंतरिक ज्ञान को स्थिर, उच्च-गुणवत्ता वाले सामाजिक तर्क व्यवहारों के साथ संरेखित करने के लिए लक्षित एक्टिवेशन स्टीयरिंग (targeted activation steering) लागू करके लार्ज लैंग्वेज मॉडल्स की अंतर्निहित थ्योरी-ऑफ-माइंड (Theory-of-Mind) क्षमताओं को बढ़ाता है।

Mengfan Li, Xuanhua Shi, Yang Deng2026-04-14
💬 NLP

Linguistic Accommodation Between Neurodivergent Communities on Reddit:A Communication Accommodation Theory Analysis of ADHD and Autism Groups

यह अध्ययन रेडिट (Reddit) डेटा पर कम्युनिकेशन अकोमोडेशन थ्योरी (Communication Accommodation Theory) को लागू करता है, जो यह प्रकट करता है कि एडीएचडी (ADHD) और ऑटिज़्म समुदाय विशिष्ट भाषाई प्रोफाइल बनाए रखते हैं जो समूहों के बीच सदस्यों की परस्पर बातचीत के दौरान विपरीत दिशाओं में बदलते हैं, जिससे यह संकेत मिलता है कि दर्शक अनुकूलन (audience adaptation) और पहचान की प्रक्रियाएं अलग-अलग तंत्रों के माध्यम से संचालित होती हैं।

Saad Mankarious, Nour Zein, Iyad Ait Hou, Aya Zirikly2026-04-14
💬 NLP

ASPIRin: Action Space Projection for Interactivity-Optimized Reinforcement Learning in Full-Duplex Speech Language Models

यह शोध पत्र ASPIRin को पेश करता है, जो एक नवीन सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो फुल-डुप्लेक्स स्पीच मॉडल्स में टर्न-टेकिंग और बैकचैनलिंग को अनुकूलित करने के लिए एक्शन स्पेस प्रोजेक्शन के माध्यम से स्पीच टाइमिंग को कंटेंट जनरेशन से अलग करता है, जिससे मानक दृष्टिकोणों में सामान्य रूप से होने वाली सिमेंटिक गिरावट और पुनरावृत्ति को रोका जा सके।

Chi-Yuan Hsiao, Ke-Han Lu, Yu-Kuan Fu, Guan-Ting Lin, Hsiao-Tsung Hung, Hung-yi Lee2026-04-14