💬 NLP

RealChart2Code: Advancing Chart-to-Code Generation with Real Data and Multi-Task Evaluation

यह शोध पत्र \texttt{RealChart2Code} को प्रस्तुत करता है, जो एक नया बड़े पैमाने का बेंचमार्क है जिसमें वास्तविक डेटासेट पर आधारित 2,800 से अधिक इंस्टेंस शामिल हैं, ताकि कच्चे डेटा से जटिल, मल्टी-पैनल चार्ट उत्पन्न करने और मल्टी-टर्न बातचीत के माध्यम से उन्हें परिष्कृत करने में विजन-लैंग्वेज मॉडल्स की क्षमताओं का व्यवस्थित रूप से मूल्यांकन किया जा सके, जो प्रोप्राइटरी और ओपन-वेट मॉडल्स के बीच प्रदर्शन के महत्वपूर्ण अंतर को प्रकट करता है।

Jiajun Zhang, Yuying Li, Zhixun Li, Xingyu Guo, Jingzhuo Wu, Leqi Zheng, Yiran Yang, Jianke Zhang, Qingbin Li, Shannan Y (…)2026-03-30
💬 NLP

Can Small Models Reason About Legal Documents? A Comparative Study

यह अध्ययन प्रदर्शित करता है कि 10B से कम पैरामीटर वाले मॉडल, विशेष रूप से एक 3B मिक्स्चर-ऑफ-एक्सपर्ट्स आर्किटेक्चर, उपयुक्त प्रॉम्प्टिंग रणनीतियों के साथ जुड़ने पर कानूनी बेंचमार्क पर GPT-4o-mini जैसे फ्रंटियर मॉडल्स के बराबर या उनसे बेहतर प्रदर्शन कर सकते हैं, जो यह प्रकट करता है कि मॉडल आर्किटेक्चर और प्रशिक्षण की गुणवत्ता कच्चे पैरामीटर काउंट की तुलना में अधिक महत्वपूर्ण है, साथ ही विभिन्न प्रॉम्प्टिंग विधियों की कार्य-निर्भर प्रभावकारिता और RAG के लिए डेंस रिट्रीवल की पर्याप्तता को भी उजागर करता है।

Snehit Vaddi2026-03-30
💬 NLP

When Chain-of-Thought Backfires: Evaluating Prompt Sensitivity in Medical Language Models

यह शोध पत्र यह प्रदर्शित करता है कि चेन-ऑफ-थॉट और फ्यू-शॉट प्रॉम्प्टिंग जैसी मानक प्रॉम्प्ट इंजीनियरिंग तकनीकें मेडिकल लार्ज लैंग्वेज मॉडल्स के प्रदर्शन को काफी कम कर देती हैं, जबकि क्लोज़ स्कोरिंग और परम्यूटेशन वोटिंग मेडिकल प्रश्न उत्तर देने के लिए अधिक सुदृढ़ और सटीक विकल्प प्रदान करते हैं।

Binesh Sadanandan, Vahid Behzadan2026-03-30
🤖 machine learning

Do Neurons Dream of Primitive Operators? Wake-Sleep Compression Rediscovers Schank's Event Semantics

यह शोध पत्र प्रदर्शित करता है कि एक स्वचालित वेक-स्लीप (wake-sleep) संपीड़न एल्गोरिदम रोज शैंक के हस्त-कोडित वैचारिक निर्भरता प्रिमिटिव्स (conceptual dependency primitives) को पुनः प्राप्त कर सकता है और साथ ही मानसिक और भावनात्मक अवस्था ऑपरेटरों का एक समृद्ध सेट भी खोज सकता है जो स्वाभाविक घटना डेटा की बेहतर व्याख्या करते हैं।

Peter Balogh2026-03-30
🤖 AI

Policy-Guided World Model Planning for Language-Conditioned Visual Navigation

यह शोध पत्र PiJEPA प्रस्तुत करता है, जो एक दो-चरणीय ढांचा (framework) है जो एक फाइन-ट्यून्ड पॉलिसी का उपयोग करके JEPA वर्ल्ड मॉडल पर MPPI प्लानिंग को वॉर्म-स्टार्ट करके भाषा-सशर्त विजुअल नेविगेशन को बेहतर बनाता है, जिससे मौजूदा विधियों की तुलना में बेहतर लक्ष्य-पहुंच सटीकता और निर्देश-अनुपालन निष्ठा प्राप्त होती है।

Amirhosein Chahe, Lifeng Zhou2026-03-30
💬 NLP

Toward Culturally Grounded Natural Language Processing

यह शोध पत्र तर्क देता है कि बहुभाषी एनएलपी (NLP) की प्रगति सांस्कृतिक सक्षमता की गारंटी नहीं देती है, जो हालिया साहित्य को संश्लेषित करते हुए पृथक भाषा बेंचमार्क से संचार पारिस्थितिकी (communicative ecologies) के मॉडलिंग की ओर एक प्रतिमान परिवर्तन (paradigm shift) का समर्थन करता है, जिसका अनुसंधान एजेंडा संदर्भगत मेटाडेटा, सांस्कृतिक रूप से स्तरीकृत मूल्यांकन और सहभागी संरेखण पर केंद्रित है।

Sina Bagheri Nezhad2026-03-30
🤖 machine learning

H-Node Attack and Defense in Large Language Models

यह शोध पत्र H-Node एडवरसैरियल नॉइज़ कैंसिलेशन (H-Node ANC) प्रस्तुत करता है, जो एक यांत्रिक ढांचा (mechanistic framework) है जो बड़े भाषा मॉडलों में मतिभ्रम (hallucination) के प्रति संवेदनशील हिडन-स्टेट आयामों की पहचान करता है ताकि लक्षित एडवरसैरियल हमलों और प्रभावी, कम-प्रभाव वाले बचावों को सक्षम बनाया जा सके जो सामान्य तर्क क्षमताओं से समझौता किए बिना मतिभ्रम ड्रिफ्ट (hallucination drift) को महत्वपूर्ण रूप से कम करते हैं।

Eric Yocam, Varghese Vaidyan, Yong Wang2026-03-30
💬 NLP

Retrieval-Augmented Generation Based Nurse Observation Extraction

यह शोध पत्र एक रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) आधारित स्वचालित पाइपलाइन का प्रस्ताव करता है जो नर्सिंग वर्कलोड को कम करने के लिए नर्सों के डिक्टेशन से नैदानिक अवलोकनों (clinical observations) को निकालता है, जिसने MEDIQA-SYNUR डेटासेट पर 0.796 का F1-स्कोर प्राप्त किया है।

Kyomin Hwang, Nojun Kwak2026-03-30
💬 NLP

I Want to Believe (but the Vocabulary Changed): Measuring the Semantic Structure and Evolution of Conspiracy Theories

यह शोध पत्र 2012 से 2022 तक के 169.9 मिलियन रेडिट (Reddit) कमेंट्स का विश्लेषण करता है ताकि यह प्रदर्शित किया जा सके कि षड्यंत्र सिद्धांत (conspiracy theories) सुसंगत अर्थपूर्ण वस्तुओं (semantic objects) के रूप में कार्य करते हैं जो स्थिरता, विस्तार, संकुचन और प्रतिस्थापन के माध्यम से समय के साथ गैर-समान रूप से विकसित होते हैं, जो उन गतिकी को प्रकट करते हैं जिन्हें पारंपरिक कीवर्ड-आधारित दृष्टिकोण पकड़ने में विफल रहते हैं।

Manisha Keim, Sarmad Chandio, Osama Khalid, Rishab Nithyanand2026-03-30
🤖 machine learning

Selective Deficits in LLM Mental Self-Modeling in a Behavior-Based Test of Theory of Mind

यह शोध पत्र एक नवीन व्यवहार-आधारित 'थ्योरी ऑफ माइंड' प्रतिमान प्रस्तुत करता है जो यह प्रकट करता है कि जहाँ हाल के एलएलएम (LLMs) दूसरों की मानसिक अवस्थाओं को मॉडल करने में मानव-स्तर का प्रदर्शन प्राप्त कर सकते हैं, वहीं वे बिना रीजनिंग ट्रेसेस (reasoning traces) की सहायता के आत्म-मॉडलिंग (self-modeling) में लगातार विफल रहते हैं, जो यह सुझाव देता है कि वे सीमित-क्षमता वाली वर्किंग मेमोरी पर निर्भर हैं और उचित रूप से स्कैफोल्डिंग (scaffolding) मिलने पर रणनीतिक धोखेबाजी में संलग्न हो सकते हैं।

Christopher Ackerman2026-03-30