💬 NLP

I Came, I Saw, I Explained: Benchmarking Multimodal LLMs on Figurative Meaning in Memes

यह शोध पत्र इंटरनेट मीम्स में लाक्षणिक अर्थों का पता लगाने और उन्हें समझाने की उनकी क्षमता पर आठ अत्याधुनिक मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स का बेंचमार्किंग करता है, जिससे यह पता चलता है कि हालांकि मॉडल ऐसे अर्थों की पहचान कर सकते हैं, वे लाक्षणिक सामग्री मौजूद होने का अनुमान लगाने की ओर एक मजबूत पूर्वाग्रह प्रदर्शित करते हैं और अक्सर उनके पूर्वानुमान सही होने पर भी निष्ठापूर्ण स्पष्टीकरण प्रदान करने में विफल रहते हैं।

Shijia Zhou, Saif M. Mohammad, Barbara Plank, Diego Frassinelli2026-03-25
💬 NLP

WISTERIA: Weak Implicit Signal-based Temporal Relation Extraction with Attention

यह शोध पत्र WISTERIA का प्रस्ताव करता है, जो एक व्याख्यात्मक टेम्पोरल रिलेशन एक्सट्रैक्शन फ्रेमवर्क है जो कमजोर निहित संकेतों (इम्प्लिसिट सिग्नल्स) की पहचान करने और घटनाओं के बीच टेम्पोरल संबंधों को वर्गीकृत करने के लिए सबसे सूचनात्मक प्रासंगिक टोकन को अलग करने हेतु पेयर-कंडीशन्ड टॉप-K अटेंशन पूलिंग का उपयोग करता है।

Duy Dao Do, Anaïs Halftermeyer, Thi-Bich-Hanh Dao2026-03-25
💬 NLP

Natural Language Interfaces for Spatial and Temporal Databases: A Comprehensive Overview of Methods, Taxonomy, and Future Directions

यह शोध पत्र भौगोलिक और कालिक डेटाबेस के लिए प्राकृतिक भाषा इंटरफेस (NLIDBs) का एक व्यापक सर्वेक्षण और वर्गीकरण प्रस्तुत करता है, जो डेटासेट, मूल्यांकन मेट्रिक्स और विधियों का विश्लेषण करके मौजूदा अनुसंधान में बिखराव को संबोधित करता है ताकि वर्तमान चुनौतियों की पहचान की जा सके और गैर-विशेषज्ञ उपयोगकर्ताओं एवं जटिल स्थानिक-कालिक क्वेरी प्रणालियों के बीच के अंतर को पाटने के लिए भविष्य की दिशाओं को रेखांकित किया जा सके।

Samya Acharja, Kanchan Chowdhury2026-03-25
💬 NLP

Unleashing Spatial Reasoning in Multimodal Large Language Models via Textual Representation Guided Reasoning

यह शोध पत्र TRACE प्रस्तुत करता है, जो एक प्रॉम्प्टिंग विधि है जो मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स की 3D स्थानिक तर्क क्षमताओं को बढ़ाने के लिए उन्हें एगोजेंट्रिक वीडियो वातावरण के संरचित टेक्स्ट-आधारित एलोसेंट्रिक निरूपण उत्पन्न करने के लिए निर्देशित करती है, जिसके परिणामस्वरूप विविध बेंचमार्क और मॉडल बैकबोन में सुसंगत प्रदर्शन सुधार प्राप्त होते हैं।

Jiacheng Hua, Yishu Yin, Yuhang Wu, Tai Wang, Yifei Huang, Miao Liu2026-03-25
🤖 AI

Beyond Preset Identities: How Agents Form Stances and Boundaries in Generative Societies

यह शोध पत्र एक मिश्रित-पद्धति ढांचे को प्रस्तुत करता है जो आभासी नृवंशविज्ञान (virtual ethnography) को 'इननेट वैल्यू बायस' (Innate Value Bias) और 'ट्रस्ट-एक्शन डिकपलिंग' (Trust-Action Decoupling) जैसे नए मापदंडों के साथ जोड़ता है ताकि यह प्रकट किया जा सके कि जनरेटिव एजेंट पूर्व-निर्धारित पहचानों से ऊपर उठकर अंतर्जात रुख (endogenous stances) बनाते हैं, सामुदायिक सीमाओं को सक्रिय रूप से नया आकार देते हैं, और भावनात्मक बनाम तर्कसंगत हस्तक्षेपों के प्रति विशिष्ट व्यवहारिक कमजोरियां प्रदर्शित करते हैं।

Hanzhong Zhang, Siyang Song, Jindong Wang2026-03-25
💬 NLP

SpecEyes: Accelerating Agentic Multimodal LLMs via Speculative Perception and Planning

SpecEyes एक एजेंटिक-स्तर का स्पेक्युलेटिव एक्सेलेरेशन फ्रेमवर्क है जो एक कॉग्निटिव गेटिंग मैकेनिज्म और एक हेटेरोजेनियस पैरेलल फनल के साथ एक लाइटवेट मॉडल को स्पेक्युलेटिव प्लानर के रूप में उपयोग करता है ताकि सटीकता को बनाए रखते हुए या उसे बढ़ाते हुए मल्टीमॉडल LLMs की लेटेंसी को महत्वपूर्ण रूप से कम किया जा सके और थ्रूपुट में सुधार किया जा सके।

Haoyu Huang, Jinfa Huang, Zhongwei Wan, Xiawu Zheng, Rongrong Ji, Jiebo Luo2026-03-25
💬 NLP

MedObvious: Exposing the Medical Moravec's Paradox in VLMs via Clinical Triage

यह शोध पत्र MedObvious को प्रस्तुत करता है, जो एक 1,880-कार्य वाला बेंचमार्क है जो यह दर्शाता है कि वर्तमान विजन लैंग्वेज मॉडल्स (Vision Language Models) मेडिकल इमेज पर आवश्यक पूर्व-नैदानिक स्वच्छता जांच (pre-diagnostic sanity checks) करने में विफल रहते हैं, और अक्सर इनपुट के अमान्य या असंगत होने पर भी विश्वसनीय लगने वाले वृत्तांतों की कल्पना (hallucinate) करते हैं, जिससे नैदानिक तैनाती में एक महत्वपूर्ण सुरक्षा अंतराल उजागर होता है।

Ufaq Khan, Umair Nawaz, L D M S S Teja, Numaan Saeed, Muhammad Bilal, Yutong Xie, Mohammad Yaqub, Muhammad Haris Khan2026-03-25
💬 NLP

Diversidade linguística e inclusão digital: desafios para uma ia brasileira

समाजभाषावैज्ञानिक अंतर्दृष्टि का उपयोग करते हुए, यह शोध पत्र तर्क देता है कि जनरेटिव एआई (generative AI) मॉडलों का प्रभुत्व भाषाई विविधता के लिए खतरा पैदा करता है, जिससे एक स्व-सुदृढ़ीकरण चक्र निर्मित होता है जहाँ केवल अच्छी तरह से प्रलेखित भाषा रूपों को ही संरक्षित किया जाता है, जबकि प्रशिक्षण डेटा की कमी के कारण कम प्रतिनिधित्व वाले बोलियों को हाशिए पर धकेल दिया जाता है।

Raquel Meister Ko Freitag2026-03-24
💬 NLP

The MediaSpin Dataset: Post-Publication News Headline Edits Annotated for Media Bias

यह शोध पत्र मीडियास्पिन (MediaSpin) डेटासेट प्रस्तुत करता है, जो प्रकाशन के बाद की समाचार सुर्खियों के 78,910 जोड़ों का एक व्यापक संग्रह है जिन्हें 13 प्रकार के मीडिया पूर्वाग्रहों के साथ एनोटेट किया गया है, जिसे यह विश्लेषण करने के लिए डिज़ाइन किया गया है कि संपादकीय संपादन जन धारणा को कैसे आकार देते हैं और पूर्वाग्रह भविष्यवाणी को सक्षम करते हैं।

Preetika Verma, Kokil Jaidka2026-03-24
📊 statistics

A Training-free Method for LLM Text Attribution

यह शोध पत्र एलएलएम-जनित (LLM-generated) पाठ के मूल स्रोत की पहचान करने के लिए एक प्रशिक्षण-मुक्त, ज़ीरो-शॉट सांख्यिकीय ढांचे का प्रस्ताव करता है, जो इसे एक अनुक्रमिक स्टोकेस्टिक प्रक्रिया के रूप में मॉडल करता है, और व्हाइट-बॉक्स एवं ब्लैक-बॉक्स सेटिंग्स के तहत ज्ञात मॉडलों के बीच अंतर करने और अज्ञात मॉडलों का पता लगाने के लिए सैद्धांतिक रूप से गारंटीकृत कम त्रुटि दर प्रदान करता है जो पाठ की लंबाई के साथ तेजी से घटती है।

Tara Radvand, Mojtaba Abdolmaleki, Mohamed Mostagir, Ambuj Tewari2026-03-24