💻 computer science

Can MLLMs "Read" What is Missing?

यह शोध पत्र MMTR-Bench प्रस्तुत करता है, जो एक नवीन बेंचमार्क है जो स्पष्ट प्रॉम्प्ट के बिना सीधे दृश्य संदर्भ से मास्क किए गए टेक्स्ट को पुनर्गठित करने की मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स की अंतर्निहित क्षमता का मूल्यांकन करता है, जिससे उनके लेआउट समझ, विजुअल ग्राउंडिंग और ज्ञान एकीकरण क्षमताओं को अलग करके और उनका आकलन करके देखा जा सकता है।

Jindi Guo, Xi Fang, Chaozheng Huang2026-04-24
💬 NLP

Spatial Metaphors for LLM Memory: A Critical Analysis of the MemPalace Architecture

यह शोध पत्र मेमपैलेस (MemPalace) आर्किटेक्चर का आलोचनात्मक विश्लेषण करता है, और इस निष्कर्ष पर पहुँचता है कि जहाँ इसका उत्कृष्ट रिट्रीवल प्रदर्शन मुख्य रूप से इसके नवीन स्थानिक रूपक (spatial metaphor) के बजाय वर्बेटिम स्टोरेज और मानक वेक्टर फ़िल्टरिंग से उपजा है, वहीं यह प्रणाली अपने कम लागत वाले, नियतात्मक राइट पाथ (deterministic write path) और एआई में स्थानिक स्मृति सिद्धांतों के पहले व्यवस्थित अनुप्रयोग के माध्यम से वास्तविक वास्तुशिल्प मूल्य प्रदान करती है, भले ही इसे उन दावों के साथ विपणन किया गया हो जो इसकी वैज्ञानिक कठोरता से अधिक हैं।

Robin Dey, Panyanon Viradecha2026-04-24
💬 NLP

Cross-Entropy Is Load-Bearing: A Pre-Registered Scope Test of the K-Way Energy Probe on Bidirectional Predictive Coding

यह पूर्व-पंजीकृत अध्ययन प्रदर्शित करता है कि सॉफ्टमैक्स के सापेक्ष K-वे एनर्जी प्रोब का प्रदर्शन क्रॉस-एन्ट्रॉपी प्रशिक्षण पर अत्यधिक निर्भर है, जो द्विदिशीय अनुमान गतिशीलता (bidirectional inference dynamics) या लेटेंट मूवमेंट मैग्नीट्यूड के बजाय काफी बड़े लॉजिट नॉर्म्स और एक स्केल-इनवेरिएंट रैंकिंग लाभ को प्रेरित करता है।

Jon-Paul Cacioli2026-04-24
💻 computer science

The First Challenge on Remote Sensing Infrared Image Super-Resolution at NTIRE 2026: Benchmark Results and Method Overview

यह शोध पत्र NTIRE 2026 रिमोट सेंसिंग इन्फ्रारेड इमेज सुपर-रिज़ॉल्यूशन चुनौती के बेंचमार्क परिणामों और पद्धति अवलोकन को प्रस्तुत करता है, जिसमें वास्तविक दुनिया के रिमोट सेंसिंग अनुप्रयोगों को आगे बढ़ाने के लिए लो-रिज़ॉल्यूशन इनपुट से हाई-रिज़ॉल्यूशन इन्फ्रारेड छवियों को पुनः प्राप्त करने हेतु 13 टीमों ने प्रतिस्पर्धा की।

Kai Liu, Haoyang Yue, Zeli Lin, Zheng Chen, Jingkai Wang, Jue Gong, Jiatong Li, Xianglong Yan, Libo Zhu, Jianze Li, Ziqi (…)2026-04-24
📈 economics

Ideological Bias in LLMs' Economic Causal Reasoning

यह शोध पत्र प्रकट करता है कि बड़े भाषा मॉडल आर्थिक कारण संबंधी तर्क में व्यवस्थित वैचारिक पूर्वाग्रह प्रदर्शित करते हैं, जो विवादास्पद आर्थिक हस्तक्षेपों का मूल्यांकन करते समय बाजार-उन्मुख दृष्टिकोणों की तुलना में हस्तक्षेप-उन्मुख (सरकार-समर्थक) दृष्टिकोणों की ओर एक दिशात्मक झुकाव और काफी उच्च सटीकता प्रदर्शित करते हैं।

Donggyu Lee, Hyeok Yun, Jungwon Kim, Junsik Min, Sungwon Park, Sangyoon Park, Jihee Kim2026-04-24
💬 NLP

Beyond Single Plots: A Benchmark for Question Answering on Multi-Charts

यह शोध पत्र PolyChartQA प्रस्तुत करता है, जो बहु-चार्ट छवियों और प्रश्न-उत्तर युग्मों का एक मध्यम-स्तरीय डेटासेट है, जिसे जटिल, बहु-चार्ट विज़ुअलाइज़ेशन से अंतर्दृष्टि प्राप्त करने में मल्टीमॉडल लैंग्वेज मॉडल्स के प्रदर्शन को बेंचमार्क और मूल्यांकन करने के लिए डिज़ाइन किया गया है।

Azher Ahmed Efat, Seok Hwan Song, Wallapak Tavanapong2026-04-24
💬 NLP

ReaGeo: Reasoning-Enhanced End-to-End Geocoding with LLMs

यह शोध पत्र ReaGeo को प्रस्तुत करता है, जो एक एंड-टू-एंड जियोकोडिंग फ्रेमवर्क है जो समन्वय (coordinate) भविष्यवाणी को चेन-ऑफ-थॉट रीजनिंग और रीइन्फोर्समेंट लर्निंग द्वारा उन्नत टेक्स्ट जनरेशन कार्य में बदलने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे विविध पते और स्थानिक प्रश्नों को सटीक रूप से संभालने के लिए पारंपरिक मल्टी-स्टेज रिट्रीवल विधियों की सीमाओं को दूर किया जा सके।

Jian Cui, Zhiyuan Ren, Desheng Weng, Yongqi Zhao, Gong Wenbin, Yu Lei, Zhenning Dong2026-04-24
💻 computer science

Time, Causality, and Observability Failures in Distributed AI Inference Systems

यह शोध पत्र यह प्रदर्शित करता है कि वितरित एआई इन्फरेंस सिस्टम में मामूली क्लॉक स्क्यू (clock skew) भी ऑब्जर्वेबिलिटी डेटा को कार्य-कारण संबंधी रूप से गलत और भ्रामक बना सकता है, जबकि सिस्टम कार्यात्मक रूप से सही और प्रदर्शन में सक्षम बना रहता है, जिससे विश्वसनीय सिस्टम मॉनिटरिंग के लिए सटीक समय संरेखण (time alignment) एक महत्वपूर्ण आवश्यकता के रूप में स्थापित होता है।

Ankur Sharma, Deep Shah, David Lariviere, Hesham ElBakoury2026-04-24
🤖 machine learning

mcdok at SemEval-2026 Task 13: Finetuning LLMs for Detection of Machine-Generated Code

SemEval-2026 टास्क 13 के लिए mcdok सिस्टम mdok टेक्स्ट डिटेक्शन दृष्टिकोण को अनुकूलित करता है, जो मशीन-जनित कोड डिटेक्शन, एट्रिब्यूशन और हाइब्रिड कोड पहचान को प्रतिस्पर्धी रूप से संबोधित करने के लिए कोड-विशिष्ट लार्ज लैंग्वेज मॉडल्स को फाइन-ट्यून करता है, हालांकि शीर्ष सिस्टमों की तुलना में महत्वपूर्ण प्रदर्शन अंतराल बने हुए हैं।

Adam Skurla, Dominik Macko, Jakub Simko2026-04-24
💬 NLP

VLAA-GUI: Knowing When to Stop, Recover, and Search, A Modular Framework for GUI Automation

VLAA-GUI स्वायत्त GUI एजेंटों के लिए एक मॉड्यूलर फ्रेमवर्क है जो अनिवार्य पूर्णता सत्यापन (mandatory completeness verification), एक मल्टी-टियर लूप ब्रेकर और एक ऑन-डिमांड सर्च एजेंट को एकीकृत करके समयपूर्व समाप्ति और पुनरावृत्ति वाले लूपों की समस्या का समाधान करता है, जिससे OSWorld और WindowsAgentArena बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Qijun Han, Haoqin Tu, Zijun Wang, Haoyue Dai, Yiyang Zhou, Nancy Lau, Alvaro A. Cardenas, Yuhui Xu, Ran Xu, Caiming Xion (…)2026-04-24