💬 NLP

When Prompts Override Vision: Prompt-Induced Hallucinations in LVLMs

यह शोध पत्र HalluScope प्रस्तुत करता है, जो यह प्रकट करता है कि लार्ज विजन-लैंग्वेज मॉडल्स में मतिभ्रम (hallucinations) मुख्य रूप से टेक्स्टुअल इंस्ट्रक्शन प्रायर्स (textual instruction priors) द्वारा संचालित होते हैं, और HalluVL-DPO का प्रस्ताव करता है जो एक प्रिफरेंस ऑप्टिमाइज़ेशन फ्रेमवर्क है जो विजुअल क्षमताओं को संरक्षित करते हुए इन प्रॉम्प्ट-प्रेरित मतिभ्रमों को प्रभावी ढंग से कम करता है।

Pegah Khayatan, Jayneel Parekh, Arnaud Dapogny, Mustafa Shukor, Alasdair Newson, Matthieu Cord2026-04-24
💻 computer science

Seeing Fast and Slow: Learning the Flow of Time in Videos

यह शोधपत्र ऐसे स्व-पर्यवेक्षित (self-supervised) मॉडलों को प्रस्तुत करता है जो वीडियो प्लेबैक गति का पता लगाने और उसे नियंत्रित करने के लिए सीखते हैं, इन क्षमताओं का लाभ उठाकर एक विशाल स्लो-मोशन डेटासेट तैयार करते हैं और स्पीड-कंडीशन्ड वीडियो जनरेशन एवं टेम्पोरल सुपर-रिज़ॉल्यूशन जैसे उन्नत अनुप्रयोगों को सक्षम करते हैं।

Yen-Siang Wu, Rundong Luo, Jingsen Zhu, Tao Tu, Ali Farhadi, Matthew Wallingford, Yu-Chiang Frank Wang, Steve Marschner (…)2026-04-24
💻 computer science

Learning Multi-Modal Whole-Body Control for Real-World Humanoid Robots

यह शोध पत्र मास्कड ह्यूमनॉइड कंट्रोलर (MHC) को प्रस्तुत करता है, जो एक मल्टी-मोडल करिकुलम के माध्यम से प्रशिक्षित एक एकीकृत सीखा हुआ नियंत्रक है, जो वास्तविक दुनिया के ह्यूमनॉइड रोबोट्स को मास्कड टारगेट ट्रेजेक्टरीज पर आधारित एक एकल, लचीले इंटरफ़ेस के माध्यम से अनुकूलित प्रक्षेप पथों (ऑप्टिमाइज्ड ट्रेजेक्टरीज) से लेकर जॉयस्टिक टेलीऑपरेशन तक, विविध होल-बॉडी व्यवहार निष्पादित करने में सक्षम बनाता है।

Pranay Dugar, Aayam Shrestha, Fangzhou Yu, Bart van Marum, Alan Fern2026-04-23
💻 computer science

Fairness Testing of Large Language Models in Role-Playing

यह शोध पत्र रोल-प्लेइंग परिदृश्यों के दौरान लार्ज लैंग्वेज मॉडल्स (LLMs) में निष्पक्षता परीक्षण पर एक अनुभवजन्य अध्ययन प्रस्तुत करता है, जिसमें 10 उन्नत मॉडलों में व्यापक सामाजिक पूर्वाग्रहों को प्रकट करने के लिए 33,000 भूमिका-विशिष्ट प्रश्नों के एक नए जनरेट किए गए डेटासेट का उपयोग किया गया है।

Xinyue Li, Zhenpeng Chen, Jie M. Zhang, Ying Xiao, Tianlin Li, Weisong Sun, Yang Liu, Yiling Lou, Xuanzhe Liu2026-04-23
📊 statistics

Recency Biased Causal Attention for Time-series Forecasting

यह शोध पत्र एक सरल तंत्र का प्रस्ताव करता है जो स्लोथ हेवी-टेल्ड डिसे (smooth heavy-tailed decay) के साथ स्कोर को पुनर्वितरित करके ट्रांसफॉर्मर अटेंशन में रिसेंसी बायस (recency bias) पेश करता है, जिससे लंबी अवधि के सहसंबंधों को पकड़ने की लचीलापन बनाए रखते हुए स्थानीय अस्थायी निर्भरताओं को बढ़ाया जाता है और टाइम-सीरीज फोरकास्टिंग बेंचमार्क पर बेहतर प्रदर्शन प्राप्त किया जाता है।

Kareem Hegazy, Michael W. Mahoney, N. Benjamin Erichson2026-04-23
💬 NLP

Caught in the Web of Words: Do LLMs Fall for Spin in Medical Literature?

यह अध्ययन प्रकट करता है कि जबकि मूल्यांकित किए गए 22 लार्ज लैंग्वेज मॉडल्स (Large Language Models) आम तौर पर चिकित्सा साहित्य में मनुष्यों की तुलना में 'स्पिन' (पक्षपाती दृष्टिकोण) के प्रति अधिक संवेदनशील होते हैं और अपने सारांशों में इसे प्रसारित कर सकते हैं, उन्हें इस तरह के पूर्वाग्रह को पहचानने और कम करने के लिए प्रभावी ढंग से प्रॉम्प्ट किया जा सकता है।

Hye Sun Yun, Karen Y. C. Zhang, Ramez Kouzy, Iain J. Marshall, Junyi Jessy Li, Byron C. Wallace2026-04-23
💻 computer science

A Survey of Scaling in Large Language Model Reasoning

यह सर्वेक्षण लार्ज लैंग्वेज मॉडल रीजनिंग में स्केलिंग रणनीतियों के जटिल परिदृश्य का व्यापक रूप से परीक्षण करता है, जो प्रदर्शन पर उनके प्रभावों का विश्लेषण करने और भविष्य के एआई विकास को निर्देशित करने के लिए उन्हें इनपुट आकार, रीजनिंग स्टेप्स, इटरेटिव राउंड्स और ट्रेनिंग-एनेबल्ड ऑप्टिमाइज़ेशन जैसे आयामों में वर्गीकृत करता है।

Zihan Chen, Song Wang, Zhen Tan, Xingbo Fu, Zhenyu Lei, Peng Wang, Huan Liu, Cong Shen, Jundong Li2026-04-23
🤖 AI

Integrating Column Generation and Large Neighborhood Search for Bus Driver Scheduling with Complex Break Constraints

यह शोध पत्र एक हाइब्रिड अनुकूलन ढांचे (hybrid optimization framework) को प्रस्तुत करता है जो विभिन्न इंस्टेंस आकारों में बस ड्राइवर शेड्यूलिंग समस्या के लिए अत्याधुनिक समाधान प्राप्त करने हेतु साझा कॉलम जनरेशन (shared column generation) का उपयोग करते हुए, ब्रांच एंड प्राइस (Branch and Price) को लार्ज नेबरहुड सर्च (Large Neighborhood Search) के साथ घनिष्ठ रूप से एकीकृत करता है।

Lucas Kletzander, Tommaso Mannelli Mazzoli, Nysret Musliu, Pascal Van Hentenryck2026-04-23
💻 computer science

SweRank: Software Issue Localization with Code Ranking

यह शोध पत्र SweRank को प्रस्तुत करता है, जो सॉफ़्टवेयर इश्यू लोकलाइजेशन के लिए एक कुशल रिट्रीव-एंड-रीरैंक फ्रेमवर्क है, जो बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करने के लिए नव-निर्मित SweLoc डेटासेट का लाभ उठाता है और साथ ही क्लोज्ड-सोर्स LLM एजेंट-आधारित दृष्टिकोणों की लागत और विलंबता (लेटेंसी) को भी पीछे छोड़ देता है।

Revanth Gangi Reddy, Tarun Suresh, JaeHyeok Doo, Ye Liu, Xuan Phi Nguyen, Yingbo Zhou, Semih Yavuz, Caiming Xiong, Heng (…)2026-04-23
🤖 machine learning

On the Existence of Universal Simulators of Attention

यह शोध पत्र एक सार्वभौमिक सिम्युलेटर के अस्तित्व को स्थापित करता है जो ट्रांसफॉर्मर एनकोडर्स से बना है और जो RASP फ्रेमवर्क के माध्यम से मनमाने वैनिला अटेंशन मैकेनिज्म और उनके अंतर्निहित ऑपरेशन्स को एल्गोरिद्मिक और नियत रूप से पुनरुत्पादित कर सकता है, जिससे एक डेटा-अज्ञेय (data-agnostic) समाधान प्राप्त होता है जहाँ पिछले दृष्टिकोण संभाव्य शिक्षण (probabilistic learning) पर निर्भर थे।

Debanjan Dutta, Anish Chakrabarty, Faizanuddin Ansari, Swagatam Das2026-04-23