💻 computer science

Transient Turn Injection: Exposing Stateless Multi-Turn Vulnerabilities in Large Language Models

यह शोध पत्र ट्रांजिएंट टर्न इंजेक्शन (TTI) को प्रस्तुत करता है, जो एक नवीन मल्टी-टर्न हमला तकनीक है जो अलग-थलग अंतःक्रियाओं में प्रतिकूल इरादे को वितरित करके स्टेटलेस मॉडरेशन का लाभ उठाती है, जो अग्रणी लार्ज लैंग्वेज मॉडल्स में महत्वपूर्ण सुरक्षा कमजोरियों को उजागर करती है और संदर्भ-जागरूक रक्षा प्रणालियों की तत्काल आवश्यकता पर बल देती है।

Naheed Rayhan, Sohely Jahan2026-04-24
⚡ electrical engineering

A Multi-Stage Warm-Start Deep Learning Framework for Unit Commitment

यह शोध पत्र एक बहु-चरणीय डीप लर्निंग फ्रेमवर्क प्रस्तावित करता है जो यूनिट कमिटमेंट समस्या के लिए व्यवहार्य, लागत प्रभावी वॉर्म-स्टार्ट समाधान उत्पन्न करने हेतु ट्रांसफार्मर-आधारित प्रेडिक्टर को नियततावादी ह्यूरिस्टिक्स (deterministic heuristics) के साथ जोड़ता है, जो गणना समय को महत्वपूर्ण रूप से तेज करता है और कभी-कभी पारंपरिक MILP सॉल्वर से बेहतर प्रदर्शन भी करता है।

Muhy Eddin Za'ter, Anna Van Boven, Bri-Mathias Hodge, Kyri Baker2026-04-24
💻 computer science

Nemobot Games: Crafting Strategic AI Gaming Agents for Interactive Learning with Large Language Models

यह शोध पत्र नेमोबॉट (Nemobot) का परिचय देता है, जो एक संवादात्मक एजेंटिक वातावरण है जो शैनन के गेम-प्लेइंग मशीनों के वर्गीकरण को विस्तारित करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे गणितीय तर्क, क्राउड-सोर्स्ड डेटा सिंथेसिस और ह्यूमन फीडबैक के साथ सुदृढीकरण शिक्षण (reinforcement learning) जैसी विधियों के माध्यम से डिक्शनरी-आधारित, समाधान योग्य, ह्यूरिस्टिक और लर्निंग-आधारित खेलों में रणनीतिक एआई एजेंटों के निर्माण और स्व-प्रोग्रामिंग को सक्षम बनाया जा सके।

Chee Wei Tan, Yuchen Wang, Shangxin Guo2026-04-24
🤖 machine learning

A Scale-Adaptive Framework for Joint Spatiotemporal Super-Resolution with Diffusion Models

यह शोधपत्र एक स्केल-अनुकूली ढांचे (scale-adaptive framework) को प्रस्तुत करता है जो विविध स्थानिक और कालिक कारकों के माध्यम से एकल आर्किटेक्चर का उपयोग करके संयुक्त स्थानिक-कालिक वीडियो सुपर-रिज़ॉल्यूशन को एकीकृत करता है, जो इस कार्य को प्रदर्शन और द्रव्यमान संरक्षण (mass conservation) बनाए रखने के लिए प्रमुख हाइपरपैरामीटर्स को समायोजित करते हुए एक नियतात्मक सशर्त माध्य भविष्यवाणी (deterministic conditional mean prediction) और एक अवशिष्ट प्रसार मॉडल (residual diffusion model) में विभाजित करता है।

Max Defez, Filippo Quarenghi, Mathieu Vrac, Stephan Mandt, Tom Beucler2026-04-24
💻 computer science

Equity Bias: An Ethical Framework for AI Design

हर्मेन्यूटिक दर्शन और एपिस्टेमिक इनजस्टिस थ्योरी (ज्ञान संबंधी अन्याय के सिद्धांत) पर आधारित, यह शोध पत्र "इक्विटी बायस" (समता पक्षपात) का प्रस्ताव करता है, जो एक ढांचा है जो एआई पक्षपात को समाप्त करने योग्य त्रुटि के बजाय एनकोडेड ज्ञान के एक पारदर्शी प्रतिबिंब के रूप में पुनर्गठित करता है, और नैतिक रूप से जवाबदेह एवं समतापूर्ण एआई प्रणालियों को बढ़ावा देने के लिए पुरातत्व, सहभागी डिजाइन और निरंतर जवाबदेही के तीन चरणों वाले जीवन चक्र का उपयोग करता है।

Mary Lockwood2026-04-24
💬 NLP

When Prompts Override Vision: Prompt-Induced Hallucinations in LVLMs

यह शोध पत्र HalluScope प्रस्तुत करता है, जो यह प्रकट करता है कि लार्ज विजन-लैंग्वेज मॉडल्स में मतिभ्रम (hallucinations) मुख्य रूप से टेक्स्टुअल इंस्ट्रक्शन प्रायर्स (textual instruction priors) द्वारा संचालित होते हैं, और HalluVL-DPO का प्रस्ताव करता है जो एक प्रिफरेंस ऑप्टिमाइज़ेशन फ्रेमवर्क है जो विजुअल क्षमताओं को संरक्षित करते हुए इन प्रॉम्प्ट-प्रेरित मतिभ्रमों को प्रभावी ढंग से कम करता है।

Pegah Khayatan, Jayneel Parekh, Arnaud Dapogny, Mustafa Shukor, Alasdair Newson, Matthieu Cord2026-04-24
💻 computer science

Seeing Fast and Slow: Learning the Flow of Time in Videos

यह शोधपत्र ऐसे स्व-पर्यवेक्षित (self-supervised) मॉडलों को प्रस्तुत करता है जो वीडियो प्लेबैक गति का पता लगाने और उसे नियंत्रित करने के लिए सीखते हैं, इन क्षमताओं का लाभ उठाकर एक विशाल स्लो-मोशन डेटासेट तैयार करते हैं और स्पीड-कंडीशन्ड वीडियो जनरेशन एवं टेम्पोरल सुपर-रिज़ॉल्यूशन जैसे उन्नत अनुप्रयोगों को सक्षम करते हैं।

Yen-Siang Wu, Rundong Luo, Jingsen Zhu, Tao Tu, Ali Farhadi, Matthew Wallingford, Yu-Chiang Frank Wang, Steve Marschner (…)2026-04-24
💻 computer science

Learning Multi-Modal Whole-Body Control for Real-World Humanoid Robots

यह शोध पत्र मास्कड ह्यूमनॉइड कंट्रोलर (MHC) को प्रस्तुत करता है, जो एक मल्टी-मोडल करिकुलम के माध्यम से प्रशिक्षित एक एकीकृत सीखा हुआ नियंत्रक है, जो वास्तविक दुनिया के ह्यूमनॉइड रोबोट्स को मास्कड टारगेट ट्रेजेक्टरीज पर आधारित एक एकल, लचीले इंटरफ़ेस के माध्यम से अनुकूलित प्रक्षेप पथों (ऑप्टिमाइज्ड ट्रेजेक्टरीज) से लेकर जॉयस्टिक टेलीऑपरेशन तक, विविध होल-बॉडी व्यवहार निष्पादित करने में सक्षम बनाता है।

Pranay Dugar, Aayam Shrestha, Fangzhou Yu, Bart van Marum, Alan Fern2026-04-23
💻 computer science

Fairness Testing of Large Language Models in Role-Playing

यह शोध पत्र रोल-प्लेइंग परिदृश्यों के दौरान लार्ज लैंग्वेज मॉडल्स (LLMs) में निष्पक्षता परीक्षण पर एक अनुभवजन्य अध्ययन प्रस्तुत करता है, जिसमें 10 उन्नत मॉडलों में व्यापक सामाजिक पूर्वाग्रहों को प्रकट करने के लिए 33,000 भूमिका-विशिष्ट प्रश्नों के एक नए जनरेट किए गए डेटासेट का उपयोग किया गया है।

Xinyue Li, Zhenpeng Chen, Jie M. Zhang, Ying Xiao, Tianlin Li, Weisong Sun, Yang Liu, Yiling Lou, Xuanzhe Liu2026-04-23
📊 statistics

Recency Biased Causal Attention for Time-series Forecasting

यह शोध पत्र एक सरल तंत्र का प्रस्ताव करता है जो स्लोथ हेवी-टेल्ड डिसे (smooth heavy-tailed decay) के साथ स्कोर को पुनर्वितरित करके ट्रांसफॉर्मर अटेंशन में रिसेंसी बायस (recency bias) पेश करता है, जिससे लंबी अवधि के सहसंबंधों को पकड़ने की लचीलापन बनाए रखते हुए स्थानीय अस्थायी निर्भरताओं को बढ़ाया जाता है और टाइम-सीरीज फोरकास्टिंग बेंचमार्क पर बेहतर प्रदर्शन प्राप्त किया जाता है।

Kareem Hegazy, Michael W. Mahoney, N. Benjamin Erichson2026-04-23