🤖 AI

Reward Redistribution for CVaR MDPs using a Bellman Operator on L-infinity

यह शोध पत्र मार्कोव डिसीजन प्रोसेसिस (Markov Decision Processes) में स्टैटिक कंडीशनल वैल्यू-एट-रिस्क (CVaR) के लिए एक नवीन स्टेट-ऑगमेंटेशन फॉर्मूलेशन प्रस्तावित करता है जो सघन पुरस्कारों (dense rewards) और एक कॉन्ट्रैक्टिंग बेलमैन ऑपरेटर को सक्षम बनाता है, जिससे अभिसरण योग्य जोखिम-अवरोधक वैल्यू इटरेशन और Q-लर्निंग एल्गोरिदम प्राप्त होते हैं जिनके प्रमाणित सन्निकटन सीमाएँ (approximation bounds) और प्रभावी सुरक्षा-प्रदर्शन ट्रेड-ऑफ्स हैं।

Aneri Muni, Vincent Taboga, Esther Derman, Pierre-Luc Bacon, Erick Delage2026-07-01
📈 economics

DeXposure-FM: A Time-series, Graph Foundation Model for Credit Exposures and Stability on Decentralized Financial Networks

DeXposure-FM एक नवीन टाइम-सीरीज ग्राफ फाउंडेशन मॉडल है जिसे एक विशाल मल्टी-चेन डेटासेट पर प्रशिक्षित किया गया है जो DeFi क्रेडिट एक्सपोजर के पूर्वानुमान में मौजूदा तरीकों से बेहतर प्रदर्शन करता है और मैक्रोप्रूडेंशियल निगरानी तथा प्रणालीगत जोखिम स्ट्रेस टेस्टिंग के लिए आवश्यक उपकरण प्रदान करता है।

Aijie Shu, Wenbin Wu, Gbenga Ibikunle, Fengxiang He2026-07-01
🤖 AI

Improved Upper Bounds for Slicing the Hypercube

यह शोध पत्र एक nn-आयामी हाइपरक्यूब के सभी किनारों (edges) को काटने के लिए आवश्यक हाइपरप्लेन की न्यूनतम संख्या के ज्ञात ऊपरी बाउंड (upper bound) को 5n/6\lceil 5n/6 \rceil से घटाकर लगभग 4n/54n/5 तक सुधारता है, जो कि CPro1 टूल का उपयोग करके n=10n=10 के लिए एक विशिष्ट समाधान का निर्माण करके प्राप्त किया गया है, जो रीजनिंग LLMs को ऑटोमेटेड हाइपरपैरामीटर ट्यूनिंग के साथ जोड़ता है।

Duncan Soiffer, Nathaniel Itty, Christopher D. Rosin, Blake Bruell, Mason DiCicco, Gábor N. Sárközy, Ryan Offstein, Dani (…)2026-07-01
⚡ electrical engineering

Lyapunov-Certified Direct Switching Theory for Q-Learning

यह शोध पत्र Q-लर्निंग के त्रुटि गतिकी (error dynamics) को एक स्टोकेस्टिक स्विचिंग लीनियर सिस्टम के रूप में मॉडल करके इसके विश्लेषण के लिए एक नवीन ढांचे को प्रस्तुत करता है, जो जॉइंट स्पेक्ट्रल रेडियस पर आधारित एक परिमित-समय अभिसरण दर (finite-time convergence rate) विश्लेषण को सक्षम बनाता है जो पारंपरिक रो-सम विधियों की तुलना में अधिक सटीक वर्स्ट-केस एक्सपोनेंशियल बाउंड्स प्रदान करता है।

Donghwan Lee2026-07-01
🤖 AI

Don't Gamble, GAMBLe: An Analytical Framework for AI-Driven Research Systems

यह शोध पत्र GAMBLe को प्रस्तुत करता है, जो एक विश्लेषणात्मक ढांचा है जो AI-संचालित अनुसंधान प्रणालियों को चार प्रमुख मापदंडों और एक प्रभावी परिदृश्य में विभाजित करता है ताकि यह प्रदर्शित किया जा सके कि घटक अंतःक्रियाएं, न कि केवल मॉडल का आकार या तंत्र की जटिलता, प्रदर्शन निर्धारित करती हैं, जिससे यह प्रकट होता है कि इष्टतम विन्यास घटकों के सार्वभौमिक पदानुक्रम के बिना भी महत्वपूर्ण दक्षता लाभ प्रदान कर सकते हैं।

Marquita Ellis, Paul Castro2026-07-01
💻 computer science

ASR-Agnostic Multimodal Spectrotemporal Modeling for Early Dementia Detection

यह शोध पत्र एक ASR-अज्ञेय (ASR-agnostic) मल्टीमॉडल ढांचे का प्रस्ताव करता है जो प्रारंभिक डिमेंशिया का पता लगाने के लिए मेल स्पेक्ट्रोग्राम से स्पेक्ट्रोटेम्पोरल विस्थापन क्षेत्रों (spectrotemporal displacement fields) को निकालता है, और अंग्रेजी, स्लोवाक और स्पेनिश कॉर्पोरा पर क्रॉस-लिंगुअल प्रयोगों के माध्यम से यह प्रदर्शित करता है कि मल्टीमॉडल फ्यूजन की प्रभावकारिता अत्यधिक कॉर्पस-निर्भर है, जो वितरित संकेतों (distributed signals) के लिए आवश्यक, एक एकल मोडैलिटी के प्रभुत्व होने पर प्रतिकूल, या संकेत मौजूद न होने पर अप्रासंगिक होती है।

Chukwuemeka Ugwu, Oluwafemi Richard Oyeleke2026-07-01
💻 computer science

Qualified Educational Capacity Planning under Heterogeneous Student Support Needs: A Synthetic Benchmark and Decision-Support Framework

यह शोध पत्र शैक्षिक क्षमता नियोजन के लिए एक सिंथेटिक बेंचमार्क और निर्णय-सहायता ढांचा प्रस्तुत करता है जो एक महत्वपूर्ण शासन सीमा (रेजीम बाउंड्री) को प्रकट करता है जहाँ नियंत्रक केवल तभी सफल होते हैं यदि वे अपनी प्रतिक्रिया क्षितिज (रिएक्शन होराइजन) के भीतर नई योग्यताएं प्राप्त कर सकें, अन्यथा वे प्रतिक्रियात्मक प्रशिक्षण के बजाय स्थिर बीमा रणनीतियों को प्राथमिकता देते हैं।

Carlos Eduardo Sanoja, Oscar Enrique Moreno Mayz2026-07-01
💻 computer science

Can Physician Expertise Improve Machine Learning Identification of Delirium?

यह शोधपत्र एक उपयोगकर्ता-केंद्रित इंटरैक्टिव मशीन लर्निंग फ्रेमवर्क प्रस्तुत करता है जो स्वचालित बेसलाइन विधियों की तुलना में अस्पताल में भर्ती रोगियों में डेलिरियम (मानसिक भ्रम) का पता लगाने की विभेदन क्षमता और टेम्पोरल मजबूती को महत्वपूर्ण रूप से सुधारने के लिए चिकित्सक-निर्देशित फीचर रिफाइनमेंट को व्याख्या योग्य मॉडलिंग के साथ एकीकृत करता है।

Xinyu Qin, Vicky Ye, Ruiheng Yu, Lu Wang2026-07-01
💻 computer science

The Consistency Dilemma in LLMs: Generator-Evaluator Agreement and Vulnerability to Mistakes

यह शोध पत्र जनरेटर-इवैल्यूएटर स्व-संगति (self-consistency) के एक माप को प्रस्तुत करता है ताकि बड़े भाषा मॉडलों (large language models) में एक महत्वपूर्ण दुविधा को उजागर किया जा सके: जबकि अवधारणाओं को लागू करने में उच्च संगति परिचालन रूप से उपयोगी होती है, यह विरोधाभासी रूप से नैदानिक सेटिंग्स में गलतियों के प्रति अधिक संवेदनशीलता से जुड़ी होती है, जो यह सुझाव देती है कि सुसंगत मॉडल अनिवार्य रूप से तैनाती के लिए सुरक्षित नहीं हैं।

Marina Mancoridis, Zoë Hitzig2026-07-01
💻 computer science

Toward AI-Resilient Assessment in Computer Science Courses in an AI-Native World

यह शोधपत्र कंप्यूटर विज्ञान में एआई-लचीले (AI-resilient) मूल्यांकन के लिए एक औपचारिक ढांचे का प्रस्ताव करता है जो छात्रों को उनके "पारेटो अधिशेष" (Pareto surplus) के आधार पर ग्रेड देता है—जो एक घोषित एआई आधार रेखा से परे उनके द्वारा प्राप्त मापने योग्य प्रदर्शन सुधार है—जबकि निर्बाध एआई उपयोग की अनुमति देता है और वास्तविक कौशल को सत्यापित करने के लिए पूरक प्रोटोकॉल की आवश्यकता रखता है।

Anshumali Shrivastava2026-07-01