📊 statistics

Sticky Jump Diffusions: A Unifying View of Masked, Continuous, and Hybrid Diffusion

यह शोध पत्र स्टिकी जंप डिफ्यूजनों (SJDs) को प्रस्तुत करता है, जो एक एकीकृत निरंतर-समय मार्कोव ढांचा है जो मास्क किए गए, निरंतर और हाइब्रिड डिफ्यूजन मॉडलों को सीमाओं के रूप में प्राप्त करता है और डैनोइजिंग हैजर्ड मैचिंग के माध्यम से सिमुलेशन-मुक्त प्रशिक्षण सक्षम करता है, जबकि भ्रष्टाचार कर्नेल (corruption kernels) के लिए एक लचीला डिज़ाइन स्पेस प्रदान करता है जो CIFAR-10, Text8 और Sudoku जैसे कार्यों पर प्रदर्शन में सुधार करता है।

Pascal Jutras-Dubé, Patrick Pynadath, Jeremy Lu, Yuan Gao, Ruqi Zhang2026-07-14
💰 quantitative finance

Reinforcement Learning for Execution under Dynamic Fees in a Closed-Loop DEX Simulator

यह शोध पत्र एक क्लोज्ड-लूप DEX सिम्युलेटर पेश करता है यह प्रदर्शित करने के लिए कि एक छोटा डीप क्यू-नेटवर्क (DQN) एजेंट विशेष रूप से डायनेमिक-फी वातावरण में ट्यून्ड बेंचमार्क की तुलना में इम्प्लीमेंटेशन शॉर्टफॉल को महत्वपूर्ण रूप से कम करता है, जो ऑटोमेटेड मार्केट मेकर्स में निष्पादन नियंत्रण (एग्जीक्यूशन कंट्रोल) के लिए मॉडल-कंडीशन्ड काउंटरफैक्चुअल साक्ष्य प्रदान करता है।

Wen-Ting Wang2026-07-14
🤖 AI

CGS: Configurable Graph Summarization with Bounded Neighborhood Loss and Query Support

यह शोध पत्र CGS का प्रस्ताव करता है, जो एक नवीन कॉन्फ़िगर करने योग्य ग्राफ़ सारांशीकरण ढांचा (framework) है जो लॉसलेस परिणामों या सीमित पड़ोस हानि (neighborhood loss) के साथ कई ग्राफ़ प्रश्नों का समर्थन करने के लिए सामान्य पड़ोस वाले नोड्स को एकत्रित करके संक्षिप्त सारांश उत्पन्न करता है, जबकि उपयोगकर्ताओं को सहने योग्य त्रुटि प्रकारों और थ्रेशोल्ड को अनुकूलित करने की अनुमति देता है।

Shubhadip Mitra, Sona Elza Simon, C Oswald, Arnab Bhattacharya, Arindam Pal2026-07-14
🤖 machine learning

Enhanced Byzantine-Robust Federated Learning Via Truncated-Quadratic Loss for Heterogeneous Data

यह शोध पत्र एक नवीन बायज़ेंटाइन-रोबस्ट (Byzantine-robust) फेडरेटेड लर्निंग फ्रेमवर्क प्रस्तावित करता है जो एक ट्रंकेटेड-क्वाड्रेटिक लॉस-आधारित एग्रीगेशन नियम का उपयोग करता है जो सेंटर्ड क्लिपिंग और हबर एग्रीगेटर्स जैसी मौजूदा विधियों की पूर्वाग्रह सीमाओं को दूर करता है, गैर-कनवेक्स लॉस और विषम डेटा के तहत ऑर्डर-ऑप्टिमल प्रदर्शन प्राप्त करता है और अनुमानित आउटलेयर गणनाओं के साथ भी मजबूती बनाए रखता है।

Zhi-Yong Wang, Hao Nan Sheng, Werner Stefan, Hing Cheung So, Linqi Song, Weitao Xu2026-07-14
🤖 AI

EquiFusion: Kinematics-Agnostic Human Motion Prediction via Equivariant Latent Diffusion

EquiFusion एक परम्यूटेशन इक्विवैरिएंट लेटेंट डिफ्यूजन आर्किटेक्चर का उपयोग करने वाला पहला किनेमैटिक्स-अज्ञेय मानव गति भविष्यवाणी मॉडल पेश करता है जो कंकाल की कनेक्टिविटी को एक स्पष्ट इनपुट के रूप में मानता है, जिससे उत्कृष्ट क्रॉस-डेटासेट सामान्यीकरण, ज़ीरो-शॉट क्षमताएं, और पिछले तरीकों की तुलना में काफी अधिक दक्षता के साथ अत्याधुनिक प्रदर्शन सक्षम होता है।

Cecilia Curreli, Florian Hofherr, Dominik Muhle, Abhishek Saroha, Riccardo Marin, Daniel Cremers2026-07-14
📊 statistics

Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies

यह शोधपत्र नियतकालिक नीतियों (deterministic policies) के साथ विस्तारित मीन फील्ड कंट्रोल (mean field control) के लिए एक मॉडल-मुक्त, निरंतर-समय एक्टर-क्रिटिक सुदृढीकरण शिक्षण ढांचे का प्रस्ताव करता है, जो माप व्युत्पन्न (measure derivatives) से जुड़े एक परिष्कृत पॉलिसी ग्रेडिएंट फॉर्मूला का लाभ उठाता है ताकि उन समस्याओं के लिए कुशल और सुदृढ़ समाधान सक्षम किए जा सकें जहाँ गतिकी (dynamics) और पुरस्कार संयुक्त अवस्था-क्रिया वितरण (joint state-action distribution) पर निर्भर करते हैं।

Ziheng Cheng, Xin Guo, Huyên Pham, Yufei Zhang2026-07-14
⚛️ quantum physics

Overcoming Fourier Locking in Quantum Data Re-uploading Classifiers via Spectral Homotopy

यह शोध पत्र डेटा री-अपलोडिंग क्वांटम क्लासिफायर में "फूरियर लॉकिंग" को प्राथमिक अनुकूलन बाधा (ऑप्टिमाइज़ेशन बॉटलनैक) के रूप में पहचानता है, जहाँ रैंडम इनिशियलाइज़ेशन स्पेक्ट्रल मिसअलाइनमेंट के कारण मॉडलों को स्प्यूरियस मिनिमा (मिथ्या स्थानीय न्यूनतम) में फँसा देता है, और एक स्पेक्ट्रल होमोटॉपी करिकुलम का प्रस्ताव करता है जो लॉस लैंडस्केप को उत्तलता (कॉन्वेक्सिफाई) बनाने और एस्केप रेट्स में महत्वपूर्ण सुधार करने के लिए लक्षित आवृत्तियों को क्रमिक रूप से बढ़ाता है।

Spencer Topel2026-07-14
💬 NLP

Can a Language Model Learn Facts Continually in Its Weights?

यह शोध पत्र यह प्रदर्शित करता है कि जबकि व्यापक प्रशिक्षण डेटा भाषा मॉडलों को नग्न कथनों की तुलना में अपने भार (weights) में नए तथ्यों को अधिक प्रभावी ढंग से संग्रहीत करने में सक्षम बनाता है, निरंतर भार-आधारित सीखना अपरिहार्य रूप से विनाशकारी विस्मृति (catastrophic forgetting) और हस्तक्षेप का कारण बनता है, जिससे संदर्भ (context) क्रमिक अपडेट के माध्यम से ज्ञान को संरक्षित करने और संयोजित करने के लिए एकमात्र विश्वसनीय माध्यम बन जाता है।

Charles O'Neill2026-07-14
💬 NLP

When the Reward Suite Is Leaky: A Preregistered Causal Contrast of Natural Verifier False Positives in RLVR

यह पूर्व-पंजीकृत कारण संबंधी अध्ययन (causal study) प्रदर्शित करता है कि कोड रिवॉर्ड सूट्स में प्राकृतिक 'फॉल्स पॉजिटिव' (false positives) व्यवस्थित रूप से RLVR प्रदर्शन मेट्रिक्स को बढ़ा देते हैं क्योंकि वे केवल सूट आर्टिफैक्ट्स के बजाय वास्तव में त्रुटिपूर्ण कोड को पुरस्कृत करते हैं, एक ऐसी घटना जिसे सस्ते स्टैटिक ऑडिट के माध्यम से पहचाना जा सकता है लेकिन जिसे सुधारने पर क्षमता में न्यूनतम लाभ प्राप्त होता है।

Chuyifei Zhang2026-07-14
🤖 machine learning

MMRM: A Multiplex Multimodal Representation Model for Product Ranking in E-commerce Search

यह शोध पत्र MMRM का प्रस्ताव करता है, जो एक एकीकृत ढांचा है जो विविध सहयोगात्मक संकेतों के साथ मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स को संरेखित करता है ताकि मल्टीप्लेक्स आइटम और यूजर रिप्रेजेंटेशन उत्पन्न किए जा सकें, जिससे JD सर्च इंजन में ई-कॉमर्स सर्च रैंकिंग प्रदर्शन और दक्षता में महत्वपूर्ण सुधार होता है।

Zhen-Lin Chen, Maosen Sheng, Peng Lin, Jianmin Chen, Zhuojian Xiao, Dongyue Wang, Xiwei Zhao2026-07-14