🔬 physics

Machine Learning for Electron-Scale Turbulence Modeling in W7-X

यह शोध पत्र वेन्डेलस्टीन 7-एक्स (Wendelstein 7-X) स्टेलरेटर में इलेक्ट्रॉन तापमान प्रवणता (ETG) टर्बुलेंस हीट फ्लक्स की भविष्यवाणी करने के लिए एक मशीन लर्निंग-संचालित, भौतिकी-निर्देशित रिड्यूस्ड मॉडल प्रस्तुत करता है, जो सक्रिय शिक्षण (active learning) और रेडियल इंटरपोलेशन के माध्यम से उच्च सटीकता प्राप्त करता है, लेकिन यह भी प्रकट करता है कि उपकरण की ज्यामिति-निर्भर परिवहन भौतिकी को पकड़ने के लिए एक एकल त्रिज्या-स्वतंत्र सूत्रीकरण अपर्याप्त है।

Ionut-Gabriel Farcas, Don Lawrence Carl Agapito Fernando, Alejandro Banon Navarro, Gabriele Merlo, Frank Jenko2026-06-08
🤖 machine learning

High entropy leads to symmetry-equivariant policies in Dec-POMDPs

यह शोध पत्र प्रदर्शित करता है कि Dec-POMDPs में उच्च एंट्रॉपी नियमितीकरण (high entropy regularization) सैद्धांतिक रूप से एक अद्वितीय, समरूपता-समतुल्य (symmetry-equivariant) नीति के अभिसरण की गारंटी देता है और अनुभवजन्य रूप से दिखाता है कि एंट्रॉपी गुणांकों को बढ़ाने से स्वतंत्र रूप से प्रशिक्षित एजेंटों के बीच क्रॉस-प्ले अनुकूलता में महत्वपूर्ण सुधार होता है, जो हनाबी (Hanabi) जैसे वातावरणों में नए अत्याधुनिक परिणाम सक्षम बनाता है।

Johannes Forkel, Constantin Ruhdorfer, Michael Beukman, Andreas Bulling, Jakob Foerster2026-06-08
🤖 machine learning

SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning

यह शोध पत्र RSA2C का प्रस्ताव करता है, जो एक व्याख्यात्मक सुदृढीकरण लर्निंग (explainable reinforcement learning) एल्गोरिदम है जो निरंतर नियंत्रण कार्यों (continuous control tasks) में बेहतर दक्षता, स्थिरता और व्याख्यात्मकता प्राप्त करने के लिए फीचर महत्व के आधार पर सीखने को गतिशील रूप से नियंत्रित करने हेतु एक कर्नलाइज़्ड एक्टर-क्रिटिक फ्रेमवर्क में RKHS-SHAP स्टेट एट्रिब्यूशन को एकीकृत करता है।

Na Li, Hangguan Shan, Wei Ni, Wenjie Zhang, Xinyu Li2026-06-08
💬 NLP

AutoTool: Dynamic Tool Selection and Integration for Agentic Reasoning

AutoTool एक प्रशिक्षण ढांचा है जो एक दो-चरणीय अनुकूलन पाइपलाइन और एक बड़े पैमाने के डेटासेट का उपयोग करके LLM एजेंटों की विकसित होते टूलसेट्स के प्रति अनुकूलन क्षमता को बढ़ाता है ताकि गतिशील टूल चयन को सक्षम किया जा सके, जिसके परिणामस्वरूप मौजूदा तरीकों की तुलना में विविध तर्क कार्यों में बेहतर प्रदर्शन प्राप्त होता है।

Jiaru Zou, Ling Yang, Yunzhe Qi, Sirui Chen, Mengting Ai, Ke Shen, Jingrui He, Mengdi Wang2026-06-08
🤖 machine learning

Generalization of Diffusion Models Arises with a Balanced Representation Space

यह शोध पत्र स्थापित करता है कि डिफ्यूजन मॉडल्स में सामान्यीकरण (generalization), स्थानीय डेटा सांख्यिकी को कैप्चर करने वाले संतुलित निरूपणों (balanced representations) को सीखने से उत्पन्न होता है, जबकि रट्टा मारना (memorization), कच्चे नमूनों को स्थानीयकृत स्पाइकी निरूपणों (localized spiky representations) के रूप में संग्रहीत करने से होता है, एक ऐसा निष्कर्ष जो बिना पुन: प्रशिक्षण के रट्टा मारने का पता लगाने और जनरेशन को निर्देशित करने के लिए नए तरीकों को सक्षम बनाता है।

Zekai Zhang, Xiao Li, Xiang Li, Lianghe Shi, Meng Wu, Molei Tao, Qing Qu2026-06-08
💬 NLP

AdaJudge: Adaptive Multi-Perspective Judging for Reward Modeling

AdaJudge एक एकीकृत ढांचा है जो बैकबोन रिप्रेजेंटेशन्स को भेदभाव-उन्मुख स्थान में संयुक्त रूप से अनुकूलित करके और स्टैटिक पूलिंग को एक एडेप्टिव मल्टी-व्यू एग्रीगेशन मॉड्यूल से बदलकर रिवॉर्ड मॉडलिंग को बढ़ाता है, जिससे यह प्रमुख बेंचमार्क पर मौजूदा मॉडलों से बेहतर प्रदर्शन करता है।

Yongliang Miao, Yangyang Liang, Mengnan Du2026-06-08
🤖 AI

E2Former-V2: On-the-Fly Equivariant Attention with Linear Activation Memory

E2Former-V2 एक स्केलेबल इक्विवेरिएंट ग्राफ न्यूरल नेटवर्क आर्किटेक्चर है जो इक्विवेरिएंट एक्सिस-अलाइन्ड स्पारसिफिकेशन और ऑन-द-फ्लाई इक्विवेरिएंट अटेंशन मैकेनिज्म पेश करके मुख्यधारा के मॉडल्स की कम्प्यूटेशनल बाधाओं को दूर करता है, जिससे 3D एटोमिस्टिक सिस्टम्स पर प्रेडिक्टिव परफॉरमेंस बनाए रखते हुए 20-गुना TFLOPS सुधार प्राप्त होता है।

Lin Huang, Chengxiang Huang, Ziang Wang, Yiyue Du, Chu Wang, Haocheng Lu, Yunyang Li, Xiaoli Liu, Arthur Jiang, Jia Zhan (…)2026-06-08
⚛️ quantum physics

Privacy Implies Stability: Information-Theoretic Generalization Bounds for Quantum Learning

यह शोध पत्र क्वांटम लर्निंग में स्थिरता, गोपनीयता और सामान्यीकरण (जनरलाइजेशन) को जोड़ने वाला एक सूचना-सैद्धांतिक ढांचा स्थापित करता है, जिसमें यह सिद्ध किया गया है कि क्वांटम डिफरेंशियल प्राइवेसी विश्वसनीय परिवेशों में सामान्यीकरण सुनिश्चित करती है और सूचना-सैद्धांतिक स्वीकार्यता (इन्फॉर्मेशन-थियोरेटिक एडमिसिबिलिटी) को पेश किया गया है जो अनभरोसेमंद परिवेशों में सामान्यीकरण की गारंटी देता है, जो गोपनीयता और सूचना सुलभता के बीच के शास्त्रीय तनाव को हल करने के लिए क्वांटम गैर-लंबवतता (नॉन-ऑर्थोगोनैलिटी) का लाभ उठाता है।

Ayanava Dasgupta, Naqueeb Ahmad Warsi, Masahito Hayashi2026-06-08
💬 NLP

Rethinking Genomic Modeling Through Optical Character Recognition

OpticalDNA एक नवीन विज़न-आधारित ढांचे को पेश करता है जो जीनोमिक मॉडलिंग को ऑप्टिकल कैरेक्टर रिकग्निशन (OCR) कार्य के रूप में पुनर्गठित करता है, जिससे डीएनए अनुक्रमों को संरचित दृश्य लेआउट में परिवर्तित किया जाता है ताकि पारंपरिक लैंग्वेज मॉडल दृष्टिकोणों की तुलना में काफी कम टोकन और प्रशिक्षित मापदंडों के साथ बेहतर प्रदर्शन और उच्च-सटीक संपीड़न प्राप्त किया जा सके।

Hongxin Xiang, Pengsen Ma, Yunkang Cao, Di Yu, Haowen Chen, Xinyu Yang, Xiangxiang Zeng2026-06-08