📊 statistics

Tricks and Plug-ins for Gradient Boosting in Image Classification

यह शोध पत्र एक नवीन ढांचे को प्रस्तुत करता है जो इमेज क्लासिफिकेशन के लिए कॉन्वोल्यूशनल न्यूरल नेटवर्क्स को डायनेमिक फीचर सिलेक्शन, सबग्रिड सिलेक्शन और इम्पोर्टेंस सैंपलिंग को एक बूस्टिंग-आधारित प्रशिक्षण प्रक्रिया में एकीकृत करके उन्नत करता है, जिसके परिणामस्वरूप मैनुअल आर्किटेक्चर ट्यूनिंग की आवश्यकता को कम करते हुए सटीकता और दक्षता में सुधार होता है।

Biyi Fang, Truong Vo, Jean Utke, Diego Klabjan2026-06-02
🤖 machine learning

Graph is a Natural Regularization: Revisiting Vector Quantization for Graph Representation Learning

यह शोध पत्र डेटा गुणों और नियत प्रशिक्षण गतिकी (deterministic training dynamics) के कारण ग्राफ वेक्टर क्वांटाइजेशन में कोडबुक कोलैप्स को एक महत्वपूर्ण बाधा के रूप में पहचानता है, और RGVQ प्रस्तावित करता है, जो एक नवीन ढांचा है जो कोडबुक उपयोगिता को बढ़ाने और डाउनस्ट्रीम प्रदर्शन में सुधार करने के लिए ग्राफ टोपोलॉजी और सॉफ्ट असाइनमेंट का स्पष्ट नियमितीकरण (explicit regularization) के रूप में लाभ उठाता है।

Zian Zhai, Fan Li, Xingyu Tan, Xiaoyang Wang, Wenjie Zhang2026-06-02
🤖 AI

Position: Beyond Sensitive Attributes, ML Fairness Should Quantify Structural Injustice via Social Determinants

यह शोध-पत्र तर्क देता है कि एल्गोरिद्मिक निष्पक्षता अनुसंधान को केवल संवेदनशील विशेषताओं पर ध्यान केंद्रित करने से आगे बढ़कर सामाजिक निर्धारकों के माध्यम से संरचनात्मक अन्याय को मापने की ओर बढ़ना चाहिए, जो यह प्रदर्शित करता है कि वर्तमान शमन रणनीतियाँ अक्सर व्यवस्थित असमानताओं को संबोधित करने में विफल रहती हैं और वास्तव में उन्हें बढ़ा भी सकती हैं।

Zeyu Tang, Alex John London, Atoosa Kasirzadeh, Sarah Stewart de Ramirez, Peter Spirtes, Kun Zhang, Sanmi Koyejo2026-06-02
🤖 machine learning

An Improved Algorithm for Adversarial Linear Contextual Bandits via Reduction

यह शोध पत्र एक ओरकल-कुशल (oracle-efficient), निकट-इष्टतम (near-optimal) एल्गोरिदम प्रस्तुत करता है जो संदर्भ वितरण (context distribution) के ज्ञान की आवश्यकता के बिना, स्टोकेस्टिक एक्शन सेट्स वाले एडवरसेरियल लीनियर कॉन्टेक्स्टुअल बैंडिट्स के लिए poly(d)T\mathrm{poly}(d)\sqrt{T} रिग्रेट को बहुपद समय (polynomial time) में प्राप्त करके एक खुले प्रश्न को हल करता है।

Tim van Erven, Jack Mayo, Julia Olkhovskaya, Chen-Yu Wei2026-06-02
🤖 machine learning

TuneAgent: Agentic Operating System Kernel Tuning with Reinforcement Learning

TuneAgent एक एजेंटिक फ्रेमवर्क है जो लिनक्स कर्नेल कॉन्फ़िगरेशन को स्वायत्त और सुरक्षित रूप से अनुकूलित करने के लिए नियम-आधारित सुदृढीकरण लर्निंग (rule-based reinforcement learning) और लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जो स्पर्स फीडबैक (sparse feedback) और वर्कलोड संवेदनशीलता जैसी चुनौतियों का समाधान करने वाली एक संरचित दो-चरणीय प्रशिक्षण रणनीति के माध्यम से महत्वपूर्ण प्रदर्शन सुधार प्राप्त करता है।

Hongyu Lin, Yuchen Li, Haoran Luo, Zhenghong Lin, Libo Zhang, Mingjie Xing, Yanjun Wu2026-06-02
📊 statistics

Off-Policy Learning in Large Action Spaces: Optimization Matters More Than Estimation

यह शोध पत्र यह प्रदर्शित करता है कि बड़े एक्शन स्पेस में ऑफ-पॉलिसी लर्निंग के लिए, केवल ऑफ-पॉलिसी एस्टिमेटर्स के सांख्यिकीय गुणों को सुधारने पर ध्यान केंद्रित करने के बजाय, सरल वेटेड लॉग-लाइक्लीहुड ऑब्जेक्टिव्स के माध्यम से चुनौतीपूर्ण ऑप्टिमाइज़ेशन लैंडस्केप्स को संबोधित करना बेहतर पॉलिसियों को प्राप्त करने के लिए अधिक महत्वपूर्ण है।

Imad Aouali, Otmane Sakhi2026-06-02
⚡ electrical engineering

FlowECG: Using Flow Matching to Create a More Efficient ECG Signal Generator

FlowECG एक फ्लो मैचिंग-आधारित ECG जनरेटर पेश करता है जो तैनाती के लिए आवश्यक सैंपलिंग स्टेप्स की संख्या में भारी कमी के माध्यम से कम्प्यूटेशनल आवश्यकताओं को एक क्रम (order of magnitude) तक कम करते हुए, अत्याधुनिक डिफ्यूजन मॉडल्स के बराबर या उनसे बेहतर सिग्नल गुणवत्ता प्राप्त करता है।

Vitalii Bondar, Serhii Semenov, Vira Babenko, Dmytro Holovniak2026-06-02
📊 statistics

Towards a Physics Foundation Model

यह शोध पत्र जनरल फिजिक्स ट्रांसफॉर्मर (GPhyT) को प्रस्तुत करता है, जो 1.8 TB विविध सिमुलेशन डेटा पर प्रशिक्षित एक फाउंडेशन मॉडल है जो पूर्व-निर्धारित समीकरणों पर निर्भर किए बिना सीधे संदर्भ से शासी गतिकी (governing dynamics) का अनुमान लगाकर उत्कृष्ट बहु-डोमेन प्रदर्शन और ज़ीरो-शॉट सामान्यीकरण प्राप्त करता है।

Florian Wiesner, Zoë J. Gray, Matthias Wessling, Stephen Baek2026-06-02
📊 statistics

Deep Learning as the Disciplined Construction of Tame Objects

यह व्याख्यात्मक टिप्पणी यह प्रदर्शित करती है कि कैसे टेम ज्योमेट्री (o-मिनिमलिटी) फलन संरचनाओं (फंक्शन कंपोजिशन) के दृष्टिकोण से सामान्य गैर-सुचारू (nonsmooth), गैर-उत्तल (nonconvex) परिवेशों में स्टोकेस्टिक ग्रेडिएंट डिसेंट के लिए अभिसरण गारंटी स्थापित करके डीप लर्निंग के लिए एक स्वाभाविक गणितीय ढांचा प्रदान करती है।

Gilles Bareilles, Allen Gehret, Johannes Aspman, Jana Lepšová, Jakub Mareček2026-06-02
🤖 machine learning

d2: Improving Reasoning in Diffusion Language Models via Trajectory Likelihood Estimation

यह शोध पत्र d2 को प्रस्तुत करता है, जो मास्क किए गए डिफ्यूजन लैंग्वेज मॉडल्स के लिए एक नवीन सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है, जो विशेषीकृत ट्राजेक्टरी लाइकलीहुड अनुमानकों (d2-AnyOrder और d2-StepMerge) का उपयोग करता है ताकि तार्किक और गणितीय बेंचमार्क पर तर्क करने की क्षमताओं को महत्वपूर्ण रूप से बढ़ाया जा सके, जिससे नया अत्याधुनिक प्रदर्शन (state-of-the-art performance) प्राप्त होता है।

Guanghan Wang, Gilad Turok, Yair Schiff, Marianne Arriola, Volodymyr Kuleshov2026-06-02✓ Author reviewed