🤖 machine learning

From Global to Factor-Wise Expert Composition in Discrete Diffusion Models

यह शोधपत्र FactorDiff प्रस्तुत करता है, जो कि डिस्क्रीट डिफ्यूजन मॉडल्स के लिए एक नवीन फ्रेमवर्क है, जो वैश्विक मिश्रण भार (global mixing weights) लागू करने के बजाय व्यक्तिगत नमूना कारकों (individual sample factors) को विशिष्ट विशेषज्ञों (specialized experts) में गतिशील रूप से रूट करके संरचनात्मक पीढ़ी (compositional generation) में सुधार करता है, जिससे ARC-AGI जैसे स्थानिक रूप से जटिल तर्क कार्यों पर बेहतर प्रदर्शन प्राप्त होता है।

Haozhe Huang, Yudong Xu, Abhijoy Mandal, Alán Aspuru-Guzik2026-07-14
💬 NLP

From Expressivity to Sample Complexity: Narrow Teachers for Transformers via C-RASP

यह शोध पत्र C-RASP निर्माणों (constructions) को सीखने के लिए प्रारंभिक नमूना जटिलता सीमाओं (sample complexity bounds) का प्रस्ताव करके ट्रांसफॉर्मर सीखने की क्षमता (learnability) की सैद्धांतिक समझ को आगे बढ़ाता है, जो मौजूदा अभिव्यक्ति विश्लेषणों (expressivity analyses) और ऐसे समाधानों को सीखने की व्यावहारिक व्यवहार्यता के बीच के अंतर को संबोधित करता है।

Michael Rizvi-Martel, Satwik Bhattamishra, Guillaume Rabusseau, Michael Hahn2026-07-14
🤖 machine learning

An Exact Instrument for State Usage in Selective State-Space Models, and the Input-Driven Migration It Reveals

यह शोध पत्र चयनात्मक स्टेट-स्पेस मॉडलों (selective state-space models) में मोड उपयोग को मापने के लिए एक सटीक उपकरण प्रस्तुत करता है, जो यह प्रकट करता है कि राइट मैप BtB_t द्वारा संचालित इनपुट-निर्भर स्टेट पुनर्वितरण (input-dependent state reallocation), इनपुट-शेड्यूल्ड मोड प्रूनिंग को स्थिर विधियों की तुलना में काफी बेहतर बनाने और आधे स्टेट बजट पर अनप्रुन्ड (unpruned) प्रदर्शन के बराबर लाने में सक्षम बनाता है।

Raktim Bhattacharya2026-07-14
🤖 machine learning

Transformer-Guided Swarm Intelligence for Frugal Neural Architecture Search

यह शोध पत्र एक मितव्ययी, हाइब्रिड न्यूरल आर्किटेक्चर सर्च फ्रेमवर्क प्रस्तावित करता है जो इमेज क्लासिफिकेशन और इम्बैलेंस्ड टैबुलर डेटा कार्यों के लिए कंज्यूमर-ग्रेड हार्डवेयर पर कॉम्पैक्ट, उच्च-प्रदर्शन वाले डीप लर्निंग मॉडल्स को कुशलतापूर्वक खोजने के लिए आर्टिफिशियल बी कॉलोनी एल्गोरिदम के साथ एक ट्रांसफॉर्मर-आधारित रीइन्फोर्समेंट लर्निंग कंट्रोलर को जोड़ता है।

Romain Amigon2026-07-14
💬 NLP

A Durability and Cross-Language Transfer Benchmark for a Validated Teaching-Feedback Classification Protocol

यह शोध पत्र स्पेनिश डेटा पर विषयगत वर्गीकरण में अग्रणी मॉडलों की उत्कृष्टता को प्रदर्शित करते हुए, एक शिक्षण-फीडबैक वर्गीकरण प्रोटोकॉल की स्थायित्वता और क्रॉस-लैंग्वेज ट्रांसफर को प्रमाणित करता है, क्योंकि यह दर्शाता है कि सेंटीमेंट एनालिसिस के लिए मॉडल का चयन एक कार्यान्वयन संबंधी निर्णय है न कि एक पद्धतिगत आवश्यकता, क्योंकि सरल मॉडल स्पेनिश और अंग्रेजी दोनों संदर्भों में तुलनीय प्रदर्शन करते हैं।

Esteban U. Vega Barajas2026-07-14
🤖 machine learning

A Minimalist Retargeting-Guided Reinforcement Learning Recipe for Dexterous Manipulation

यह शोधपत्र REGRIND को प्रस्तुत करता है, जो एक न्यूनतम पाइपलाइन है जो रिटारगेटिंग-गाइडेड सुदृढीकरण लर्निंग (reinforcement learning) को ज़ीरो-शॉट सिम-टू-रियल ट्रांसफर के साथ जोड़ता है ताकि केवल एक एकल मानव प्रदर्शन का उपयोग करके मल्टी-फिंगर्ड रोबोट्स पर डेक्सट्रस, कॉन्टैक्ट-रिच मैनिपुलेशन कार्यों को सक्षम किया जा सके।

Yunhai Feng, Natalie Leung, Jiaxuan Wang, Lujie Yang, Haozhi Qi, Preston Culbertson2026-07-14
🤖 machine learning

Invariant Learning Dynamics of Transformers in Inductive Reasoning Tasks

यह शोध पत्र एक सैद्धांतिक ढांचा प्रस्तुत करता है जो यह प्रदर्शित करता है कि सामान्यीकृत आगमनात्मक तर्क (inductive reasoning) कार्यों पर ट्रांसफॉर्मर की शिक्षण गतिशीलता (learning dynamics) एक निम्न-आयामी अपरिवर्तनीय मैनिफोल्ड (low-dimensional invariant manifold) तक सीमित है, जो इन-कॉन्टेक्स्ट बनाम इन-वेट्स लर्निंग के लक्षण वर्णन, प्रारंभिक स्थिति (initialization) के आधार पर सर्किट चयन की भविष्यवाणी, और सीखे गए सर्किट्स के स्वचालित पता लगाने को सक्षम बनाती है।

Tiberiu Musat, Tiago Pimentel, Nicholas Zucchet, Thomas Hofmann2026-07-14
🤖 machine learning

A Fourier analytique approach to Gaussian mixture learning

यह शोध पत्र एक यादृच्छिक फूरियर विश्लेषणात्मक एल्गोरिदम प्रस्तुत करता है जो कि बहुपदीय नमूना और कम्प्यूटेशनल जटिलता के साथ, मनमाने आयामों में गोलाकार गाऊसी मिश्रणों (spherical Gaussian mixtures) के केंद्रों और भारों को सीखता है, जो कि गैर-स्थिर आयामी व्यवस्थाओं में पिछली सीमाओं को पार करते हुए सटीक सीमाएँ प्राप्त करता है।

Somnath Chakraborty, Hariharan Narayanan2026-07-13
📊 statistics

Contrastive Learning on Multimodal Analysis of Electronic Health Records

यह शोध पत्र एक सैद्धांतिक रूप से आधारित, गोपनीयता-संरक्षित बहुविध कंट्रास्टिव लर्निंग फ्रेमवर्क प्रस्तावित करता है जो इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड से संरचित कोड और असंरचित नोट्स को प्रभावी ढंग से एकीकृत करता है ताकि एकल-मोडलिटी दृष्टिकोणों से बेहतर प्रदर्शन किया जा सके और नैदानिक उपयोगिता प्रदर्शित की जा सके।

Tianxi Cai, Feiqing Huang, Ryumei Nakada, Linjun Zhang, Doudou Zhou2026-07-13
🤖 machine learning

LDPKiT: Superimposing Remote Queries for Privacy-Preserving Distillation

यह शोधपत्र LDPKiT प्रस्तुत करता है, जो एक गोपनीयता-संरक्षण ढांचा (privacy-preserving framework) है जो स्थानीय डेटा से अनुमानित इन-डिस्ट्रीब्यूशन नमूने उत्पन्न करने के लिए एक नवीन सुपरइम्पोजिशन तकनीक का उपयोग करता है, जिससे मजबूत गोपनीयता स्तरों पर भी उच्च उपयोगिता बनाए रखते हुए स्थानीय विभेदक गोपनीयता (local differential privacy) के तहत प्रभावी मॉडल डिस्टिलेशन सक्षम होता है।

Kexin Li, Aastha Mehta, David Lie2026-07-13