🤖 machine learning

Online Data Selection Is Implicit Alignment

यह शोध पत्र प्रदर्शित करता है कि सुपरवाइज्ड फाइन-ट्यूनिंग के दौरान ऑनलाइन डेटा चयन एक अंतर्निहित संरेखण तंत्र (implicit alignment mechanism) के रूप में कार्य करता है जो उपयोग किए गए स्कोरिंग मानदंडों के आधार पर मॉडल की व्यवहार संबंधी प्राथमिकताओं—जैसे कि इनकार की दर (refusal rates), वाचालता (verbosity), और चाटुकारिता (sycophancy)—को व्यवस्थित रूप से आकार देता है, और इस विचलन (drift) का ऑडिट और नियंत्रण करने की विधियों का प्रस्ताव करता है।

Aoxiong Zeng, Yuxin Yang, Xiangquan Yang2026-07-09
⚡ electrical engineering

Prior-aware and Context-guided Group Sampling for Active Probabilistic Subsampling

यह शोध पत्र PGA-DPS प्रस्तुत करता है, जो एक उन्नत सक्रिय संभाव्य उप-नमूकरण (active probabilistic subsampling) विधि है जो वर्गीकरण, छवि पुनर्निर्माण और विभाजन कार्यों में मौजूदा दृष्टिकोणों से बेहतर प्रदर्शन करने के लिए डेटासेट पूर्ववृत्त (dataset priors) और समूह-आधारित टॉप-के सैंपलिंग को एकीकृत करती है।

Beomgu Kang, Hyunseok Seo2026-07-09
🤖 machine learning

Is Randomness Necessary for Adaptive Data Analysis?

यह शोधपत्र सूचना-सैद्धांतिक रैंडम ऑरेकल मॉडल (Random Oracle model) में यह सिद्ध करके एक दशक पुराने खुले प्रश्न को हल करता है कि एडेप्टिव डेटा एनालिसिस (Adaptive Data Analysis) के लिए रैंडमनेस (randomness) अनिवार्य रूप से आवश्यक है, क्योंकि एक कम्प्यूटेशनल रूप से असीमित विश्लेषक के विरुद्ध कोई भी नियतात्मक तंत्र (deterministic mechanism) केवल O~(n)\tilde{O}(n) क्वेरीज़ के बाद विफल हो जाता है।

Edith Cohen, Haim Kaplan, Yishay Mansour, Shay Sapir, Uri Stemmer2026-07-09
⚛️ lattice

Weight-Space Physics: Interpretable Hypernetworks for Lattice Quantum Field Theories

यह शोध पत्र JEPAWG का परिचय देता है, जो एक जॉइंट-एम्बेडिंग प्रेडिक्टिव आर्किटेक्चर-आधारित वेट जनरेटर (weight generator) है जो कपलिंग कांस्टेंट्स को सीधे नॉर्मलाइजिंग फ्लो वेट्स में मैप करता है, यह प्रदर्शित करते हुए कि नेटवर्क का लेटेंट स्पेस फेज़ ट्रांज़िशन और फाइनाइट-साइज़ स्केलिंग जैसी महत्वपूर्ण भौतिक घटनाओं को पुनः प्राप्त कर सकता है, जिससे नेटवर्क वेट्स को स्वयं लैटिस फील्ड थ्योरीज़ के लिए व्याख्या योग्य भौतिक अवलोकनों (physical observables) के रूप में स्थापित किया जा सके।

Tobias Göbel, Julian R. Ebelt, Zier Mensch, Mathis Gerdes, Miranda C. N. Cheng2026-07-09
🤖 machine learning

Distributed Sparse Interventions in Language Models

यह शोध पत्र डिस्ट्रीब्यूटेड स्पार्स इंटरवेंशन्स (DSI) को प्रस्तुत करता है, जो एक नवीन विधि है जो उन गैर-रेखीय प्रभावों और अंतःक्रियाओं को पकड़ने के लिए परतों के across न्यूरॉन्स के स्पार्स सेट की पहचान करती है जिन्हें पारंपरिक रैखिक स्टीयरिंग दृष्टिकोण चूक जाते हैं, ताकि भाषा मॉडल में कार्य व्यवहारों को प्रभावी ढंग से सक्रिय किया जा सके।

Maximilian S. Ernst (Max Planck School of Cognition, Center for Lifespan Psychology Max Planck Institute for Human Devel (…)2026-07-09
🤖 machine learning

Fractal KV-Cache Archives: Lossless Symbolic Storage with In-Place Retrieval for Long-Context LLM Inference

यह शोध पत्र "फ्रैक्टरल केवी-कैश आर्काइव्स" (Fractal KV-Cache Archives) प्रस्तुत करता है, जो क्वांटाइज्ड केवी कैशेज़ के लिए एक लॉसलेस, लीनियर-टाइम स्टोरेज फॉर्मेट है जो न्यूनतम परप्लेक्सिटी डिग्रेडेशन के साथ 54x तक संपीड़न (compression) प्राप्त करते हुए अनुमानित सबस्ट्रिंग क्वेरीज़ के लिए सर्च इंडेक्स के रूप में कार्य करने के साथ-साथ O(1) रैंडम एक्सेस और एमोर्टाइज्ड अपेंडिंग को सक्षम बनाता है।

Vladimir Gusev2026-07-09
⚡ electrical engineering

Prior-matched evaluation of operational Earth-observation classifiers: a three-number reporting method demonstrated on Sentinel-1 internal-wave detection

यह शोध पत्र एक गलत क्लास प्रायर (class prior) पर रिपोर्टिंग के कारण दुर्लभ-घटना पृथ्वी-अवलोकन क्लासिफायर में प्रेसिजन (precision) के व्यवस्थित अति-अनुमान की समस्या को संबोधित करता है, जिसमें एक तीन-संख्या वाली रिपोर्टिंग पद्धति और एक प्रिसिजन-प्रथम विकास चक्र का प्रस्ताव दिया गया है जिसने सेंटिनल-1 डेटा से आंतरिक तरंगों (internal waves) के परिचालन पता लगाने की सटीकता को 0.192 से 0.927 तक सफलतापूर्वक सुधारा है।

Joao Pinelo, Joao Goncalves, Arun Shukla, Adriana Santos-Ferreira2026-07-09
🔢 mathematics

Restricted Dynamic Geometric Complexity: Certificates for Structured Preconditioning

यह शोध पत्र "प्रतिबंधित गतिशील ज्यामितीय जटिलता" (Restricted Dynamic Geometric Complexity) को एक अंतर्निहित प्रमाण ढाँचे के रूप में प्रस्तुत करता है जो संरचनात्मक प्रीकंडीशनिंग चुनौतियों को ज्यामितीय दूरी और पहुँच योग्यता की समस्याओं में परिवर्तित करता है, जो प्रतिबंधित मीट्रिक परिवारों के तहत अनुकूलन के लिए प्रमाणिक एकतुल्यता सिद्धांतों, रैखिक मैट्रिक्स असमानता सूत्रीकरणों और सटीक जटिलता सूत्रों को प्रदान करता है।

Zavier Li2026-07-09
🤖 machine learning

Geometric--Nongeometric Optimizer Calculus: A Modular Language for Reachable Gradient Methods

यह शोध पत्र एक मॉड्यूलर "ज्यामितीय-गैरज्यामितीय ऑप्टिमाइज़र कैलकुलस" प्रस्तुत करता है जो अनुकूलित (adaptive) ऑप्टिमाइज़र्स को विशिष्ट घटकों में विभाजित करता है ताकि उनके सुलभ ग्रेडिएंट दिशाओं का औपचारिक रूप से विश्लेषण किया जा सके, विभिन्न मेट्रिक परिवारों के लिए अभिव्यंजना (expressivity) प्रमेय स्थापित किए जा सकें, और ऑप्टिमाइज़र डिज़ाइन को एक एकल सार्वभौमिक समाधान की खोज के बजाय एक पारेटो अनुकूलन समस्या के रूप में फ्रेम किया जा सके।

Zavier Li2026-07-09
🤖 machine learning

Continual Learning With Participation Privacy: An Auditable Buffering-Aggregation Recipe

यह शोध पत्र एक रैंडमाइज्ड बफरिंग रैपर का उपयोग करके सिंगल-एडिट यूजर स्ट्रीम्स को प्रबंधनीय हैमिंग-शैली के बिन अपडेट्स में बदलने के माध्यम से, भागीदारी गोपनीयता बाधाओं के तहत निरंतर शिक्षण (कंटीन्यूअस लर्निंग) में प्रक्षेपवक्र-स्तरीय विभेदक गोपनीयता (ट्रैजेक्टरी-लेवल डिफरेंशियल प्राइवेसी) प्राप्त करने के लिए एक ऑडिटेबल मॉड्यूलर रेसिपी प्रस्तावित करता है, जिससे मानक विभेदक रूप से निजी प्रिमिटिव्स को अनुकूलन योग्य इंटरैक्शन के बावजूद गोपनीयता गारंटी बनाए रखने में सक्षम बनाया जा सके।

T-H. Hubert Chan, Elaine Shi, Mengshi Zhao, Mingxun Zhou2026-07-09