📊 statistics

Kriging for large datasets via penalized neighbor selection

यह शोध पत्र एक दंडित क्रिगिंग (penalized kriging) ढांचे का प्रस्ताव करता है जो स्थानिक सहसंबंध के आधार पर इष्टतम पड़ोसियों को स्वचालित रूप से चुनने के लिए LASSO और एडेप्टिव LASSO नियमितीकरण का उपयोग करता है, जिससे पारंपरिक तरीकों की तुलना में काफी कम कम्प्यूटेशनल लागत पर बड़े डेटासेट के लिए वैश्विक-स्तर की भविष्यवाणी सटीकता प्राप्त होती है।

Francisco Cuevas-Pacheco, Jonathan Acosta2026-02-04
📊 statistics

Simulation-Based Inference via Regression Projection and Batched Discrepancies

यह शोध पत्र एक हल्के, समानांतर करने योग्य (parallelizable) सिमुलेशन-आधारित अनुमान पद्धति को प्रस्तुत करता है जो एक सुसंगत छद्म-पश्च (pseudo-posterior) का निर्माण करने के लिए एक एकल फिट किए गए प्रतिगमन प्रक्षेप (regression projection) और बैच किए गए विचलनों (discrepancies) का उपयोग करता है, जबकि यह इसके स्पर्शोन्मुखी व्यवहार (asymptotic behavior) को सैद्धांतिक रूप से अभिलक्षणिक बनाता है और गैररेखीय एवं ब्रह्मांडीय मॉडलों पर इसकी कम्प्यूटेशनल दक्षता और पहचान क्षमता (identifiability) के बीच के समझौतों को प्रदर्शित करता है।

Arya Farahi, Jonah Rose, Paul Torrey2026-02-04
📊 statistics

Nonparametric priors with full-range borrowing of information

यह शोधपत्र एक नवीन "हाइपर-टाई" (hyper-tie) अवधारणा का उपयोग करते हुए एक नए प्रकार के डिपेंडेंट नॉनपैरामेट्रिक प्रायर्स (dependent nonparametric priors) को प्रस्तुत करता है ताकि विषम डेटा के बीच पूर्ण-सीमा (धनात्मक और ऋणात्मक) सूचना साझाकरण को सक्षम बनाया जा सके, जिससे भविष्यवाणी और क्लस्टरिंग कार्यों में मौजूदा विधियों से बेहतर प्रदर्शन किया जा सके।

Filippo Ascolani, Beatrice Franzolini, Antonio Lijoi, Igor Prünster2026-02-03
📊 statistics

Data denoising with self consistency, variance maximization, and the Kantorovich dominance

यह शोधपत्र एक नवीन डेटा डिनोइजिंग (denoising) ढांचे को प्रस्तुत करता है जो कॉनवेक्स ऑर्डर (convex order) के तहत वेरिएंस को अधिकतम करके एक निर्धारित संरचना और स्व-संगति (self-consistency) वाले निकटतम वितरण की खोज करता है, और आगे 'कान्टोरोविच डोमिनेंस' (Kantorovich dominance) नामक एक नई अवधारणा पर आधारित एक अधिक सुदृढ़ और गणनात्मक रूप से कुशल संस्करण प्रस्तावित करता है।

Joshua Zoen-Git Hiew, Tongseok Lim, Brendan Pass, Marcelo Cruz de Souza2026-02-03
📊 statistics

The Marginal Likelihood of two-way tables and Ecological Inference

यह शोध पत्र पारिस्थितिक अनुमान (इकोलॉजिकल इन्फरेंस) की शर्तों को स्पष्ट करने के लिए 2x2 तालिकाओं के मार्जिनल लाइकलीहुड (सीमांत संभाव्यता) पर प्लैकेट के कार्य को सामान्य RxC तालिकाओं तक विस्तृत करता है और निश्चित मार्जिन वाले तालिकाओं के संग्रह में सटीक बहुभिन्नसम बहुपदीय संभाव्यता (मल्टीनोमियल लाइकलीहुड) को अधिकतम करने के लिए एक कुशल फिशर स्कोरिंग एल्गोरिदम प्रस्तुत करता है।

Antonio Forcina2026-02-03
📊 statistics

Active Learning with Adaptive Non-Stationary Kernel for Continuous-Fidelity Surrogate Models

यह शोध पत्र निरंतर-फिडेलिटी सरोगेट मॉडल्स के लिए एक नया एक्टिव लर्निंग फ्रेमवर्क प्रस्तावित करता है जो कम्प्यूटेशनल रूप से महंगे सिमुलेशन, जैसे कि फाइनाइट एलीमेंट मेथड्स, के लिए इनपुट और फिडेलिटी पैरामीटर्स के चयन को अनुकूलित करने हेतु एक एडेप्टिव नॉन-स्टेशनरी कर्नेल और एक IMSPE-आधारित रणनीति का उपयोग करता है।

Romain Boutelet, Chih-Li Sung2026-02-03
📊 statistics

Multivariate Species Sampling Models

यह शोध पत्र बहुचर प्रजाति नमूनाकरण मॉडल (multivariate species sampling models) को आश्रित गैर-पैरामीट्रिक पूर्व-संभाव्यताओं (dependent nonparametric priors) के लिए एक एकीकृत ढांचे के रूप में प्रस्तुत करता है जो आंशिक रूप से विनिमेय विभाजन संभाव्यता फलनों (partially exchangeable partition probability functions) के माध्यम से उनकी क्लस्टरिंग संरचना को स्पष्ट करता है, जिससे यह स्पष्ट होता है कि साझा संबंधों के माध्यम से समूहों के बीच सूचना का आदान-प्रदान कैसे किया जाता है और समृद्ध निर्भरता संरचनाओं वाले नए मॉडल विकसित करने के लिए एक आधार प्रदान करता है।

Beatrice Franzolini, Antonio Lijoi, Igor Prünster, Giovanni Rebaudo2026-02-03
📊 statistics

Do Large Language Models (Really) Need Statistical Foundations?

यह शोध पत्र तर्क देता है कि बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के लिए सांख्यिकीय आधार आवश्यक हैं क्योंकि उनकी अंतर्निहित स्टोकेस्टिक प्रकृति और विशुद्ध रूप से यांत्रिक विश्लेषण की जटिलता (इंट्रैक्टेबिलिटी) है, जो संरेखण (अलाइनमेंट), अनिश्चितता मात्रा निर्धारण (अनसर्टेन्टी क्वांटिफिकेशन) और मूल्यांकन जैसे प्रमुख अनुसंधान क्षेत्रों में सांख्यिकीय पद्धतियों के एक विविध, मोज़ेक-समान एकीकरण का समर्थन करता है।

Weijie Su2026-02-03