📊 statistics

The arithmetic-harmonic inequality index: Theory, inference, and finite-sample analysis

यह शोध पत्र धनात्मक यादृच्छिक चरों (positive random variables) के लिए फैलाव के एक स्केल-इनवेरिएंट माप के रूप में अंकगणितीय-हरात्मक असमानता (arithmetic-harmonic inequality - AHI) सूचकांक की जांच करता है, जिसके लिए सामान्यीकृत व्युत्क्रम गॉसियन परिवार (generalized inverse Gaussian family) के लिए विश्लेषणात्मक अभिव्यक्तियों को व्युत्पन्न किया गया है, इसके अनुमानक (estimator) के अनंत-नमूना गुणों और पूर्वाग्रह सन्निकटन (bias approximations) को स्थापित किया गया है, और मोंटे कार्लो सिमुलेशन के माध्यम से इसके परिमित-नमूना प्रदर्शन का मूल्यांकन किया गया है।

Roberto Vila, Helton Saulo2026-04-07
📊 statistics

Efficient estimation of relative risk, odds ratio and their logarithms for rare events

यह शोध पत्र सापेक्ष जोखिम (relative risk), ऑड्स अनुपात (odds ratio) और उनके लघुगणक (logarithms) के लिए क्रमिक अनुमानकों (sequential estimators) का प्रस्ताव करता है जो एक लक्षित माध्य-वर्ग त्रुटि (mean-square error) की गारंटी देते हैं और विशेष रूप से दुर्लभ या मध्यम रूप से दुर्लभ घटनाओं के लिए उच्च दक्षता प्रदर्शित करते हैं।

Luis Mendo2026-04-07
📊 statistics

High Dimensional Bootstrap and Asymptotic Expansion for the kk-th Largest Coordinate

यह शोधपत्र फैक्टोरियल मोमेंट्स (factorial moments) और भारित समावेश-अपवर्जन (weighted inclusion-exclusion) का उपयोग करते हुए एक नवीन दृष्टिकोण विकसित करता है ताकि सामान्यीकृत योगों (normalized sums) के kk-वें सबसे बड़े निर्देशांक (coordinate) के लिए द्वितीय-क्रम की स्पर्शोन्मुख विस्तार (second-order asymptotic expansions) और उच्च-आयामी बूटस्ट्रैप अनुमान (high-dimensional bootstrap inference) स्थापित किया जा सके, जिससे विभिन्न निर्भरता और क्षण स्थितियों (dependence and moment conditions) के तहत मैक्सिमा से सामान्य क्रम सांख्यिकी (general order statistics) तक मौजूदा सिद्धांत का विस्तार किया जा सके।

Long Feng2026-04-07
📊 statistics

Rank-Based Sparse Regression in Principal Components Space under Measurement Error

यह शोधपत्र प्रिंसिपल कंपोनेंट्स स्पेस में एक सुदृढ़ उच्च-आयामी प्रतिगमन विधि प्रस्तावित करता है जो भारी-पूंछ वाले रिस्पॉन्स एरर और प्रेडिक्टर्स में एडिटिव मेजरमेंट एरर को प्रभावी ढंग से संभालने के लिए एक विल्कोक्सन-प्रकार के रैंक लॉस को एक एडेप्टिव रीवेटिंग स्कीम के साथ जोड़ता है, जो संदूषण के तहत स्थिरता में मौजूदा 1\ell_1-पेनलाइज्ड दृष्टिकोणों से बेहतर प्रदर्शन करता है।

Long Feng, Xiaoyi Wang, Le Zhou2026-04-07
📊 statistics

Efficient Causal Graph Discovery Using Large Language Models

यह शोध पत्र एक नवीन, कुशल ढांचे का प्रस्ताव करता है जो पूर्ण कारण ग्राफ (causal graphs) खोजने के लिए 'ब्रेड्थ-फर्स्ट सर्च' दृष्टिकोण के साथ लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे केवल रैखिक (linear) संख्या में क्वेरीज़ के माध्यम से पिछले युग्म-आधारित (pairwise) तरीकों की द्विघाती (quadratic) क्वेरी सीमाओं को पार किया जा सकता है और वास्तविक दुनिया के डेटासेट पर अत्याधुनिक प्रदर्शन प्राप्त किया जा सकता है।

Thomas Jiralerspong, Xiaoyin Chen, Yash More, Vedant Shah, Yoshua Bengio2026-04-06
📊 statistics

Degrees of Freedom in Penalized Regression: Model Selection with Adaptive Penalties

यह शोधपत्र एडेप्टिव लासो (Adaptive Lasso) और एडेप्टिव ग्रुप लासो (Adaptive Group Lasso) मॉडलों में प्रभावी स्वतंत्रता की कोटियों (effective degrees of freedom) के लिए नवीन, निष्पक्ष अनुमानक व्युत्पन्न करता है, जो मॉडल जटिलता के प्रॉक्सी के रूप में सक्रिय सेट आकार (active set size) के सामान्य दुरुपयोग को सुधारता है और सामान्य डिज़ाइन मैट्रिसेस के तहत जोखिम अनुमान और अनुमान के लिए एक कठोर सैद्धांतिक आधार प्रदान करता है।

Mauro Bernardi, Antonio Canale, Marco Stefanucci2026-04-06
🧬 biology

VeloTree: Inferring single-cell trajectories from RNA velocity fields with varifold distances

यह शोध पत्र VeloTree प्रस्तुत करता है, जो RNA वेलोसिटी इंटीग्रल कर्व्स के बीच स्क्वेयर्ड वारिफोल्ड डिस्टेंस (squared varifold distance) पर आधारित एक सुदृढ़ पाथ डिस्टेंस की गणना करके सिंगल-सेल डिफरेंशिएशन ट्री को इन्फर करने की एक नवीन विधि है, जो सिम्युलेटेड और वास्तविक दोनों डेटासेट पर उच्च सटीकता प्रदर्शित करता है।

Elodie Maignant, Tim Conrad, Christoph von Tycowicz2026-04-06
🧬 biology

Benchmarking Heritability Estimation Strategies Across 86 Configurations and Their Downstream Effect on Polygenic Risk Score Performance

यह अध्ययन छह टूल परिवारों और दस विधि समूहों में 86 हेरिटेबिलिटी अनुमान कॉन्फ़िगरेशन का बेंचमार्किंग करता है, जिससे यह प्रकट होता है कि हालांकि SNP हेरिटेबिलिटी अनुमान पद्धतिगत विकल्पों के आधार पर महत्वपूर्ण रूप से भिन्न होते हैं, इस अपस्ट्रीम परिवर्तनशीलता का डाउनस्ट्रीम पॉलीजेनिक रिस्क स्कोर प्रदर्शन पर नगण्य प्रभाव पड़ता है।

Muhammad Muneeb, David B. Ascher2026-04-06
📈 economics

Measuring What Cannot Be Surveyed: LLMs as Instruments for Latent Cognitive Variables in Labor Economics

यह शोध पत्र श्रम अर्थशास्त्र में अंतर्निहित संज्ञानात्मक चरों के लिए वैध मापन उपकरणों के रूप में लार्ज लैंग्वेज मॉडल्स (LLMs) के उपयोग के लिए एक सैद्धांतिक ढांचा स्थापित करता है, जो संवर्धित मानव पूंजी सूचकांक (Augmented Human Capital Index) के निर्माण और सत्यापन के माध्यम से यह प्रदर्शित करता है कि LLMs एआई एक्सपोज़र के विशिष्ट आयामों को प्रकट करने और आर्थिक अनुमान में मापन त्रुटि को सुधारने के लिए व्यावसायिक कार्य सामग्री (occupational task content) को विश्वसनीय रूप से परिमाणित कर सकते हैं।

Cristian Espinal Maya2026-04-06
📊 statistics

A Scale-Invariant Entropy Statistic for Distance Distributions

यह शोध पत्र स्केल-इनवेरिएंट एंट्रॉपी सांख्यिकी (entropy statistics) के एक परिवार को प्रस्तुत करता है जो बिंदु प्रक्रियाओं (point processes) के लघुगणकीय रूप से एकत्रित दूरी वितरणों (logarithmically aggregated distance distributions) से व्युत्पन्न है, जिसे पूर्ण पैमाने (absolute scale) से स्वतंत्र सापेक्ष अंतराल की संरचनात्मक विशेषताओं को एनकोड करने के लिए डिज़ाइन किया गया है, जिसमें अभाज्य संख्याओं (prime numbers) को एक प्रेरक उदाहरण के रूप में उपयोग किया गया है।

Mohamed Gewily2026-04-06