📊 statistics

Interpreting feature importance under spatial heterogeneity: Evidence from urban development stages and regional migration

Dit artikel toont aan dat in ruimtelijk heterogene systemen zoals stedelijke migratie, de rangschikkingen van de belangrijkheid van kenmerken afgeleid uit machine learning instabiel zijn over verschillende ontwikkelingsstadia en niet inherent de richting of uniformiteit van de invloed van een voorspeller onthullen, wat aparte ruimtelijke validatie noodzakelijk maakt voor beleidsapplicaties.

dongwoo kim2026-07-31
📊 statistics

When a Winning Forecast Does Not Identify an Action: An Evidence-Budget Algorithm for Distributional Decisions

Dit artikel introduceert de Finite-Evidence Decision Identification Procedure (FEDIP), een modulair auditkader dat onthult hoe beperkte validatiegegevens er vaak niet in slagen om uniek één optimale actie te identificeren tussen concurrerende distributiemodellen, waarmee de noodzaak van expliciete economische verliesfuncties wordt aangetoond om de actiedispersie op te lossen die standaard score-gebaseerde selectie over het hoofd ziet.

Min Huang, Mingyan Liu, Xiaoer Li2026-07-31
📊 statistics

A Gaussian-Based Refinement Algorithm for Estimating Usual Energy Intake from FAO Food Balance Sheets: Validation Across Six Countries

Deze studie introduceert en valideert een op Gaussische verdeling gebaseerd verfijningsalgoritme dat succesvol de distributies van de normale energie-inname van de populatie schat uit Voedselbalansrekeningen door gerapporteerde waarden als bovengrenzen te behandelen, waarbij het een significant verbeterde nauwkeurigheid aantoont ten opzichte van bestaande FAO-methoden wanneer het wordt vergeleken met nationale dieetonderzoeken in zes landen.

Omar A. Alhumaidan2026-07-31
📊 statistics

An Empirical Comparison of Statistical Methods for Estimating EQ-5D Health State Utilities in Rheumatoid Arthritis Clinical Trials for Economic Modelling

Deze studie vergelijkt empirisch lineaire gemengde effectenmodellen, generalized estimating equations en two-part mixed models voor het schatten van EQ-5D-utiliteiten in reuma-trials, waarbij wordt vastgesteld dat hoewel two-part mixed models lagere utiliteitsschattingen opleveren, de keuze van de methode minimale impact heeft op de algehele kosteneffectiviteitsconclusies.

Jiajun Yan, Eleanor Pullenayegum, Shun Fu Lee, Feng Xie2026-07-30
📊 statistics

Normative Translation and Pre-Screening to Overcome Domain Collapse and Epistemic Shielding in Non-Compensatory Composite Indicators

Dit artikel stelt een verenigd methodologisch kader voor dat een Global Normative-Anchor Translated CES-functie combineert met een zekerheidsequivalent pre-screeningmechanisme om computationele domeininstorting te voorkomen en de "Epistemic Shielding Trap" in niet-compensatoire samengestelde indicatoren te vermijden, waardoor nauwkeurige longitudinale datakwaliteitsaudits mogelijk worden terwijl expliciet wordt gewaarschuwd tegen het gebruik van de bestrafte index voor cross-sectionele financieringsallocatie.

Shahryar Ghiasi2026-07-30
📊 statistics

Bayesian Inference for Multi-Source Binary Data with Selection and Measurement Error

Dit artikel introduceert een Bayesiaans modelleringskader dat gezamenlijk misclassificatie- en selectiefouten in multi-source binaire gegevens aanpakt, waarbij door middel van simulaties en empirische analyse wordt aangetoond dat hoewel de samengestelde fout robuust geïdentificeerd kan worden, het nauwkeurig decomponeren ervan in specifieke componenten geldige indicatoren, hulpvariabelen en informatieve priors vereist.

Santiago Gómez-Echeverry, Arnout van Delden, Ton de Waal, Dimitris Pavlopoulos2026-07-30
📊 statistics

A General Framework for Stability Assessment of Non-Deterministic Prediction Models

Dit artikel stelt een algemeen kader voor het kwantificeren van de stabiliteit van niet-deterministische voorspellingsmodellen over metrische, categorische en ordinale uitkomsten door datagestuurde en modelgestuurde stabiliteitsmaten te introduceren die de beperkingen van bestaande methoden overwinnen, zoals hun onvermogen om individuele testobjecten te verwerken en hun gevoeligheid voor de samenstelling van de data.

Thomas Martin Lange, Armin Otto Schmitt, Felix Heinrich2026-07-30
📊 statistics

A Sequential Tour-Based Mode Choice Framework with GPS-based Data: Integrating Machine-Learning-Derived Features into Mixed Logit and MNL Models

Deze studie ontwikkelt een sequentieel tour-gebaseerd modaliteitskeuzekader voor Sydney met behulp van GPS-gegevens en door machine learning afgeleide kenmerken, waarbij wordt aangetoond dat Mixed Logit-modellen de voorspelling voor onderling afhankelijke tour-componenten aanzienlijk verbeteren en dat het kader robuust blijft tegen onzekerheid in de upstream-schatting, waardoor het gebruik van gesimuleerde inputs voor praktische reizigersvraagvoorspelling wordt gevalideerd.

Mostafa Rahimi, Maliheh Tabasi, Abdul Rawoof Pinjari, Taha Hossein Rashidi2026-07-30
📊 statistics

Ablation Study of Class Imbalance Techniques for Credit Default Prediction with SHAP-based Explainability Analysis

Deze studie toont aan dat bij taken voor het voorspellen van kredietverzuim de ingebouwde `scale_pos_weight`-parameter van XGBoost de traditionele SMOTE-resamplingtechniek aanzienlijk overtreft op het gebied van recall, wat benadrukt dat de optimale strategie voor het omgaan met klassenonbalans afhangt van de specifieke classifier die wordt gebruikt in plaats van een universele resamplingmethode.

Atharv Tiwari2026-07-30