📊 statistics

Automated auditing of statistical quality in university theses: why lexical rules fail and what a language layer adds

Deze studie toont aan dat regelgebaseerde geautomatiseerde auditing van de statistische kwaliteit in universitaire dissertaties slechter presteert dan toeval door fundamentele lexicale beperkingen, maar het integreren van een taalmodel-laag verbetert de overeenstemming met deskundige oordelen aanzienlijk, terwijl een hoge recall en lage kosten behouden blijven.

Milton Vladimir Mamani Calisaya, Charles Ignacio Mendoza Mollocondo, Vladimiro Ibañez Quispe, Jesus Pari Flores2026-08-28
📊 statistics

Grade 4-to-5 Joint Mathematics–Science Benchmark Transitions in Nine Systems: A Descriptive Common-Severity Analysis Using TIMSS 2023 Longitudinal Data

Deze studie maakt gebruik van longitudinale TIMSS 2023-gegevens van negen systemen om de gezamenlijke waarschijnlijkheid te schatten en te standaardiseren van studenten die overgaan van onder naar boven beide benchmarks voor wiskunde en natuurwetenschappen, waarbij significante systeemspecifieke variaties worden onthuld en wordt aangetoond dat hoewel standaardisatie op basis van gemeenschappelijke ernst de doelafhankelijkheid verheldert, de resultaten beschrijvend blijven in plaats van causaal.

Jonas A. Mandalunes2026-08-28
📊 statistics

When the adjustment fails: population-denominator sensitivity in coverage-adjusted PISA trends

Dit artikel toont aan dat de op dekking aangepaste trends van het bovenste kwartiel van PISA zeer gevoelig zijn voor de keuze van de populatiedenominator, wat significante discrepanties onthult tussen gerapporteerde gegevens en de schattingen van de World Population Prospects die de noodzaak van transparante herkomstrapportage en voorzichtigheid onderstrepen wanneer synthetische gewichten aanpassingen triggeren.

Jonas A. Mandalunes, Danica Jane S. Mandalunes2026-08-28
📊 statistics

Measurement-bounded predictive inference in international large-scale assessment: how the plausible-value ceiling governs attainable accuracy and the stability of predictor rankings in PISA 2022

Deze studie toont aan dat het inherente plafond in de meetprecisie van de PISA 2022-plausibele waarden de haalbare voorspellende nauwkeurigheid fundamenteel beperkt en de rangschikking van voorspellers over domeinen en onderwijssystemen destabiliseert, wat noodzaakt dat prestatievergelijkingen en modelinterpretaties worden gegrond in deze berekenbare meetgrenzen.

Jonas A. Mandalunes2026-08-28
📊 statistics

Spatiotemporal Dynamics and Optimal Control of a Two-Stage Infection-Age Structured Epidemic Model with Nonlocal Diffusion, Chemotactic Avoidance, and Intermittent Control Strategies

Dit artikel stelt een nieuw twee-fasen infectie-leeftijds-epidemisch model op dat niet-lokale diffusie, chemotactische vermijding en afnemende immuniteit incorporeert om de globale stabiliteit van evenwichten te bewijzen en een bi-niveau optimaal controleframework met intermitterende strategieën te ontwikkelen dat, gevalideerd door Berlijnse data, de superioriteit van ruimtelijk gerichte interventies ten opzichte van uniforme benaderingen aantoont.

Yuhao zhou2026-08-28
📊 statistics

Dense Truths, Sparse Estimators: Making Lasso Work for Dense-Signal Logistic Regression

Dit artikel daagt de conventionele voorkeur voor Ridge-regressie in hoogdimensionale settings met een dicht signaal uit door aan te tonen dat de onderprestatie van Lasso voortkomt uit suboptimale afstemming in plaats van inherente gebreken, en introduceert een nieuwe posterior-predictive penalty-selector die Lasso in staat stelt om een voorspellende nauwkeurigheid te bereiken die vergelijkbaar is met of de Ridge-regressie overtreft, terwijl het zijn cruciale vermogen tot variabele selectie behoudt.

Jason Liao2026-08-28
📊 statistics

An Examination of the Performance of Variance Estimators in International Large-Scale Assessments

Deze Monte Carlo-simulatiestudie evalueert de prestaties van BRR-, JK2- en bootstrapping-variantieschatters in internationale grootschalige onderzoeken, waarbij wordt vastgesteld dat hoewel JK2 een superieure precisie biedt voor gladde statistieken zoals gemiddelden, bootstrapping en BRR nauwkeuriger zijn voor niet-gladde statistieken, en dat Fay-correcties en de omgang met non-respons de betrouwbaarheid van de schatters aanzienlijk beïnvloeden.

Umut Atasever, Sabine Meinck, Diego Cortes2026-08-27
📊 statistics

Inverse Target Trial Emulation: A Method to Simulate Realistic Observational Data

Dit artikel introduceert Inverse Target Trial Emulation (ITTE), een Bayesiaans raamwerk dat realistische observationele datasets genereert vanuit data van gerandomiseerde gecontroleerde studies door systematisch verwarrende variabelen en tijdgerelateerde biases te induceren, waardoor een rigoureuze evaluatie en vergelijking van analytische strategieën voor het corrigeren van deze biases in niet-gerandomiseerd gezondheidsonderzoek mogelijk wordt.

Luca Benetti, Gianluca Baio, Anna Heath2026-08-27
📊 statistics

What does Retraction Watch's "computer-generated content" reason capture? A metadata analysis of 9,161 retractions

Deze metadata-analyse van 9.161 intrekkingen onthult dat de reden "computergegenereerde inhoud" in Retraction Watch sterk geconcentreerd is bij één enkele uitgever en sterk geassocieerd is met paper mills, maar deze patronen weerspiegelende co-coderingpraktijken in plaats van definitief bewijs te leveren voor de werkelijke aanwezigheid van generatieve AI in de ingetrokken artikelen.

Jonas Mandalunes2026-08-27