📊 statistics

Automated auditing of statistical quality in university theses: why lexical rules fail and what a language layer adds

본 연구는 대학 학위 논문의 통계적 품질에 대한 규칙 기반 자동 감사가 근본적인 어휘적 한계로 인해 우연보다 낮은 성능을 보인다는 점을 입증하였으나, 언어 모델 계층을 통합함으로써 높은 재현율과 낮은 비용을 유지하면서도 전문가의 판단과의 일치도를 유의미하게 향상시킨다는 것을 보여준다.

Milton Vladimir Mamani Calisaya, Charles Ignacio Mendoza Mollocondo, Vladimiro Ibañez Quispe, Jesus Pari Flores2026-08-28
📊 statistics

Grade 4-to-5 Joint Mathematics–Science Benchmark Transitions in Nine Systems: A Descriptive Common-Severity Analysis Using TIMSS 2023 Longitudinal Data

본 연구는 9개 교육 체계의 TIMSS 2023 종단 데이터를 활용하여 학생들이 수학과 과학 모두에서 미달 수준에서 도달 수준으로 전환될 결합 확률을 추정 및 표준화하며, 이를 통해 유의미한 체계별 차이를 밝히고 공통 심각도 표준화가 목표 의존성을 명확히 해주는 반면 그 결과는 인과적이라기보다 기술적임을 입증한다.

Jonas A. Mandalunes2026-08-28
📊 statistics

No need, or no category? Recording refusal of generative AI in European official statistics

이 논문은 유럽의 공식 통계가 설문 설계의 한계로 인해 장애 및 비용과 같은 결정적인 장벽들을 포착하지 못함으로써, 생성형 AI의 미사용 원인을 필요성 부족으로 잘못 귀인하고 있으며, 이를 통해 측정상의 인위적 결과물을 실제 대중의 무관심으로 오인하고 있다고 주장한다.

Jonas A. Mandalunes2026-08-28
📊 statistics

When the adjustment fails: population-denominator sensitivity in coverage-adjusted PISA trends

이 논문은 PISA의 커버리지 조정 상위 4분위 추세가 인구 분모의 선택에 매우 민감하다는 점을 입증하며, 보고된 데이터와 세계 인구 전망(World Population Prospects) 추정치 사이의 상당한 불일치를 드러냄으로써 투명한 출처 보고의 필요성과 합성 가중치가 조정을 유발할 때 주의가 필요함을 강조한다.

Jonas A. Mandalunes, Danica Jane S. Mandalunes2026-08-28
📊 statistics

Measurement-bounded predictive inference in international large-scale assessment: how the plausible-value ceiling governs attainable accuracy and the stability of predictor rankings in PISA 2022

본 연구는 PISA 2022의 가능한 값(plausible values)에 내재된 측정 정밀도의 한계가 도달 가능한 예측 정확도를 근본적으로 제한하고 영역 및 교육 체계 전반에 걸쳐 예측 변수의 순위를 불안정하게 만든다는 점을 입증하며, 이에 따라 성과 비교와 모델 해석은 이러한 계산 가능한 측정 경계에 근거해야 함을 보여준다.

Jonas A. Mandalunes2026-08-28
📊 statistics

Spatiotemporal Dynamics and Optimal Control of a Two-Stage Infection-Age Structured Epidemic Model with Nonlocal Diffusion, Chemotactic Avoidance, and Intermittent Control Strategies

본 논문은 평형점의 전역적 안정성을 증명하고, 베를린 데이터를 통해 공간적 표적 개입이 균일한 접근 방식보다 우월함을 입증하는 간헐적 전략을 포함한 이단계 감염 연령 역학 모델을 구축하기 위해 비국소 확산, 화학 주성 피함, 면역 약화가 통합된 새로운 모델을 정립하며, 이를 바탕으로 이중 수준 최적 제어 프레임워크를 개발한다.

Yuhao zhou2026-08-28
📊 statistics

Dense Truths, Sparse Estimators: Making Lasso Work for Dense-Signal Logistic Regression

이 논문은 밀집 신호(dense-signal)가 존재하는 고차원 설정에서 릿지 회귀(Ridge regression)를 선호하는 관행에 이의를 제기하며, 라쏘(Lasso)의 성능 저하가 내재적 결함이 아닌 차선적인 튜닝에서 비롯됨을 입증하고, 라쏘가 그 핵심적인 변수 선택 능력을 유지하면서도 릿지 회귀와 대등하거나 이를 상회하는 예측 정확도를 달새성할 수 있게 하는 새로운 사후 예측 penalty 선택기를 도입한다.

Jason Liao2026-08-28
📊 statistics

An Examination of the Performance of Variance Estimators in International Large-Scale Assessments

이 몬테카를로 시뮬레이션 연구는 국제 대규모 평가에서 BRR, JK2 및 부트스트래핑 분산 추정치의 성능을 평가하며, JK2가 평균과 같은 매끄러운 통계량에 대해 우수한 정밀도를 제공하는 반면, 부트스트래핑과 BRR은 비매끄러운 통계량에 대해 더 정확하고, Fay 조정 및 무응답 처리가 추정치 신뢰도에 유의미한 영향을 미친다는 것을 밝혀냈다.

Umut Atasever, Sabine Meinck, Diego Cortes2026-08-27
📊 statistics

Inverse Target Trial Emulation: A Method to Simulate Realistic Observational Data

이 논문은 무작위 대조 시험 데이터로부터 교란 요인과 시간 관련 편향을 체계적으로 유도함으로써 현실적인 관찰 데이터를 생성하는 베이지안 프레임워크인 역 대상 임상시험 모사(Inverse Target Trial Emulation, ITTE)를 소개하며, 이를 통해 비무작위 보건 연구에서 이러한 편향을 조정하기 위한 분석 전략들을 엄격하게 평가하고 비교할 수 있게 한다.

Luca Benetti, Gianluca Baio, Anna Heath2026-08-27
📊 statistics

What does Retraction Watch's "computer-generated content" reason capture? A metadata analysis of 9,161 retractions

9,161건의 철회 논문에 대한 이 메타데이터 분석은 리트랙션 워치(Retraction Watch)의 "컴퓨터 생성 콘텐츠" 사유가 특정 출판사 한 곳에 과도하게 집중되어 있으며 논문 공장(paper mills)과 강력하게 연관되어 있음을 밝혀내고 있으나, 이러한 패턴은 실제 철회된 논문들에 생성형 AI가 존재했다는 결정적인 증거를 제공하기보다는 공동 코딩(co-coding) 관행을 반영하는 것이다.

Jonas Mandalunes2026-08-27