💻 computer science

When Reward Is Not Grammar: A Reward-Action Validity Audit of Deep Reinforcement Learning for English Inflection

Este artículo introduce una auditoría de validez de recompensa-acción para demostrar que un cuaderno de Deep Q-Network que afirma aprender morfología inglesa en realidad falla en la adquisición de reglas gramaticales debido a fallos fundamentales en su función de recompensa, expresividad de acción, codificación de estado y metodología de evaluación.

Nikesh Adhikari, Shankar Ghimire, Sagar Neupane2026-08-22
💻 computer science

CNN Regularization and Model Capacity: An Empirical Investigation of L1, L2, and Dropout in Hand Sign Image Classification

Este estudio empírico demuestra que en la clasificación de imágenes de señas manuales, aumentar la capacidad de la CNN no garantiza un mejor rendimiento y que la regularización por dropout, particularmente con tasas dependientes de la arquitectura, supera significativamente a las penalizaciones L1 y L2, logrando un modelo de tamaño mediano la precisión más alta de 96,66%.

Chaitanya Patil2026-08-22
💻 computer science

LMS-FAIR-India: A FAIR Compliant Synthetic LMS Interaction Dataset from a Private University for Privacy Preserving Learning Analytics

Este artículo presenta LMS-FAIR-India, un conjunto de datos totalmente sintético y conforme con los principios FAIR de 1,7 millones de eventos de interacción de LMS de una universidad privada india que permite la investigación de analítica del aprendizaje preservando la privacidad sin utilizar datos reales de estudiantes.

Sanjay Agal2026-08-22
💻 computer science

Coverage and Complementarity of Three Agentic AI Risk Taxonomies Across 131 Real World Incidents

Este artículo evalúa empíricamente la cobertura y complementariedad de tres taxonomías dominantes de riesgos de la IA agéntica (OWASP-ASI, MSFT-AIRT y NIST AI RMF) a través de 131 incidentes del mundo real para proporcionar orientación basada en evidencia a los profesionales e identificar brechas específicas para futuras revisiones de los marcos de trabajo.

Shivaraman Parthasarathy2026-08-21
💻 computer science

A memetic ant colony system algorithm for multiple machine scheduling in additive manufacturing with orientation selection of parts and energy costs ​

Este artículo propone un novedoso algoritmo de sistema de colonia de hormigas memético integrado con el descenso de vecindad variable para resolver el problema de programación de múltiples máquinas en la fabricación aditiva mediante la optimización simultánea de los costes energéticos, la ruta de finalización (makespan) y las orientaciones de las piezas, demostrando mejoras significativas de eficiencia respecto a los métodos existentes.

JOSE CARLOS MOLINA, Ignacio Eguia, Andres Padillo, Jesus Racero2026-08-21
💻 computer science

Curvature-Information Duality Driven Geometrically Optimal Compression of Deep Models

Este artículo presenta el marco de trabajo Curvature-aware Information Bottleneck (CurvIB), una técnica de compresión de modelos teóricamente fundamentada basada en la geometría de la información y el teorema de la dualidad curvatura-información, la cual unifica la poda adaptativa sensible a la curvatura, la cuantización óptima consciente de Wasserstein y la recuperación de precisión basada en el transporte óptimo para mejorar significativamente el rendimiento de los modelos de aprendizaje profundo bajo restricciones extremas de recursos.

Hongyu Zheng2026-08-21
💻 computer science

Lightweight attention mechanisms in breast ultrasound lesion segmentation: parameter cost, protocol choice, data leakage, and what the data can resolve

Este estudio demuestra que, en el conjunto de datos BUSI, las mejoras en el rendimiento de diversos mecanismos de atención ligeros en la segmentación de lesiones de ultrasonido mamario son estadísticamente insignificantes y están por debajo de la resolución de los datos, mientras que factores como la profundidad de la red y la fuga de datos (a través de la selección de puntos de control o duplicados cercanos) producen efectos significativamente mayores y resolubles.

Gökhan Uçar2026-08-21
💻 computer science

The Say-Do Gap Index: A Reproducible NLP Pipeline for Detecting ESG Rhetoric–Reality Divergence in Corporate Media Coverage

Este artículo presenta un flujo de trabajo de PLN totalmente reproducible, que incluye un corpus curado, una taxonomía ESG de seis categorías y un clasificador BERT en español ajustado, diseñado para cuantificar la divergencia entre la retórica ESG corporativa y los resultados observables en la cobertura mediática a través de un novedoso "Índice de Brecha Decir-Hacer" al tiempo que aborda la validez de constructo y la aplicabilidad transcontextual.

Alfredo Merlet2026-08-21
💻 computer science

BM25 and Dense Retrieval Are Complementary for Portuguese Clinical Text: An Empirical Study of Hybrid RAG Across 500 Clinical Queries

Este estudio empírico demuestra que para el soporte de decisiones clínicas en portugués, la recuperación híbrida que combina BM25 y métodos densos supera significativamente a los enfoques de estrategia única al aprovechar sus fortalezas complementarias, validando al mismo tiempo la evaluación automatizada basada en LLM y la verificación de citas determinista para garantizar la precisión y reducir las alucinaciones.

Igor Eduardo2026-08-21
💻 computer science

Brazilian-PHI: Benchmarking Checksum-Validated Recognizers for CPF, CRM, CNS, CNPJ, RG, CEP, and Phone in Portuguese Clinical Text

Este artículo presenta Brazilian-PHI, el primer benchmark para la detección de siete tipos de información de salud personal brasileña en textos clínicos, demostrando que los reconocedores de Presidio personalizados con validación de suma de comprobación superan significativamente a las herramientas predeterminadas y a los modelos de lenguaje extensos en precisión, latencia y cumplimiento de los requisitos de la LGPD.

Igor Eduardo2026-08-21