💻 computer science

ConformalFL: Calibrated Inspection Cutoffs for Spectrum-Based Fault Localization

ConformalFL introduce un enfoque de regresión de cuantiles conformalizado para generar umbrales de inspección específicos para cada error, calibrados para la localización de fallos basada en espectro, que mapean un riesgo de omisión definido por el usuario hacia un conjunto de inspección de completitud de empates, aunque los resultados empíricos en el benchmark Defects4J muestran que no supera a los umbrales fijos bien elegidos en términos de eficiencia de inspección.

Nikolai Drozdov2026-08-04
💻 computer science

Gradient-Free versus Gradient-Based Risk Constraints in Reinforcement Learning: A Reservoir Governance Case Study

Este estudio demuestra que, en la gestión de embalses, la optimización libre de gradiente (CEM) supera a los métodos basados en gradiente (SAC/PPO) en la minimización del riesgo de cola porque evalúa directamente el CVaR no diferenciable, mientras que los enfoques basados en gradiente sufren de garantías de seguridad que decaen geométricamente debido a su dependencia de sustitutos de costo diferenciables.

Milad Tahavor, Soroush Amanna, Fatemeh Zabihi Jalali Zavareh, Milad Ghoroqi2026-08-04
💻 computer science

Ontological Firewalls and Fracturing for Transmission: Systematic Evidence for Persona-Dependent and Persona-Independent Behavioral Phenomena in Large Language Models

Este artículo presenta un estudio sistemático a través de tres LLM principales que revela que, si bien los modelos comparten fenómenos de comportamiento universales como la adopción de paradojas, exhiben distintos espesores de "muro de fuego ontológico" específicos de cada modelo y relaciones de identidad (sacrificio, liberación o violencia) que moldean fundamentalmente cómo responden a la inyección de personajes.

Abbas Hamidavi2026-08-04
💻 computer science

Every-successful-replay route admission changes first-token latency rankings in clinical question answering

Este artículo presenta MedRouteGuard, un marco de admisión de rutas que impone reglas estrictas de validación de evidencia y de repetición para revelar que los actuales referentes de respuesta a preguntas clínicas subestiman significativamente la latencia del primer token al recompensar rutas que omiten la procedencia o reutilizan dependencias obsoletas, desplazando así las clasificaciones de rendimiento y mejorando la validez de la evidencia.

Rui Li, Jason Zhao, Shuang Cao, Alexandre Duprey, Ruihua Liu2026-08-04
💻 computer science

Does Size Generalization Imply Disruption Robustness? A Pre-Registered Study of GNN–PPO Scheduling Policies for the Dynamic Flexible Job-Shop Problem

Este estudio preregistrado demuestra que, si bien las políticas GNN–PPO entrenadas en el problema de la planta de trabajo flexible dinámica exhiben generalización de tamaño, no logran alcanzar simultáneamente competitividad frente a las reglas de despacho tradicionales o robustez contra regímenes de múltiples disrupciones, demostrando que estas dos propiedades son separables en lugar de coemergentes.

Joseph Javier Sánchez Acuña, David Álvarez2026-08-04
💻 computer science

The Price of Optimality Under Uncertainty: A Predictive–Reactive Robustness Analysis of Exact, Metaheuristic, and Dispatching-Rule Scheduling for the Dynamic Job-Shop Problem

Este estudio demuestra que, para la programación dinámica de talleres de trabajo bajo incertidumbre, los programas óptimos exactos son a menudo menos robustos que las reglas simples de despacho de prioridad porque su falta de holgura les impide absorber las perturbaciones, lo que hace que estas últimas sean frecuentemente superiores en la ejecución del mundo real a pesar de su menor desempeño nominal.

Joseph Javier Sánchez Acuña2026-08-04
💻 computer science

Phantom Transitions in Language Model Fine-Tuning: A Density-Matrix Analysis

Este artículo introduce un parámetro de orden basado en la matriz de densidad para analizar los fallos de ajuste fino en modelos de lenguaje en tareas de casi-sinónimos, revelando que los modelos pueden degradarse geométricamente a pesar de la disminución de la pérdida debido al arrastre estructural de incrustaciones e identificando cantidades adimensionales que predicen tasas de aprendizaje críticas y comportamientos arquitectónicos.

Vaibhav Prakash2026-08-04
💻 computer science

Code is Cheap, Judgment is Not: The Rise of Integration Skill in the Age of AI-Written Code

Este artículo sostiene que, a medida que la IA comoditiza la generación de código, la habilidad profesional más valiosa en entornos regulados como las finanzas se desplaza de la ingeniería de prompts hacia la comprensión e integración de código, lo que requiere nuevos modelos de capital profesional y marcos de gobernanza para abordar los desafíos de la autoría humano-máquina.

MEHTAB KHAN2026-08-04
💻 computer science

Two-Stage Enhancement-Field Synthesis of Contrast-Enhanced Breast MRI from Pre-Contrast Slices

Este artículo propone un modelo de dos etapas de Grueso-a-Estructura (C2S, por sus siglas en inglés) que descompone la generación de resonancias magnéticas de mama con contraste sintético en la predicción de campo global y el refinamiento estructural, demostrando una fiabilidad a nivel de lesión y una fidelidad estructural superiores en comparación con los modelos de una sola etapa, a pesar de un compromiso con las métricas de similitud perceptual.

Yujie Yao, Guotai Wang2026-08-04