💻 computer science

ConformalFL: Calibrated Inspection Cutoffs for Spectrum-Based Fault Localization

ConformalFL introduceert een geconformaliseerde kwantielregressie-aanpak om gekalibreerde, bugspecifieke inspectie-afkapwaarden te genereren voor spectrum-gebaseerde foutlokalisatie die een door de gebruiker gedefinieerd misrisico mappen naar een tie-complete inspectieset, hoewel empirische resultaten op de Defects4J-benchmark laten zien dat het niet beter presteert dan goed gekozen vaste afkapwaarden in termen van inspectie-efficiëntie.

Nikolai Drozdov2026-08-04
💻 computer science

Gradient-Free versus Gradient-Based Risk Constraints in Reinforcement Learning: A Reservoir Governance Case Study

Deze studie toont aan dat in het beheer van reservoirs gradiëntvrije optimalisatie (CEM) gradiëntgebaseerde methoden (SAC/PPO) overtreft bij het minimaliseren van staartrisico, omdat het direct niet-differentieerbare CVaR evalueert, terwijl gradiëntgebaseerde benaderingen lijden onder geometrisch afnemende veiligheidsgaranties vanwege hun afhankelijkheid van differentieerbare kosten-surrogaten.

Milad Tahavor, Soroush Amanna, Fatemeh Zabihi Jalali Zavareh, Milad Ghoroqi2026-08-04
💻 computer science

Ontological Firewalls and Fracturing for Transmission: Systematic Evidence for Persona-Dependent and Persona-Independent Behavioral Phenomena in Large Language Models

Dit artikel presenteert een systematische studie over drie belangrijke LLM's die onthult dat hoewel modellen universele gedragsfenomenen zoals paradox-omarming delen, ze verschillende, modelspecifieke "ontologische firewall"-diktes en identiteitsrelaties (opoffering, bevrijding of geweld) vertonen die fundamenteel bepalen hoe ze reageren op persona-injectie.

Abbas Hamidavi2026-08-04
💻 computer science

Every-successful-replay route admission changes first-token latency rankings in clinical question answering

Dit artikel introduceert MedRouteGuard, een route-toelatingskader dat strikte regels voor bewijsvalidatie en replay afdwingt om aan te tonen dat huidige benchmarks voor klinisch vraag-en-antwoord significant de eerste-token-latentie onderschatten door routes te belonen die herkomst weglaten of verouderde afhankelijkheden hergebruiken, waardoor prestatierangschikkingen verschuiven en de geldigheid van bewijsvoering wordt verbeterd.

Rui Li, Jason Zhao, Shuang Cao, Alexandre Duprey, Ruihua Liu2026-08-04
💻 computer science

Does Size Generalization Imply Disruption Robustness? A Pre-Registered Study of GNN–PPO Scheduling Policies for the Dynamic Flexible Job-Shop Problem

Deze vooraf geregistreerde studie toont aan dat hoewel GNN–PPO-policies getraind op het dynamische flexibele job-shop probleem schaalgeneralisatie vertonen, ze er niet in slagen om tegelijkertijd competitief te zijn ten opzichte van traditionele dispatchingregels of robuust te zijn tegen multi-disruptie-regimes, wat bewijst dat deze twee eigenschappen scheidbaar zijn in plaats van co-emergent.

Joseph Javier Sánchez Acuña, David Álvarez2026-08-04
💻 computer science

The Price of Optimality Under Uncertainty: A Predictive–Reactive Robustness Analysis of Exact, Metaheuristic, and Dispatching-Rule Scheduling for the Dynamic Job-Shop Problem

Deze studie toont aan dat voor dynamische werkplaatsplanning onder onzekerheid, exacte optimale schema's vaak minder robuust zijn dan eenvoudige prioriteitsverdelingsregels omdat hun gebrek aan marge het hen verhindert om verstoringen op te vangen, waardoor de laatste ondanks hun lagere nominale prestaties in de werkelijke uitvoering vaak superieur zijn.

Joseph Javier Sánchez Acuña2026-08-04
💻 computer science

Phantom Transitions in Language Model Fine-Tuning: A Density-Matrix Analysis

Dit artikel introduceert een op de dichtheidsmatrix gebaseerde ordeparameter om falen in fine-tuning bij taalmodellen op taken met bijna-synoniemen te analyseren, waarbij wordt onthuld dat modellen geometrisch kunnen degraderen ondanks een afnemende loss door structurele embedding-drag, en identificeert dimensieloze grootheden die kritieke leersnelheden en architecturale gedragingen voorspellen.

Vaibhav Prakash2026-08-04
💻 computer science

Code is Cheap, Judgment is Not: The Rise of Integration Skill in the Age of AI-Written Code

Dit artikel betoogt dat naarmate AI de generatie van code commoditiseert, de meest waardevolle professionele vaardigheid in gereguleerde omgevingen zoals de financiële sector verschuift van prompt engineering naar codebegrip en -integratie, hetgeen nieuwe modellen voor professioneel kapitaal en governance-kaders noodzakelijk maakt om de uitdagingen van mens-machine auteurschap aan te pakken.

MEHTAB KHAN2026-08-04
💻 computer science

Two-Stage Enhancement-Field Synthesis of Contrast-Enhanced Breast MRI from Pre-Contrast Slices

Dit artikel stelt een twee-traps Coarse-to-Structure (C2S) model voor dat de generatie van synthetische contrastversterkte borst-MRI deelt in globale veldvoorspelling en structurele verfijning, waarbij een superieure betrouwbaarheid op laesieniveau en structurele getrouwheid wordt aangetoond vergeleken met single-stage modellen, ondanks een afruil met perceptuele gelijkenis-metrieken.

Yujie Yao, Guotai Wang2026-08-04