💻 computer science

From Prompt to Production: A Case Study of Human-AI Collaborative Software Development Using Claude Code Multi-Agent Orchestration

Dit artikel presenteert een uitgebreide casestudy over de ontwikkeling van een medisch platform voor productieomgevingen met behulp van de multi-agent orchestratie van Claude Code, waarbij een mens-AI-competentiekader wordt vastgesteld, prestatiewinsten over verschillende AI-configuraties wordt gekwantificeerd, en strategieën voor tokenoptimalisatie worden voorgesteld om de productiviteit te verhogen terwijl de kosten worden verlaagd.

Pham Thi Thuong, Nguyen Dang Quang, Ngo Thi Lan Phuong2026-07-07
💻 computer science

Prevalence Shift and ICU Mortality Miscalibration Across Institutions

Dit artikel toont aan dat prevalentie-mismatch op ziekenhuisniveau een dominante, kwantificeerbare oorzaak is van kalibratiefalen in cross-institutionele ICU-sterftecijfermodellen, waarbij wordt aangetoond dat een eenvoudige Bayesiaanse correctie met enkel lokale sterftecijfers effectief de kalibratie kan herstellen zonder dat gelabelde doelgegevens vereist zijn.

Aman Chandra H, Stuti Shivhare, Suyash Sahu2026-07-07
💻 computer science

Where Reasoning Breaks Under Compression: A Layer-Localized Quantization Autopsy with Three Foundation-Model Case Studies

Dit artikel toont aan dat de redeneercapaciteiten in foundation models laagspecifieke fragiliteitspatronen vertonen die variëren over architecturen, wat onthult dat hoewel uniforme kwantisatie volstaat bij hogere bitbreedtes, een mixed-precision strategie geleid door laaggelokaliseerde fragiliteitskaarten significante compressie onder de vier bits mogelijk maakt zonder prestatieverlies.

Prof. Ayman Elnashar2026-07-07
💻 computer science

A Safety Envelope for Foundation-Model Dental Diagnosis: Bounded-Deviation Guarantees and Cross-Center Refusal

Dit artikel introduceert een lichtgewicht, backbone-agnostische veiligheidsenvelop die bevroren foundation models omhult om bewezen begrensde voorspellingsafwijkingen, gekalibreerd vertrouwen en robuuste out-of-distribution weigering te bieden, waardoor de betrouwbaarheid wordt gewaarborgd die vereist is voor klinische tandheelkundige diagnose over diverse centra en architecturen heen.

Prof. Ayman Elnashar, Norsin Elnashar, Prof. Ahmed Elemam2026-07-07
💻 computer science

VozConsultAI: A Provider-Agnostic Architecture and a Clinically Grounded Evaluation of Open-Weight Large Language Models for SOAP Note Extraction in Brazilian Portuguese Telehealth

Dit artikel introduceert VozConsultAI, een provider-agnostische microservice-architectuur voor de geautomatiseerde generatie van SOAP-notities in het Braziliaans-Portugees voor tele-health, en presenteert de eerste vergelijkende benchmark van open-weight large language models met behulp van een nieuwe, klinisch onderbouwde evaluatiemethode die veiligheid prioriteert en hallucinaties bestraft.

Nilton Gomes Furtado, Julia Vasconcelos Furtado2026-07-07
💻 computer science

Learning Human-Aligned Explanations: AMeta-Model Approach to Combining XAIMethods for Arabic Sentiment Analysis

Dit artikel stelt een door mensen gesuperviseerd meta-model raamwerk voor dat meerdere XAI-methoden combineert om meer plausibele en mensgerichte verklaringen te genereren voor Arabische sentimentanalyse, waarbij een significante verbetering van de F1-score van 0,84 wordt bereikt met CatBoost, terwijl er een afruil wordt gemaakt wat betreft de getrouwheid vergeleken met eerdere ensemble-benaderingen.

Youssef Chafiqui, Houda Anoun2026-07-07
💻 computer science

AM-RAF: An Agentic, Retrieval-Augmented, Uncertainty-Gated Framework for Trustworthy Clinical Decision Support in Resource-Constrained Health Systems 

Dit artikel stelt AM-RAF voor, een conceptuele zeslaagse architectuur die agentische redenering, retrieval-augmented generatie en onzekerheid-gestuurde uitstel integreren om een betrouwbaar, privacy-bewarend klinisch beslissingsondersteunend systeem te creëren dat specifiek is ontworpen voor de connectiviteits- en rechtvaardigheidsuitdagingen van hulpbronnenarme gezondheidssystemen.

Md. Maruf Sharker Munna2026-07-07
💻 computer science

Three Axes of Quantum Risk: A Unified Observability Model for PQC, QKD, and Crypto-Agility

Dit artikel introduceert een verenigd drie-assig observabiliteitsmodel voor kwantumrisico dat activa evalueert op basis van algoritmische weerstand, kanaalbescherming en crypto-agility, ondersteund door een open-source implementatie (Sezar) en empirische validatie over TLS-, QKD- en agility-scenario's om de beperkingen van huidige single-axis ontdekkingsinstrumenten aan te pakken.

Aleaddin Ozer, Murat Aydos2026-07-07
💻 computer science

Dynamic Task Offloading in Vehicular Edge Networks: A Mobility-Driven A3C-Based Framework

Dit artikel stelt een mobiliteitsgestuurd task offloading-framework voor Vehicular Edge Computing voor dat het Asynchronous Advantage Actor-Critic (A3C) deep reinforcement learning-algoritme gebruikt om planningsbeslissingen te optimaliseren, waarbij effectief de latentie en het energieverbruik wordt geminimaliseerd terwijl de betrouwbaarheid in dynamische voertuigomgevingen wordt gewaarborgd.

Manoj Kumar Somesula2026-07-07
💻 computer science

Selecting Performance-Representative Validation Sets for Developing Medical Image Segmentation Neural Networks

Dit artikel stelt een nieuwe methode voor voor het selecteren van een kleine, prestatievertegenwoordigende validatieset uit beperkte medische beeldgegevens om de nauwkeurigheid van modelontwikkeling te verbeteren, waarbij wordt aangetoond door middel van prostaatkanker MRI-segmentatietaken dat deze aanpak prestatieschattingen oplevert die significant dichter bij ware onafhankelijke resultaten liggen dan traditionele willekeurige partitionering.

Xiangcen Wu, Wen Yan, Weixi Yi, Ester Bonmati, Yipeng Hu2026-07-07