💻 computer science

From Prompt to Production: A Case Study of Human-AI Collaborative Software Development Using Claude Code Multi-Agent Orchestration

Dieses Paper präsentiert eine umfassende Fallstudie zur Entwicklung einer medizinischen Produktionsplattform unter Verwendung der Multi-Agenten-Orchestrierung von Claude Code, etabliert ein Framework für die Kompetenz zwischen Mensch und KI, quantifiziert die Leistungssteigerungen über verschiedene KI-Konfigurationen hinweg und schlägt Strategien zur Token-Optimierung vor, um die Produktivität zu steigern und gleichzeitig die Kosten zu senken.

Pham Thi Thuong, Nguyen Dang Quang, Ngo Thi Lan Phuong2026-07-07
💻 computer science

Prevalence Shift and ICU Mortality Miscalibration Across Institutions

Diese Arbeit zeigt auf, dass die Prävalenz-Fehlanpassung auf Krankenhausebene eine dominante, quantifizierbare Ursache für Kalibrierungsfehler in institutionenübergreifenden ICU-Mortalitätsmodellen ist, wobei sie darlegt, dass eine einfache Bayes'sche Korrektur unter Verwendung lediglich lokaler Mortalitätsraten effektiv die Kalibrierung wiederherstellen kann, ohne dass gelabelte Ziel-Daten erforderlich sind.

Aman Chandra H, Stuti Shivhare, Suyash Sahu2026-07-07
💻 computer science

Where Reasoning Breaks Under Compression: A Layer-Localized Quantization Autopsy with Three Foundation-Model Case Studies

Diese Arbeit zeigt auf, dass die Fähigkeiten zum logischen Schlussfolgern in Foundation-Modellen eine schichtspezifische Fragilitätsmuster aufweisen, die über verschiedene Architekturen hinweg variieren, was offenlegt, dass während eine uniforme Quantisierung bei höheren Bitbreiten ausreicht, eine durch lokalisierte Fragilitätskarten gesteuerte Mixed-Precision-Strategie eine signifikante Kompression unter vier Bits ermöglicht, ohne die Leistung zu beeinträchtigen.

Prof. Ayman Elnashar2026-07-07
💻 computer science

A Safety Envelope for Foundation-Model Dental Diagnosis: Bounded-Deviation Guarantees and Cross-Center Refusal

Dieses Paper führt eine leichtgewichtige, backbone-agnostische Sicherheitsumhüllung ein, die eingefrorene Foundation-Modelle umschließt, um nachweislich begrenzte Vorhersageabweichungen, kalibrierte Konfidenz und eine robuste Out-of-Distribution-Verweigerung bereitzustellen und somit die für die klinische dentale Diagnose über verschiedene Zentren und Architekturen hinweg erforderliche Zuverlässigkeit zu gewährleisten.

Prof. Ayman Elnashar, Norsin Elnashar, Prof. Ahmed Elemam2026-07-07
💻 computer science

VozConsultAI: A Provider-Agnostic Architecture and a Clinically Grounded Evaluation of Open-Weight Large Language Models for SOAP Note Extraction in Brazilian Portuguese Telehealth

Dieses Paper stellt VozConsultAI vor, eine anbieterunabhängige Microservice-Architektur zur automatisierten Erstellung von SOAP-Notizen im brasilianischen Portugiesisch für die Telemedizin, und präsentiert den ersten vergleichenden Benchmark von Open-Weight-Large-Language-Models unter Verwendung einer neuartigen, klinisch fundierten Evaluationsmetrik, welche die Sicherheit priorisiert und Halluzinationen sanktioniert.

Nilton Gomes Furtado, Julia Vasconcelos Furtado2026-07-07
💻 computer science

Learning Human-Aligned Explanations: AMeta-Model Approach to Combining XAIMethods for Arabic Sentiment Analysis

Dieses Paper schlägt ein durch Menschen supervidiertes Meta-Modell-Framework vor, das mehrere XAI-Methoden kombiniert, um plausiblere und menschenorientierte Erklärungen für die arabische Sentiment-Analyse zu generieren, wobei eine signifikante Verbesserung des F1-Scores auf 0,84 mit CatBoost erzielt wird, während im Vergleich zu vorherigen Ensemble-Ansätzen eine gewisse Treue (Faithfulness) in Kauf genommen wird.

Youssef Chafiqui, Houda Anoun2026-07-07
💻 computer science

AM-RAF: An Agentic, Retrieval-Augmented, Uncertainty-Gated Framework for Trustworthy Clinical Decision Support in Resource-Constrained Health Systems 

Dieses Paper schlägt AM-RAF vor, eine konzeptionelle sechsschichtige Architektur, die agentisches Denken, Retrieval-Augmented Generation und Unsicherheits-gesteuerte Deferierung integriert, um ein vertrauenswürdiges, datenschutzwahrendes klinisches Entscheidungsunterstützungssystem zu schaffen, das speziell auf die Konnektivitäts- und Gerechtigkeitsherausforderungen ressourcenbeschränkter Gesundheitssysteme zugeschnitten ist.

Md. Maruf Sharker Munna2026-07-07
💻 computer science

Three Axes of Quantum Risk: A Unified Observability Model for PQC, QKD, and Crypto-Agility

Dieses Papier führt ein vereinheitlichtes dreiachsiges Beobachtbarkeitsmodell für Quantenrisiken ein, das Vermögenswerte basierend auf algorithmischer Resistenz, Kanalschutz und Krypto-Agilität bewertet, unterstützt durch eine Open-Source-Implementierung (Sezar) sowie empirische Validierung über TLS-, QKD- und Agilitäts-Szenarien hinweg, um die Einschränkungen aktueller einachsiger Discovery-Tools zu adressieren.

Aleaddin Ozer, Murat Aydos2026-07-07
💻 computer science

Dynamic Task Offloading in Vehicular Edge Networks: A Mobility-Driven A3C-Based Framework

Dieses Paper schlägt ein mobilitätsgesteuertes Task-Offloading-Framework für Vehicular Edge Computing vor, das den Asynchronous Advantage Actor-Critic (A3C) Deep-Reinforcement-Learning-Algorithmus nutzt, um Scheduling-Entscheidungen zu optimieren und dabei Latenz sowie Energieoverhead effektiv zu minimieren und gleichzeitig die Zuverlässigkeit in dynamischen Fahrzeugumgebungen zu gewährleisten.

Manoj Kumar Somesula2026-07-07
💻 computer science

Selecting Performance-Representative Validation Sets for Developing Medical Image Segmentation Neural Networks

Dieses Paper schlägt eine neuartige Methode zur Auswahl eines kleinen, leistungsrepräsentativen Validierungsdatensatzes aus begrenzten medizinischen Bilddaten vor, um die Genauigkeit der Modellentwicklung zu verbessern, wobei durch Aufgaben der Prostata-Karzinom-MRT-Segmentierung nachgewiesen wird, dass dieser Ansatz Leistungsabschätzungen liefert, die signifikant näher an den wahren unabhängigen Ergebnissen liegen als herkömmliche Zufallspartitionierungen.

Xiangcen Wu, Wen Yan, Weixi Yi, Ester Bonmati, Yipeng Hu2026-07-07