💻 computer science

From Prompt to Production: A Case Study of Human-AI Collaborative Software Development Using Claude Code Multi-Agent Orchestration

Este artigo apresenta um estudo de caso abrangente do desenvolvimento de uma plataforma médica de nível de produção utilizando a orquestração multiagente do Claude Code, estabelecendo um framework de competência humano-IA, quantificando ganhos de desempenho em diferentes configurações de IA e propondo estratégias de otimização de tokens para aumentar a produtividade enquanto reduz custos.

Pham Thi Thuong, Nguyen Dang Quang, Ngo Thi Lan Phuong2026-07-07
💻 computer science

Prevalence Shift and ICU Mortality Miscalibration Across Institutions

Este artigo demonstra que o desajuste de prevalência ao nível hospitalar é uma causa dominante e quantificável de falha de calibração em modelos de mortalidade de UTI entre instituições, mostrando que uma simples correção bayesiana utilizando apenas taxas de mortalidade locais pode restaurar efetivamente a calibração sem exigir dados rotulados do alvo.

Aman Chandra H, Stuti Shivhare, Suyash Sahu2026-07-07
💻 computer science

Where Reasoning Breaks Under Compression: A Layer-Localized Quantization Autopsy with Three Foundation-Model Case Studies

Este artigo demonstra que as capacidades de raciocínio em modelos de fundação exibem padrões de fragilidade específicos por camada que variam entre arquiteturas, revelando que, embora a quantização uniforme seja suficiente em larguras de bits mais altas, uma estratégia de precisão mista guiada por mapas de fragilidade localizados por camada permite uma compressão significativa abaixo de quatro bits sem sacrificar o desempenho.

Prof. Ayman Elnashar2026-07-07
💻 computer science

A Safety Envelope for Foundation-Model Dental Diagnosis: Bounded-Deviation Guarantees and Cross-Center Refusal

Este artigo introduz um envelope de segurança leve e agnóstico à arquitetura (backbone-agnostic) que envolve modelos de fundação congelados para fornecer desvios de previsão comprovadamente limitados, confiança calibrada e recusa robusta de dados fora da distribuição, garantindo assim a confiabilidade necessária para o diagnóstico clínico odontológico em diversos centros e arquiteturas.

Prof. Ayman Elnashar, Norsin Elnashar, Prof. Ahmed Elemam2026-07-07
💻 computer science

VozConsultAI: A Provider-Agnostic Architecture and a Clinically Grounded Evaluation of Open-Weight Large Language Models for SOAP Note Extraction in Brazilian Portuguese Telehealth

Este artigo introduz o VozConsultAI, uma arquitetura de microsserviços agnóstica a provedores para a geração automatizada de notas SOAP em telemedicina em português brasileiro, e apresenta o primeiro benchmark comparativo de modelos de linguagem de pesos abertos utilizando uma nova métrica de avaliação clinicamente fundamentada que prioriza a segurança e penaliza alucinações.

Nilton Gomes Furtado, Julia Vasconcelos Furtado2026-07-07
💻 computer science

Learning Human-Aligned Explanations: AMeta-Model Approach to Combining XAIMethods for Arabic Sentiment Analysis

Este artigo propõe um framework de metamodelo supervisionado por humanos que combina múltiplos métodos de XAI para gerar explicações mais plausíveis e alinhadas ao ser humano para análise de sentimento em árabe, alcançando uma melhoria significativa de 0,84 no F1 score com CatBoost, ao mesmo tempo em que sacrifica parte da fidelidade em comparação com abordagens de ensemble anteriores.

Youssef Chafiqui, Houda Anoun2026-07-07
💻 computer science

AM-RAF: An Agentic, Retrieval-Augmented, Uncertainty-Gated Framework for Trustworthy Clinical Decision Support in Resource-Constrained Health Systems 

Este artigo propõe o AM-RAF, uma arquitetura conceitual de seis camadas que integra o raciocínio agêntico, a geração aumentada por recuperação e o adiamento baseado em incerteza para criar um sistema de suporte à decisão clínica confiável e preservador de privacidade, projetado especificamente para os desafios de conectividade e equidade de sistemas de saúde com recursos limitados.

Md. Maruf Sharker Munna2026-07-07
💻 computer science

Three Axes of Quantum Risk: A Unified Observability Model for PQC, QKD, and Crypto-Agility

Este artigo introduz um modelo de observabilidade de três eixos unificado para risco quântico que avalia ativos com base em resistência algorítmica, proteção de canal e agilidade criptográfica, apoiado por uma implementação de código aberto (Sezar) e validação empírica através de cenários de TLS, QKD e agilidade para abordar as limitações das atuais ferramentas de descoberta de eixo único.

Aleaddin Ozer, Murat Aydos2026-07-07
💻 computer science

Dynamic Task Offloading in Vehicular Edge Networks: A Mobility-Driven A3C-Based Framework

Este artigo propõe um framework de offloading de tarefas orientado pela mobilidade para Computação de Borda Veicular que utiliza o algoritmo de aprendizado por reforço profundo Asynchronous Advantage Actor-Critic (A3C) para otimizar as decisões de escalonamento, minimizando efetivamente a latência e o overhead de energia enquanto garante a confiabilidade em ambientes veiculares dinâmicos.

Manoj Kumar Somesula2026-07-07
💻 computer science

Selecting Performance-Representative Validation Sets for Developing Medical Image Segmentation Neural Networks

Este artigo propõe um novo método para selecionar um conjunto de validação pequeno e representativo do desempenho a partir de dados limitados de imagens médicas para melhorar a precisão do desenvolvimento do modelo, demonstrando, por meio de tarefas de segmentação de ressonância magnética de câncer de próstata, que esta abordagem produz estimativas de desempenho significativamente mais próximas dos resultados independentes reais do que o particionamento aleatório tradicional.

Xiangcen Wu, Wen Yan, Weixi Yi, Ester Bonmati, Yipeng Hu2026-07-07