💻 computer science

Lightweight attention mechanisms in breast ultrasound lesion segmentation: parameter cost, protocol choice, data leakage, and what the data can resolve

Questo studio dimostra che, sul dataset BUSI, i guadagni di prestazione derivanti da vari meccanismi di attenzione leggeri nella segmentazione delle lesioni dell'ecografia mammaria sono statisticamente trascurabili e al di sotto della risoluzione dei dati, mentre fattori come la profondità della rete e la fuga di dati (tramite la selezione dei checkpoint o duplicati quasi identici) producono effetti significativamente più grandi e risolvibili.

Gökhan Uçar2026-08-21
💻 computer science

The Say-Do Gap Index: A Reproducible NLP Pipeline for Detecting ESG Rhetoric–Reality Divergence in Corporate Media Coverage

Questo articolo presenta una pipeline NLP completamente riproducibile, che include un corpus curato, una tassonomia ESG a sei categorie e un classificatore BERT spagnolo perfezionato, progettati per quantificare la divergenza tra la retorica ESG aziendale e i risultati osservabili nella copertura mediatica attraverso un inedito "Say-Do Gap Index", affrontando al contempo la validità di costrutto e l'applicabilità in contesti diversi.

Alfredo Merlet2026-08-21
💻 computer science

BM25 and Dense Retrieval Are Complementary for Portuguese Clinical Text: An Empirical Study of Hybrid RAG Across 500 Clinical Queries

Questo studio empirico dimostra che per il supporto alle decisioni cliniche in lingua portoghese, il recupero ibrido che combina BM25 e metodi densi supera significativamente gli approcci a strategia singola sfruttando le loro forze complementari, convalidando al contempo la valutazione automatizzata basata su LLM e la verifica deterministica delle citazioni per garantire l'accuratezza e ridurre le allucinazioni.

Igor Eduardo2026-08-21
💻 computer science

Brazilian-PHI: Benchmarking Checksum-Validated Recognizers for CPF, CRM, CNS, CNPJ, RG, CEP, and Phone in Portuguese Clinical Text

Questo articolo introduce Brazilian-PHI, il primo benchmark per il rilevamento di sette tipi di informazioni personali sulla salute brasiliane nei testi clinici, dimostrando che i riconoscitori Presidio personalizzati con validazione checksum superano significativamente gli strumenti predefiniti e i grandi modelli linguistici in termini di accuratezza, latenza e conformità ai requisiti della LGPD.

Igor Eduardo2026-08-21
💻 computer science

Deconstructing the Trolley Problem: From Static Triage to a Two-Tier Hierarchical Evaluation Framework for Constructive Moral Intelligence

Questo articolo propone un Quadro di Valutazione Gerarchico a Due Livelli che trascende i compromessi statici del classico dilemma del carrello integrando un livello di ottimizzazione geometrica non compensativa per interventi fisici proattivi al tempo t=-1 con una transizione fluida verso un livello di salvaguardia consequenzialista al tempo t=0, riformulando così l'etica delle macchine dal calcolo passivo dello spettatore alla co-progettazione attiva della gestione del rischio morale.

Shinya Iida2026-08-21
💻 computer science

National Scale Disaster Response Optimization Engine Using Advanced Data Structures

Questo articolo presenta il National Scale Disaster Response Optimization Engine (NSDR-OE), un sistema che sfrutta un insieme di otto strutture dati avanzate per ottenere l'indicizzazione spaziale, la prioritizzazione dell'urgenza e la pianificazione delle risorse in tempo reale con complessità O(log n), dimostrando un'accelerazione di 231× rispetto ai baseline lineari e una latenza inferiore a 200 ms sia in scenari sintetici che in scenari di eventi sismici reali.

Vikas Maral, Kavya Bhand, Kabir Khanuja, Pranav Rana2026-08-21
💻 computer science

Structural Leakage in Host Intrusion Alert Corpora: An Evaluation Framework for ATT&CK Technique and Tactic Mapping

Questo articolo introduce un framework di valutazione consapevole della fuga di dati (leakage-aware) per la mappatura degli avvisi di intrusione degli host di Wazuh sulle tattiche e tecniche MITRE ATT&CK, dimostrando che i metodi di valutazione standard sovrastimano le prestazioni a causa della fuga strutturale di dati derivante dagli identificativi delle regole e dai modelli di avviso, mostrando al contempo che la previsione a livello di tattica rimane robusta quando tali bias vengono controllati.

Emad Sherif2026-08-21
💻 computer science

CARE: Controlled AI Reasoning for Enterprises

Questo articolo introduce CARE, un'architettura di governance runtime che traduce i principi etici dell'IA in controlli tecnici come l'applicazione dei confini dei dati e il routing dinamico dei modelli, dimostrando attraverso simulazioni di benchmark che le condizioni di ragionamento ingegneristico riducono significativamente l'esposizione dei dati e garantiscono un dispiegamento responsabile degli LLM in ambito enterprise.

Harshil Lodhiya2026-08-21
💻 computer science

Explainable AI-Based Labor Planning Framework for Distributed Transportation and Fulfillment Networks

Questo studio propone e valida un framework basato sull'intelligenza artificiale spiegabile che integra la previsione della domanda, l'analisi della produttività e l'ottimizzazione multi-obiettivo per unificare le decisioni di pianificazione del lavoro attraverso reti di trasporto distribuite, dimostrando la sua capacità di ridurre le carenze di personale e le ore di lavoro non necessarie, fornendo al contempo raccomandazioni trasparenti e leggibili dai manager.

Nakshi Das2026-08-21
💻 computer science

Adversarial Evaluation of a Two-Layer Anonymization Pipeline Against Record-Linkage Attacks

Questo articolo valuta empiricamente la sicurezza di una pipeline di anonimizzazione a due livelli che combina vincoli di privacy sintattica per i dati a livello di record con la privacy differenziale per le query aggregate contro attacchi di collegamento dei record realistici, dimostrando che l'assenza di una garanzia formale congiunta rende necessaria una valutazione avversaria diretta attraverso diversi dataset e scenari di conoscenza.

Mohammed Sayim Khalil2026-08-21