💻 computer science

Can One Agent Restore Another? Multi-Agent Verification Through Independent Constraint Sources

Questo studio dimostra che, mentre i modelli linguistici più grandi possono recuperare indipendentemente da istruzioni contrastanti, un agente accoppiato più piccolo può ripristinare il comportamento di un partner perturbato solo quando la cronologia del partner non contiene l'istruzione contrastante, fornendo prova del fatto che l'affidabilità distribuita nei sistemi multi-agente derivi da fonti di vincolo parzialmente indipendenti piuttosto che dal mero volume di generazione.

Simin Yuan2026-08-13
💻 computer science

From Human Approval to Current Authority: Adaptive Runtime Governance at the Execution Boundary of AI-Enabled Organizational Workflows

Questo studio propone l'Adaptive Runtime Governance (ARG) come un framework per affrontare il divario etico tra le approvazioni umane registrate e l'attuale autorità di esecuzione nei flussi di lavoro dell'IA, dimostrando attraverso un prototipo deterministico che la rivalidazione dell'autorizzazione e delle condizioni di policy immediatamente prima dell'esecuzione può tecnicamente imporre un'autorità umana attribuibile.

Maria Kollia2026-08-13
💻 computer science

Ethical Field Theory: Computational Foundations and Philosophical Extensions

Questo articolo presenta la Teoria del Campo Etico (EFT) come un quadro matematico unificato per l'allineamento dell'IA che modella la regolazione etica come un sistema dinamico continuo governato da equazioni di campo non lineari, collegando simultaneamente il calcolo formale con sei tradizioni filosofiche ed stabilendo sette previsioni verificabili per convalidare il suo rigore scientifico senza confondere l'analogia matematica con la realtà fisica.

Ali Moslemi Tabrizi2026-08-13
💻 computer science

Geometric Indexing Does Not Improve Versioned Memory Retrieval: Three Pre-Registered Negative Results and a Silent Total-Failure Mode

Questo articolo dimostra, attraverso tre esperimenti pre-registrati, che l'indicizzazione geometrica non riesce a migliorare il recupero della memoria versionata poiché lo spostamento artificiale nello spazio di embedding causa una deriva illimitata rispetto alle query, mentre la risoluzione della coreferenza rimane essenziale in quanto le correzioni ellittiche grezze sono irrecuperabili e portano a un fallimento totale silenzioso.

Maximiliano Rodrigo Speranza2026-08-13
💻 computer science

A Multi-Criteria Decision Framework for Aggregating Ranked ICD-10 Code Suggestions from Large Language Models

Questo studio dimostra che l'applicazione di metodi di aggregazione dei ranghi della Multi-Criteria Decision Analysis, in particolare il Borda Count e il Reciprocal Rank Fusion, per combinare gli output di molteplici Large Language Models migliora significativamente l'accuratezza e la stabilità della codifica clinica automatizzata ICD-10 rispetto all'utilizzo di singoli modelli o di semplici schemi di voto.

Ricardo da Silva Santos, Murilo Gleysson Gazzola, Paulo Marcelino Figueira, Adriana Gomes Luz, Rodolfo de Carvalho Pacag (…)2026-08-13
💻 computer science

Predictive Modeling for Course Demand and Revenue Forecasting on Edupro: Moving from Reactive to Proactive Planning

Questo articolo presenta una dashboard di analisi predittiva per EduPro che risolve i disallineamenti tra docenti e corsi e migliora le previsioni sui ricavi utilizzando un modello di regressione lineare, che ha superato Random Forest a causa delle piccole dimensioni del campione del dataset, consentendo così all'azienda di passare da una pianificazione reattiva a una proattiva.

Awinash Kumar2026-08-13
💻 computer science

ScintiGround-38K: A Grounded Visual Question Answering Benchmark for Paired Anterior–Posterior Bone Scintigraphy

Il documento introduce ScintiGround-38K, un benchmark su larga scala che preserva la provenienza per il visual question answering localizzato su immagini accoppiate di scintigrafia ossea antero-posteriore, il quale rivela come, sebbene i modelli raggiungano un'elevata accuratezza grezza nelle risposte, essi fatichino significativamente nella rilevazione delle classi minoritarie e nella localizzazione rigorosa basata sull'evidenza.

M. Rifqi Dzaky Azhad, Ema Rachmawati2026-08-13
💻 computer science

Code-Mixed Corpora for Indian Social Media: Baselines and Insights for Hinglish Language Identification

Questo articolo introduce un baseline leggero, basato su TF-IDF a livello di carattere e regressione logistica, per l'identificazione del linguaggio Hinglish a livello di token che raggiunge un'accuratezza del 95,92% sul dataset COMI-LINGUA, superando i modelli multilingue di circa il 7% fornendo al contempo un'analisi critica degli errori e una tabella di marcia per le future tecnologie linguistiche inclusive in India.

Kavita Srivastava2026-08-13
💻 computer science

Exclusive Self-Attention Beyond AdamW: Stability and Generalization under Muon Optimization

Questo articolo dimostra che l'Exclusive Self-Attention (XSA), un meccanismo progettato per ridurre il comportamento autoriferito, rimane stabile sotto l'ottimizzazione Muon e produce modesti miglioramenti nella generalizzazione nei modelli linguistici, con guadagni di prestazioni che diventano più costanti all'aumentare della scala del modello da 12 a 24 strati.

Chandana Dayapule2026-08-13