💻 computer science

How Portable Are LLM-Serving Scheduler Rankings Across Workloads, Operating Regions, and Metrics?

Questo articolo introduce l'LLM-Serving Scheduler Portability Benchmark (LSSP) per dimostrare che, sebbene le classifiche delle policy di scheduling mostrino un forte accordo tra alcune sorgenti di carico di lavoro, esse esibiscono una variabilità significativa e una portabilità limitata attraverso diverse regioni operative e metriche di valutazione, rendendo necessario che i confronti tra scheduler siano interpretati come condizionati al loro specifico contesto sperimentale.

Soroush Vahidi2026-09-08
💻 computer science

Adapting a small language model for plant protection information in Türkiye

Questo studio valuta BitkiKormacı, un sistema di piccolo modello linguistico turco per la protezione delle piante, dimostrando che, sebbene la generazione aumentata dalla ricerca migliori significativamente le prestazioni su specifici benchmark di sviluppo, il sistema presenta ancora fallimenti critici nei compiti di sicurezza e resistenza, sottolineando la necessità di una rigorosa revisione indipendente da parte di esperti prima del dispiegamento pratico.

Mehmet Solak2026-09-08
💻 computer science

Agency as an Architecture Layer: A Formal Enterprise Architecture Framework for Agentic-AI-Driven Enterprises

Questo articolo introduce l'Agentic Enterprise Architecture Framework (AEAF), un'estensione formale ai metamodelli tradizionali di enterprise architecture che incorpora uno strato di agenzia dedicato con semantica Datalog stratificata per modellare, analizzare e governare sistematicamente gli agenti IA non umani, definendo la loro autorità, responsabilità e i vincoli di coordinamento all'interno della struttura aziendale.

SAMIR EL HASSANI2026-09-08
💻 computer science

GAT-MAPPO-EIG: A Graph Attention Multi-Agent Reinforcement Learning Framework for Escape Interdiction Games on Dynamic Transportation Networks

Questo articolo propone GAT-MAPPO-EIG, un framework di Graph Attention Multi-Agent Proximal Policy Optimization che sfrutta il deep reinforcement learning per risolvere efficientemente giochi di interdizione della fuga su larga scala e dinamici, apprendendo strategie di intercettazione coordinate senza fare affidamento su metodi di ottimizzazione tradizionali computazionalmente costosi.

Sukanya Samanta2026-09-08
💻 computer science

Qaamuuska-NLP: A Structured 46K-Entry Somali Lexicon Extracted from a Print Dictionary

Questo articolo presenta Qaamuuska-NLP, un lessico somalo leggibile dalle macchine di 46.314 voci strutturato, estratto tramite una pipeline deterministica basata su regole dal dizionario monolingue del 2012 *Qaamuuska Af-Soomaaliga*, che preserva informazioni grammaticali e lessicali dettagliate mantenendo al contempo il testo originale delle voci per la verifica.

Abdullahi Mohamud Ahmed, Abdulkadir Ugas, Abdirashid Omar, Abdulhakim Ismail2026-09-08
💻 computer science

Mirage Mesh: A Multi-Layer Cyber Deception Framework for Linux Environments

Questo articolo introduce Mirage Mesh, un framework di cyber-deception leggero e multi-livello per ambienti Linux che integra esche a livello di rete, di sistema, di software e di dati con uno schema di eventi unificato e una pipeline automatizzata per rilevare e analizzare attività malevole che simulano l'amministrazione legittima, proponendo al contempo una nuova metrica per valutarne l'efficacia attraverso la cyber kill chain.

Mohamed Anwar Basha M, Praveen Kumar K, Priyadharshan V, Ram Prabhu K K2026-09-08
💻 computer science

Context-Window-Mediated Corruption of Large Multimodal Models in Clinical Medicine: A Systematic Review

Questa revisione sistematica di dieci studi ad alto rischio di bias rivela che i grandi modelli multimodali in medicina clinica sono vulnerabili alla corruzione basata sull'input attraverso quattro distinte classi di fallimento, una minaccia che persiste indipendentemente dalle caratteristiche del modello o dalle difese testate e che non richiede un attaccante avversario per compromettere l'integrità dell'output.

Amir Srour, Alon Galindo Mor, Mahmud Omar, Yiftach Barash, Diana Litmanovich, Mayse Srour-Asmar, Eyal Klang, Alon Gorens (…)2026-09-08
💻 computer science

Collapse-Retained Information and Representation-Independent Pushdown Exposure Complexity

Questo articolo stabilisce un teorema di compromesso indipendente dalla rappresentazione che dimostra come l'eliminazione delle informazioni semantiche di ordine superiore conservate dopo la fissazione di ordine inferiore in realizzazioni deterministiche pushdown non ristrette necessiti di un costo fisico quantificato dalla profondità di esposizione dello stack sorgente e dal debito di canonicalizzazione, con limiti inferiori netti derivati dall'interazione tra l'informazione conservata e la capacità di osservazione limitata.

Alp Eren Bütün2026-09-08
💻 computer science

Validation of Large Language Models in Healthcare: a Scoping Review 

Questa revisione sistematica mappa i metodi di validazione esistenti per i modelli linguistici di grandi dimensioni in ambito sanitario, categorizzandoli per compito e tipo di valutazione per fornire agli stakeholder un quadro strutturato per la selezione di strategie appropriate al contesto prima dell'implementazione clinica.

Anne A.H. de Hond, Ruurd Jan Anthonius Kuiper, Isa Spiero, Yu-Wen Chen, Demy L. Idema, Johanna A. A. Damen, Maarten van (…)2026-09-08
💻 computer science

Artificial intelligence for oral history and disaster experience: a systematic mapping study

Questo studio di mappatura sistematica esamina 35 studi primari per analizzare come l'intelligenza artificiale stia trasformando la storia orale da archivi statici in campi dinamici e interattivi, evidenziando progressi significativi nella trascrizione e nell'analisi e sottolineando al contempo le sfide etiche critiche e la necessità di approcci centrati sull'uomo e informati sul trauma.

Ahmad Azarsa, Ali Asgary, Maleknaz Nayebi, Sean Holman2026-09-08