cs.AI articoli | Gist.Science

CERES: A Probabilistic Early Warning System for Acute Food Insecurity

Il documento presenta CERES, un sistema di allerta precoce probabilistico, open-source e automatizzato che genera stime settimanali a 90 giorni sull'insicurezza alimentare acuta in 43 paesi ad alto rischio, integrando sei flussi di dati e impegnandosi nella verifica pubblica prospettica di ogni previsione.

Tom Danny S. Pedersen2026-03-11🤖 cs.AI

Common Sense vs. Morality: The Curious Case of Narrative Focus Bias in LLMs

Questo studio introduce il benchmark CoMoral per evidenziare come i grandi modelli linguistici tendano a privilegiare il ragionamento morale rispetto alla comprensione del senso comune, mostrando inoltre un pregiudizio narrativo che li porta a rilevare più facilmente contraddizioni attribuite a personaggi secondari rispetto al narratore.

Saugata Purkayastha, Pranav Kushare, Pragya Paramita Pal, Sukannya Purkayastha2026-03-11🤖 cs.AI

AI Act Evaluation Benchmark: An Open, Transparent, and Reproducible Evaluation Dataset for NLP and RAG Systems

Questo articolo presenta un dataset aperto, trasparente e riproducibile per valutare la conformità dei sistemi NLP e RAG al Regolamento UE sull'IA, combinando conoscenze giuridiche e modelli linguistici per generare scenari e compiti di classificazione del rischio, recupero di articoli e generazione di obblighi.

Athanasios Davvetas, Michael Papademas, Xenia Ziouvelou, Vangelis Karkaletsis2026-03-11🤖 cs.AI

A Guideline-Aware AI Agent for Zero-Shot Target Volume Auto-Delineation

Il paper presenta OncoAgent, un agente AI innovativo che traduce le linee guida cliniche testuali in volumi target tridimensionali per la radioterapia in modo zero-shot e senza riaddestramento, ottenendo prestazioni superiori e una maggiore conformità alle linee guida rispetto ai modelli supervisionati tradizionali.

Yoon Jo Kim, Wonyoung Cho, Jongmin Lee, Han Joo Chae, Hyunki Park, Sang Hoon Seo, Noh Jae Myung, Kyungmi Yang, Dongryul Oh, Jin Sung Kim2026-03-11🤖 cs.AI

Variational Routing: A Scalable Bayesian Framework for Calibrated Mixture-of-Experts Transformers

Il paper introduce VMoER, un approccio bayesiano strutturato che applica l'inferenza variazionale alla fase di routing nelle architetture Mixture-of-Experts, consentendo una quantificazione dell'incertezza calibrata e scalabile per i modelli foundation con un costo computazionale trascurabile.

Albus Yizhuo Li, Matthew Wicker2026-03-11🤖 cs.AI

Declarative Scenario-based Testing with RoadLogic

RoadLogic è un sistema open-source che colma il divario tra le specifiche dichiarative OpenSCENARIO e le simulazioni eseguibili per i veicoli autonomi, utilizzando la programmazione logica a insiemi di risposte e la pianificazione del movimento per generare automaticamente scenari realistici e conformi alle specifiche.

Ezio Bartocci, Alessio Gambi, Felix Gigler, Cristinel Mateis, Dejan Ničkovic2026-03-11🤖 cs.AI

An Empirical Study and Theoretical Explanation on Task-Level Model-Merging Collapse

Questo studio identifica e spiega teoricamente il "crollo" nel merging di modelli, dimostrando attraverso analisi empiriche che l'incompatibilità rappresentazionale tra compiti, e non il conflitto nello spazio dei parametri, è la causa principale del degrado delle prestazioni quando si uniscono modelli LLM specializzati.

Yuan Cao, Dezhi Ran, Yuzhe Guo, Mengzhou Wu, Simin Chen, Linyi Li, Wei Yang, Tao Xie2026-03-11🤖 cs.AI

EvoDriveVLA: Evolving Autonomous Driving Vision-Language-Action Model via Collaborative Perception-Planning Distillation

Il paper propone EvoDriveVLA, un innovativo framework di distillazione collaborativa percezione-pianificazione che risolve le instabilità dei modelli Vision-Language-Action per la guida autonoma integrando vincoli percettivi auto-ancorati e ottimizzazione delle traiettorie guidata da un "oracle", ottenendo prestazioni all'avanguardia nelle valutazioni open-loop e closed-loop.

Jiajun Cao, Xiaoan Zhang, Xiaobao Wei, Liyuqiu Huang, Wang Zijian, Hanzhen Zhang, Zhengyu Jia, Wei Mao, Hao Wang, Xianming Liu, Shuchang Zhou Liu, Yang Wang, Shanghang Zhang2026-03-11🤖 cs.AI

Telogenesis: Goal Is All U Need

Il paper "Telogenesis" dimostra che le priorità attentive possono emergere endogenamente da un agente basandosi esclusivamente su tre lacune epistemiche (ignoranza, sorpresa e obsolescenza), permettendo di generare strategie adattive che superano quelle fisse e ricostruiscono la struttura ambientale latente senza ricompense esterne.

Zhuoran Deng, Yizhi Zhang, Ziyi Zhang, Wan Shen2026-03-11🤖 cs.AI

GenePlan: Evolving Better Generalized PDDL Plans using Large Language Models

Il paper presenta GenePlan, un nuovo framework che utilizza algoritmi evolutivi assistiti da modelli linguistici di grandi dimensioni per generare pianificatori generalizzati interpretabili in Python, i quali dimostrano prestazioni superiori rispetto ai metodi basati su prompt e paragonabili agli stati dell'arte nel risolvere compiti di pianificazione classica.

Andrew Murray, Danial Dervovic, Alberto Pozanco, Michael Cashmore2026-03-11🤖 cs.AI

Vibe-Creation: The Epistemology of Human-AI Emergent Cognition

Questo articolo teorizza che l'interazione tra ragionamento umano e intelligenza artificiale generativa genera una "Terza Entità" emergente, caratterizzata da un'asimmetria di agency e da un processo di "vibe-creation" che automatizza la conoscenza tacita, sfidando così i paradigmi epistemologici tradizionali e ridefinendo la competenza intellettuale nell'era dell'IA.

Ilya Levin2026-03-11🤖 cs.AI

Temporal-Conditioned Normalizing Flows for Multivariate Time Series Anomaly Detection

Il paper introduce i flussi di normalizzazione condizionati temporalmente (tcNF), un nuovo framework autoregressivo che migliora il rilevamento di anomalie nelle serie temporali multivariate modellando con precisione le dipendenze temporali e le incertezze per generare distribuzioni probabilistiche affidabili.

David Baumgartner, Helge Langseth, Kenth Engø-Monsen, Heri Ramampiaro2026-03-11🤖 cs.AI

Evolving Prompt Adaptation for Vision-Language Models

Il paper propone EvoPrompt, un nuovo framework che utilizza un proiettore di prompt condiviso tra modalità e una strategia di addestramento evolutiva con regolarizzazione geometrica per guidare l'adattamento dei modelli visione-linguaggio su compiti con pochi dati, garantendo alte prestazioni few-shot senza dimenticare le capacità zero-shot pre-addestrate.

Enming Zhang, Jiayang Li, Yanru Wu, Zhenyu Liu, Yang Li2026-03-11🤖 cs.AI

Efficiently Aligning Draft Models via Parameter- and Data-Efficient Adaptation

Il paper presenta EDA, un framework efficiente in termini di parametri e dati che utilizza un'architettura decoppiata, una strategia di rigenerazione dei dati e un meccanismo di selezione dei campioni per adattare rapidamente i modelli bozzetto a modelli target finemente sintonizzati, ripristinando così le prestazioni del decoding speculativo con costi di addestramento ridotti.

Luxi Lin, Zhihang Lin, Zhanpeng Zeng, Yuhao Chen, Qingyu Zhang, Jixiang Luo, Xuelong Li, Rongrong Ji2026-03-11🤖 cs.AI

Enhancing Debunking Effectiveness through LLM-based Personality Adaptation

Questo studio propone un metodo innovativo che utilizza i Large Language Models per generare messaggi di debunking delle fake news personalizzati in base ai tratti della personalità, dimostrando che tali messaggi sono generalmente più persuasivi di quelli generici e sollevando al contempo importanti questioni etiche.

Pietro Dell'Oglio, Alessandro Bondielli, Francesco Marcelloni, Lucia C. Passaro2026-03-11🤖 cs.AI

Compiler-First State Space Duality and Portable $O(1)$ Autoregressive Caching for Inference

Questo lavoro dimostra che l'implementazione di Mamba-2 utilizzando esclusivamente primitive standard XLA, senza kernel personalizzati, abilita un caching autoregressivo portatile e a complessità $O(1)$ che raggiunge prestazioni elevate su CPU, GPU NVIDIA e TPU mantenendo la compatibilità numerica con le implementazioni CUDA di riferimento.

Cosmo Santoni2026-03-11🤖 cs.AI

Routing without Forgetting

Il paper introduce "Routing without Forgetting" (RwF), un'architettura transformer che risolve il problema dell'apprendimento continuo online senza dimenticare, sostituendo l'adattamento graduale dei parametri con un routing dinamico basato su reti di Hopfield moderne per generare prompt contestuali in un singolo passaggio.

Alessio Masano, Giovanni Bellitto, Dipam Goswani, Joost Van de Weijer, Concetto Spampinato2026-03-11🤖 cs.AI

A Variational Latent Equilibrium for Learning in Cortex

Questo lavoro propone un formalismo generale basato su principi di conservazione dell'energia e azione estrema per approssimare la retropropagazione nel tempo (BPTT) in modo biologicamente plausibile, estendendo il modello di Equilibrio Latente Generalizzato (GLE) per fornire un quadro rigoroso per l'apprendimento spaziotemporale nel cervello e per circuiti fisici.

Simon Brandt, Paul Haider, Walter Senn, Federico Benitez, Mihai A. Petrovici2026-03-11🤖 cs.AI

Context Engineering: From Prompts to Corporate Multi-Agent Architecture

Questo paper introduce l'ingegneria del contesto come disciplina fondamentale per gestire l'ambiente informativo degli agenti AI autonomi, proponendo un modello di maturità a quattro livelli che integra ingegneria del contesto, dell'intento e delle specifiche per superare le sfide di scalabilità e allineamento strategico nelle implementazioni aziendali.

Vera V. Vishnyakova2026-03-11🤖 cs.AI

Grounding Synthetic Data Generation With Vision and Language Models

Questo lavoro presenta un framework interpretabile basato su modelli visione-linguaggio per la generazione e valutazione di dati sintetici nel telerilevamento, introducendo il dataset ARAS400k che dimostra come l'addestramento su dati reali aumentati con dati sintetici superi le prestazioni dei modelli basati solo su dati reali per segmentazione semantica e descrizione di immagini.

Ümit Mert Ça\u{g}lar, Alptekin Temizel2026-03-11🤖 cs.AI

← Precedente Successivo →

cs.AI