cs.AI articoli | Gist.Science

Sparse Variational Student-t Processes for Heavy-tailed Modeling

Il paper presenta gli Sparse Variational Student-t Processes (SVTP), un nuovo framework che estende i processi a punti induttori sparsi ai processi Student-t, offrendo un metodo scalabile e robusto per la modellazione di dati con code pesanti e outlier che supera le prestazioni dei processi Gaussiani sparsi.

Jian Xu, Delu Zeng, John Paisley2026-03-11🤖 cs.AI

Robust Training of Neural Networks at Arbitrary Precision and Sparsity

Questo paper introduce un quadro unificato che modella la quantizzazione e la sparsificazione come rumore additivo, proponendo una trasformata di dequantizzazione basata sulla regressione ridge per fornire un percorso di gradiente ben definito che permette l'addestramento stabile di reti neurali ad alta efficienza con precisione arbitraria e livelli di sparsità estremi, superando i limiti degli approcci esistenti come lo Straight-Through Estimator.

Chengxi Ye, Grace Chu, Yanfeng Liu, Yichi Zhang, Lukasz Lew, Li Zhang, Mark Sandler, Andrew Howard2026-03-11🤖 cs.AI

DRUPI: Dataset Reduction Using Privileged Information

Il paper introduce DRUPI, un metodo di condensazione del dataset che migliora le prestazioni dei modelli sintetizzando informazioni privilegiate (come etichette di feature o attenzione) insieme ai dati ridotti, ottenendo significativi guadagni su diversi benchmark.

Shaobo Wang, Youxin Jiang, Tianle Niu, Yantai Yang, Ruiji Zhang, Shuhao Hu, Shuaiyu Zhang, Chenghao Sun, Weiya Li, Conghui He, Xuming Hu, Linfeng Zhang2026-03-11🤖 cs.AI

LAYOUTDREAMER: Physics-guided Layout for Text-to-3D Compositional Scene Generation

Il paper introduce LayoutDreamer, un framework basato su 3D Gaussian Splatting che genera scene 3D composizionali di alta qualità e fisicamente plausibili partendo da prompt testuali, superando i limiti delle metodologie esistenti grazie a un grafico di scena diretto e a un'ottimizzazione adattiva del layout.

Yang Zhou, Zongjin He, Qixuan Li + 1 more2026-03-11🤖 cs.AI

Astromer 2

Questo articolo presenta Astromer 2, un modello fondazionale migliorato per l'analisi delle curve di luce che, grazie all'apprendimento auto-supervisionato su 1,5 milioni di dati e all'uso di embedding pesati, supera significativamente il suo predecessore Astromer 1 e i modelli precedenti, ottenendo un miglioramento del 15% nel punteggio F1 anche con dataset etichettati molto limitati.

Cristobal Donoso-Oliva, Ignacio Becker, Pavlos Protopapas + 3 more2026-03-11🔭 astro-ph

On the Impact of the Utility in Semivalue-based Data Valuation

Il paper introduce il concetto di "firma spaziale" per mappare i punti dati in uno spazio geometrico che semplifica l'analisi della robustezza delle valutazioni basate sui semivalori rispetto alle variazioni della funzione di utilità, proponendo una metrica pratica per quantificare tale stabilità.

Mélissa Tamine, Benjamin Heymann, Maxime Vono, Patrick Loiseau2026-03-11🤖 cs.AI

MKE-Coder: Multi-Axial Knowledge with Evidence Verification in ICD Coding for Chinese EMRs

Il paper presenta MKE-Coder, un nuovo framework che migliora la codifica automatica ICD nelle cartelle cliniche elettroniche cinesi integrando conoscenze multi-assiali con la verifica delle evidenze cliniche, superando le sfide linguistiche e strutturali specifiche di questo contesto.

Xinxin You, Xien Liu, Xue Yang, Ziyi Wang, Ji Wu2026-03-11🤖 cs.AI

LLM-Advisor: An LLM Benchmark for Cost-efficient Path Planning across Multiple Terrains

Il paper presenta LLM-Advisor, un framework basato su prompt che utilizza i grandi modelli linguistici come consulenti post-elaborazione per ottimizzare l'efficienza dei costi nella pianificazione di percorsi su terreni eterogenei, superando le limitazioni spaziali dei modelli attuali senza modificare i pianificatori sottostanti.

Ling Xiao, Toshihiko Yamasaki2026-03-11🤖 cs.AI

HyConEx: Hypernetwork classifier with counterfactual explanations for tabular data

Il paper introduce HyConEx, un classificatore basato su hypernetwork progettato per dati tabulari che combina previsioni accurate e spiegazioni locali sotto forma di esempi controfattuali in un'unica rete neurale.

Patryk Marszałek, Kamil Ksi\k{a}\.zek, Oleksii Furman, Ulvi Movsum-zada, Przemysław Spurek, Marek Smieja2026-03-11🤖 cs.AI

Logic Explanation of AI Classifiers by Categorical Explaining Functors

Il paper propone un approccio teoricamente fondato basato sulla teoria delle categorie, che introduce un "functore esplicativo" per garantire la coerenza logica e la fedeltà delle spiegazioni estratte dai modelli di intelligenza artificiale, superando i limiti delle attuali tecniche euristico-based.

Stefano Fioravanti, Francesco Giannini, Paolo Frazzetto + 2 more2026-03-11🤖 cs.AI

GateLens: A Reasoning-Enhanced LLM Agent for Automotive Software Release Analytics

Il paper introduce GateLens, un agente LLM che utilizza l'Algebra Relazionale come rappresentazione intermedia formale per garantire analisi rapide, trasparenti e affidabili di dati tabulari complessi nel settore automobilistico, superando i limiti dei sistemi basati su Chain-of-Thought e riducendo i tempi di analisi dell'80% senza necessità di esempi few-shot.

Arsham Gholamzadeh Khoee, Shuai Wang, Robert Feldt, Dhasarathy Parthasarathy, Yinan Yu2026-03-11🤖 cs.AI

A Consequentialist Critique of Binary Classification Evaluation: Theory, Practice, and Tools

Questo articolo propone una critica consequenzialista alle pratiche di valutazione della classificazione binaria, sostenendo l'adozione di regole di scoring adeguate come il punteggio Brier attraverso un nuovo framework decisionale e il pacchetto Python `briertools`, che colmano il divario tra teoria e pratica dominata da metriche a soglia fissa.

Gerardo Flores, Abigail Schiff, Alyssa H. Smith, Julia A Fukuyama, Ashia C. Wilson2026-03-11🤖 cs.AI

MCP Bridge: A Lightweight, LLM-Agnostic RESTful Proxy for Model Context Protocol Servers

Il documento presenta MCP Bridge, un proxy RESTful leggero e agnostico rispetto ai modelli LLM che abilita l'uso del Model Context Protocol su dispositivi con risorse limitate grazie a un modello di esecuzione sicuro, accompagnato da modelli Qwen ottimizzati che raggiungono prestazioni superiori rispetto a sistemi molto più grandi nel benchmark MCPToolBench++.

Arash Ahmadi, Sarah Sharif, Yaser M. Banad2026-03-11🤖 cs.AI

Stepwise Guided Policy Optimization: Coloring your Incorrect Reasoning in GRPO

Il paper introduce SGPO, un framework che risolve il limite di GRPO di non aggiornare la politica quando tutti i campioni di un gruppo sono errati, migliorando l'apprendimento per rinforzo nei modelli linguistici attraverso una diversificazione guidata da un modello giudice passo-passo che permette di apprendere anche dagli errori senza richiedere soluzioni corrette.

Peter Chen, Xiaopeng Li, Ziniu Li, Xi Chen, Tianyi Lin2026-03-11🤖 cs.AI

Let's Verify Math Questions Step by Step

Il paper presenta MathQ-Verify, una pipeline innovativa a cinque stadi che verifica rigorosamente la validità e la completezza delle domande matematiche per filtrare problemi mal posti, migliorando significativamente le prestazioni rispetto ai metodi di verifica diretti e facilitando la creazione di dataset matematici affidabili.

Chengyu Shen, Zhen Hao Wong, Runming He, Hao Liang, Meiyi Qiang, Zimo Meng, Zhengyang Zhao, Bohan Zeng, Zhengzhou Zhu, Bin Cui, Wentao Zhang2026-03-11🤖 cs.AI

UltraEdit: Training-, Subject-, and Memory-Free Lifelong Editing in Language Models

Il paper presenta UltraEdit, un metodo innovativo per l'editing continuo dei modelli linguistici che, eliminando la necessità di addestramento, soggetti specifici o memoria esterna, raggiunge velocità e efficienza superiori rispetto agli stati dell'arte, permettendo di eseguire fino a 2 milioni di modifiche su modelli da 7B con risorse hardware limitate.

Xiaojie Gu, Ziying Huang, Jia-Chen Gu, Kai Zhang2026-03-11🤖 cs.AI

SATURN: SAT-based Reinforcement Learning to Unleash LLMs Reasoning

Il paper presenta SATURN, un framework di apprendimento per rinforzo basato su problemi di soddisfacibilità booleana (SAT) che supera le limitazioni di scalabilità, verificabilità e controllo della difficoltà delle attività esistenti, permettendo di potenziare significativamente le capacità di ragionamento dei modelli linguistici su compiti matematici e di programmazione attraverso un curriculum learning progressivo.

Huanyu Liu, Ge Li, Jia Li, Hao Zhu, Kechi Zhang, Yihong Dong2026-03-11🤖 cs.AI

Daily-Omni: Towards Audio-Visual Reasoning with Temporal Alignment across Modalities

Il paper introduce Daily-Omni, un nuovo benchmark audio-visivo per valutare la capacità di ragionamento temporale sincrono tra modalità nei modelli linguistici multimodali, evidenziando attraverso una valutazione estensiva che la maggior parte dei modelli attuali fatica ancora a gestire efficacemente l'allineamento temporale cross-modale.

Ziwei Zhou, Rui Wang, Zuxuan Wu, Yu-Gang Jiang2026-03-11🤖 cs.AI

Embodied AI with Foundation Models for Mobile Service Robots: A Systematic Review

Questo articolo presenta la prima revisione sistematica sull'integrazione dei modelli fondazionali nell'intelligenza artificiale incarnata per i robot di servizio mobili, analizzando come tali tecnologie affrontino le sfide tecniche e abilitino applicazioni pratiche in ambiti domestici e sanitari, pur sollevando questioni etiche e prospettando direzioni future per un deployment sicuro e affidabile.

Matthew Lisondra, Beno Benhabib, Goldie Nejat2026-03-11💬 cs.CL

Rating Quality of Diverse Time Series Data by Meta-learning from LLM Judgment

Il paper propone TSRating, un framework unificato che sfrutta il giudizio dei modelli linguistici su larga scala (LLM) e l'apprendimento meta per valutare in modo efficiente e adattabile la qualità di serie temporali provenienti da domini diversi, superando i limiti delle metodologie esistenti.

Shunyu Wu, Dan Li, Wenjie Feng, Haozheng Ye, Jian Lou, See-Kiong Ng2026-03-11🤖 cs.AI

← Precedente Successivo →