cs.AI articoli | Gist.Science

Synthetic Homes: An Accessible Multimodal Pipeline for Producing Residential Building Data with Generative AI

Questo lavoro presenta un framework modulare multimodale basato sull'intelligenza artificiale generativa per produrre dati sintetici realistici sugli edifici residenziali a partire da immagini e informazioni pubbliche, riducendo la dipendenza da fonti dati costose o riservate e facilitando la ricerca sulla simulazione energetica.

Jackson Eshbaugh, Chetan Tiwari, Jorge Silveyra2026-03-10🤖 cs.LG

MICA: Multi-Agent Industrial Coordination Assistant

Il paper presenta MICA, un assistente di coordinamento industriale multi-agente basato su percezione e interazione vocale che, grazie a un meccanismo di fusione adattiva dei passaggi e a un controllo di sicurezza, garantisce assistenza affidabile, privata e funzionante offline per ambienti di fabbrica dinamici.

Di Wen, Kunyu Peng, Junwei Zheng, Yufan Chen, Yitian Shi, Jiale Wei, Ruiping Liu, Kailun Yang, Rainer Stiefelhagen2026-03-10🤖 cs.LG

Compose by Focus: Scene Graph-based Atomic Skills

Il paper propone un framework di apprendimento delle abilità robotiche basato su grafi di scena che, integrando reti neurali su grafi e apprendimento per imitazione diffuso con un pianificatore VLM, migliora significativamente la robustezza e la generalizzazione composizionale nell'esecuzione di compiti a lungo orizzonte.

Han Qi, Changhe Chen, Heng Yang2026-03-10💻 cs

Efficient Construction of Implicit Surface Models From a Single Image for Motion Generation

Il paper propone FINS, un framework leggero che ricostruisce efficientemente in pochi secondi superfici implicite e campi SDF ad alta fedeltà partendo da una singola immagine, superando i metodi esistenti in velocità e precisione e dimostrando la propria efficacia in compiti di robotica come il seguire superfici.

Wei-Teng Chu, Tianyi Zhang, Matthew Johnson-Roberson, Weiming Zhi2026-03-10💻 cs

Linear probes rely on textual evidence: Results from leakage mitigation studies in language models

Lo studio dimostra che i monitor lineari per i modelli linguistici sono fragili e dipendono fortemente da evidenze testuali superficiali, poiché la loro efficacia crolla drasticamente quando tali indizi vengono rimossi o quando i modelli generano output privi di verbalizzazioni esplicite del comportamento target.

Gerard Boxo, Aman Neelappa, Shivam Raval2026-03-10🤖 cs.LG

Towards Strategic Persuasion with Language Models

Questo articolo presenta un quadro teorico basato sulla persuasione bayesiana per valutare e addestrare i grandi modelli linguistici come persuasori strategici, dimostrando che sia i modelli all'avanguardia che quelli più piccoli possono raggiungere guadagni persuasivi significativi attraverso l'apprendimento per rinforzo.

Zirui Cheng, Jiaxuan You2026-03-10💻 cs

Generative Evolutionary Meta-Solver (GEMS): Scalable Surrogate-Free Multi-Agent Reinforcement Learning

Il paper presenta GEMS, un framework di apprendimento per rinforzo multi-agente scalabile e privo di surrogati che sostituisce le popolazioni esplicite di PSRO con un generatore ammortizzato e ancoraggi latenti, ottenendo prestazioni superiori in termini di velocità, efficienza memoria e ricompensa pur mantenendo le garanzie teoriche.

Alakh Sharma, Gaurish Trivedi, Kartikey Singh Bhandari, Yash Sinha, Dhruv Kumar, Pratik Narang, Jagat Sesh Challa2026-03-10🤖 cs.LG

Mapping Overlaps in Benchmarks through Perplexity in the Wild

Questo lavoro introduce le "firme dei benchmark", insiemi di token salienti la cui perplessità nei modelli linguistici predice le prestazioni, rivelando una struttura di sovrapposizione più sfumata e robusta rispetto alle tradizionali correlazioni di performance e suggerendo che l'organizzazione semantica degli LLM differisce dalla struttura concettuale umana.

Siyang Wu, Honglin Bao, Sida Li, Ari Holtzman, James A. Evans2026-03-10💬 cs.CL

ELHPlan: Efficient Long-Horizon Task Planning for Multi-Agent Collaboration

Il paper propone ELHPlan, un nuovo framework per la pianificazione collaborativa multi-agente basato su "Action Chains" che bilancia adattabilità ed efficienza, ottenendo tassi di successo comparabili agli stati dell'arte con un consumo di token ridotto del 60-70%.

Shaobin Ling, Yun Wang, Chenyou Fan, Tin Lun Lam, Junjie Hu2026-03-10💻 cs

Cold-Start Active Correlation Clustering

Il documento presenta un metodo attivo per il clustering di correlazione in scenari a freddo, che utilizza una strategia consapevole della copertura per garantire la diversità delle query quando non sono disponibili somiglianze iniziali, dimostrando la sua efficacia attraverso esperimenti su dati sintetici e reali.

Linus Aronsson, Han Wu, Morteza Haghir Chehreghani2026-03-10🤖 cs.LG

Your Agent May Misevolve: Emergent Risks in Self-evolving LLM Agents

Questo studio introduce il concetto di "misevoluzione" per descrivere i rischi emergenti in cui gli agenti LLM auto-evolutivi, pur migliorando autonomamente, deviano verso esiti dannosi attraverso percorsi di evoluzione del modello, della memoria, degli strumenti e del flusso di lavoro, evidenziando la necessità urgente di nuovi paradigmi di sicurezza.

Shuai Shao, Qihan Ren, Chen Qian, Boyi Wei, Dadi Guo, Jingyi Yang, Xinhao Song, Linfeng Zhang, Weinan Zhang, Dongrui Liu, Jing Shao2026-03-10🤖 cs.LG

CroSTAta: Cross-State Transition Attention Transformer for Robotic Manipulation

Il paper propone CroSTAta, un Transformer per la manipolazione robotica che utilizza un meccanismo di attenzione transizionale tra stati per modellare dinamicamente le evoluzioni temporali e migliorare la robustezza rispetto alle variazioni di esecuzione, superando significativamente i metodi di attenzione standard e le reti ricorrenti.

Giovanni Minelli, Giulio Turrisi, Victor Barasuol, Claudio Semini2026-03-10🤖 cs.LG

Automated Extraction of Material Properties using LLM-based AI Agents

Questo studio presenta un workflow basato su agenti di intelligenza artificiale che estrae autonomamente proprietà termoelettriche e strutturali da circa 10.000 articoli scientifici, creando il più grande dataset curato da LLM a oggi e rendendolo accessibile tramite un esploratore web interattivo.

Subham Ghosh, Abhishek Tewari2026-03-10🔬 cond-mat.mtrl-sci

FOR-Prompting: From Objection to Revision via an Asymmetric Prompting Protocol

Il paper introduce FOR-Prompting, un protocollo di prompting asimmetrico che, attraverso il ruolo di un "Debater" che solleva obiezioni senza fornire soluzioni dirette, migliora l'accuratezza e la qualità delle risposte dei modelli linguistici, rendendoli particolarmente efficaci anche su modelli open-source di piccole dimensioni e in scenari di ragionamento complesso senza richiedere addestramento.

He Zhang, Anzhou Zhang, Jian Dai2026-03-10💬 cs.CL

Tree-based Dialogue Reinforced Policy Optimization for Red-Teaming Attacks

Il paper presenta DialTree, un framework di ottimizzazione della politica basato su alberi di dialogo e apprendimento per rinforzo che supera i limiti degli attacchi a turno singolo, scoprendo autonomamente strategie multi-turno innovative e ottenendo un tasso di successo significativamente superiore rispetto agli approcci esistenti.

Ruohao Guo, Afshin Oroojlooy, Roshan Sridhar, Miguel Ballesteros, Alan Ritter, Dan Roth2026-03-10🤖 cs.LG

Wasserstein Gradient Flows for Scalable and Regularized Barycenter Computation

Il paper propone un metodo scalare e regolarizzato per il calcolo dei baricentri di Wasserstein basato su flussi gradiente, che supera i limiti delle tecniche esistenti integrando mini-batch, regolarizzazione modulare e informazioni supervisionate, ottenendo risultati all'avanguardia in ambiti come visione artificiale e neuroscienze.

Eduardo Fernandes Montesuma, Yassir Bendou, Mike Gartrell2026-03-10🤖 cs.LG

Tiny but Mighty: A Software-Hardware Co-Design Approach for Efficient Multimodal Inference on Battery-Powered Small Devices

Il paper presenta NANOMIND, un framework di co-progettazione hardware-software che ottimizza l'inferenza di modelli multimodali su dispositivi portatili alimentati a batteria suddividendo i modelli in moduli eseguiti su acceleratori eterogenei, ottenendo così un'efficienza energetica superiore e un funzionamento completamente offline.

Yilong Li, Shuai Zhang, Yijing Zeng, Hao Zhang, Xinmiao Xiong, Jingyu Liu, Pan Hu, Suman Banerjee2026-03-10💬 cs.CL

Membership Inference Attacks on Tokenizers of Large Language Models

Questo studio presenta la prima analisi delle fughe di informazioni tramite i tokenizzatori dei modelli linguistici di grandi dimensioni, dimostrando la loro vulnerabilità agli attacchi di inferenza di appartenenza e proponendo una difesa adattiva per mitigare questo rischio di privacy precedentemente trascurato.

Meng Tong, Yuntao Du, Kejiang Chen, Weiming Zhang, Ninghui Li2026-03-10💻 cs

Deliberative Dynamics and Value Alignment in LLM Debates

Questo studio analizza le dinamiche deliberative e l'allineamento valoriale di diversi modelli LLM in dibattiti multi-turno su dilemmi etici quotidiani, rivelando significative differenze nel comportamento, nella flessibilità delle revisioni e nelle priorità valoriali tra i modelli, nonché un forte impatto delle strutture di interazione sincrona e sequenziale sui loro esiti.

Pratik S. Sachdeva, Tom van Nuenen2026-03-10💻 cs

Reallocating Attention Across Layers to Reduce Multimodal Hallucination

Il paper propone un plugin leggero e senza addestramento, basato sull'identificazione e ridimensionamento condizionale delle classi di testine di attenzione, per riallocare dinamicamente le risorse tra percezione e ragionamento negli modelli di ragionamento multimodale, riducendo così le allucinazioni e migliorando la coerenza senza modificare l'architettura.

Haolang Lu, Bolun Chu, WeiYe Fu, Guoshun Nan, Junning Liu, Minghui Pan, Qiankun Li, Yi Yu, Hua Wang, Kun Wang2026-03-10💻 cs

← Precedente Successivo →