💻 computer science

Evolving Background Activities for Event-Triggered Thinking in Lifelong Autonomous Robots

Questo articolo propone un framework di attività di background evolutivo per robot autonomi lifelong che consolida dinamicamente il ragionamento ripetitivo in processi di background leggeri innescati da specifiche condizioni, riducendo così significativamente i costi computazionali pur mantenendo il richiamo di eventi critici e migliorando il successo in compiti a lungo termine.

Su Hong2026-08-31
💻 computer science

Unsupervised Satellite Image Change Detection Using Quantum-Inspired Mapping and Weighted Hybrid Neighborhood MRFs

Questo articolo propone un framework di rilevamento dei cambiamenti in immagini satellitari non supervisionato che riformula un Campo Casuale di Markov consapevole del contesto con vicinanze pesate a 8 connessioni come un problema QUBO, ottenendo prestazioni competitive sul benchmark OSCD pur mantenendo la compatibilità con le future architetture di quantum annealing.

Saman Ghafari¹, Shaho Piroti, Parviz Zeaieanfirouzabadi2026-08-31
💻 computer science

Memory or Generalization? Temporal Probing of Data Contamination in Bengali LLM Benchmarks

Questo articolo introduce il "temporal probing", un test di validità diretta che utilizza item di pari difficoltà, ma successivi al periodo di cutoff, per misurare la contaminazione dei dati nei benchmark per LLM in bengalese, riscontrando che gli attuali modelli sul dataset BoolQ-bn non mostrano alcuna inflazione significativa dovuta alla memorizzazione, nonostante la prevalenza di set di test statici e tradotti.

Md Fahim Faisal Tanha2026-08-31
💻 computer science

A Governed Shared-Kernel Architecture for Persistent, Auditable Multi-Agent Societies Beyond the LLM Session

Questo articolo valuta "World 8", un'architettura sperimentale a kernel condiviso che disaccoppia l'identità logica dell'attore dalle sessioni transitorie per imporre una governance multi-agente persistente, verificabile e recuperabile, dimostrando attraverso estesi test che, sebbene l'indurimento generico affronti i guasti comuni, il wrapper di governance specifico è unicamente richiesto per prevenire vulnerabilità complesse di autorizzazione e manomissione.

Saeed Farokhi2026-08-31
💻 computer science

WVAB: A Low-Latency Wireless Assistive Vision Framework for Risk-Aware Navigation and Multilingual Audio Guidance

Questo articolo presenta WVAB, un framework di visione assistiva wireless assistito dall'host che integra il rilevamento ESP32-CAM, il trasporto UDP e l'inferenza YOLOv8n per ottenere una navigazione a bassa latenza e consapevole del rischio con guida audio multilingue, dimostrando una latenza di elaborazione GPU di 78,6 ms e un accordo del pianificatore del 91,5% nei test del prototipo, pur riconoscendo i limiti nella validazione clinica.

Md Shahanur Islam Shagor2026-08-31
💻 computer science

Quantifying Multilingual Safety Alignment Vulnerabilities: The Impact of Parameter Scale and Low-Resource Script Tokenization

Questo articolo dimostra empiricamente che, sebbene l'aumento della scala dei parametri migliori l'allineamento della sicurezza in inglese, i modelli a pesi aperti rimangono significativamente più vulnerabili ai jailbreak quando elaborano lingue a basse risorse come l'urdu e il punjabi a causa della frammentazione della tokenizzazione degli script, rivelando critici punti ciechi di valutazione negli attuali benchmark di sicurezza.

Faizan e Bahoo Chaudhry2026-08-31
💻 computer science

Are Feature Selection and Feature Attribution the Same? A Comparative Survey -- Extended Version

Questo articolo investiga la relazione tra i metodi di selezione delle caratteristiche e quelli di attribuzione delle caratteristiche attraverso un sondaggio completo e un quadro di valutazione unificato, con l'obiettivo di chiarire le loro somiglianze, differenze e i rispettivi punti di forza unici per colmare il divario tra questi due campi di ricerca.

Muhammad Rajabinasab, Arthur Zimek2026-08-31
💻 computer science

Development and Validation of a Localized Large Language Model for Preoperative Anesthesia Planning: Protocol for a Retrospective Observational Study and Clinical Turing Test

Questo articolo delinea un protocollo per lo sviluppo e la validazione di un modello linguistico di grandi dimensioni localizzato, perfezionato su 3.000 cartelle storiche di anestesia dell'Ospedale Istishari, per generare piani anestesiologici preoperatori che siano valutati rispetto agli standard degli esperti umani per sicurezza e accuratezza in un "Clinical Turing Test" retrospettivo.

Mohammad Abu-Jeyyab2026-08-31