Per ogni articolo in questa pagina, almeno uno degli autori originali ha visto la nostra spiegazione divulgativa e se ne è occupato — confermandone l'accuratezza o richiedendo correzioni che abbiamo poi applicato. Una conferma non significa che gli autori approvino formalmente ogni frase, ma che la spiegazione è passata sotto gli occhi di chi ha scritto l'articolo.

1014 articoli verificati dagli autori · 461–470 / 1014

💬 NLP

MIRAGE: A Polarity-Flipping Encoding Subspace in LLM Agents

Il documento introduce MIRAGE, un sistema di monitoraggio in tempo reale che rileva l'esfiltrazione di dati da parte di agenti LLM identificando un sottospazio di codifica a bassa dimensionalità condiviso nel residual stream del modello, raggiungendo un'accuratezza di rilevamento significativamente superiore rispetto ai metodi basati solo sull'output leggendo il calcolo sottostante anziché le caratteristiche superficiali.

Pratibha Revankar, Kargi Chauhan, Jihye Kim, Sadiba Nusrat Nur, Vincent Siu, Chenguang Wang2026-06-10✓ Author reviewed
💬 NLP

WebChallenger: A Reliable and Efficient Generalist Web Agent

WebChallenger è un framework di agenti web generalista che raggiunge prestazioni allo stato dell'arte su molteplici benchmark utilizzando modelli standard ed economici attraverso l'introduzione di PageMem e di tre meccanismi architettonici che replicano i vantaggi cognitivi umani nell'attenzione selettiva, nella memoria persistente e nella fluidità procedurale.

Jayoo Hwang, Xiaowen Zhang, Vedant Padwal2026-06-10✓ Author reviewed
🔬 physics

Systematic comparison of VMEC and HINT equilibrium calculations for finite-beta LHD plasmas

Questo articolo confronta sistematicamente i calcoli di equilibrio VMEC e HINT per i plasmi del Large Helical Device, rivelando che, sebbene entrambi i codici concordino a bassi valori di beta, essi divergono a valori di beta più elevati poiché HINT cattura la stocasticità del bordo e la rottura delle superfici di flusso che l'assunzione di superficie di flusso annidata di VMEC non può rappresentare.

Albert Civit-Bertran, Yasuhiro Suzuki, Shimpei Futatani2026-06-10✓ Author reviewed
🔭 astrophysics

Learning the Universe with the 2nd Generation of CAMELS: Varying 35 parameters of the IllustrisTNG model in (50Mpc/h)^3 boxes

Questo articolo presenta la seconda generazione del progetto CAMELS, caratterizzata da 1.192 simulazioni cosmologiche con volumi otto volte più grandi rispetto al suo predecessore per esplorare uno spazio di 35 parametri, dimostrando che, sebbene questi volumi più grandi migliorino l'inferenza dei parametri basata su reti neurali, i guadagni sono sublineari a causa dell'accoppiamento dei modi e delle degenerazioni dei parametri.

Shy Genel, Yongseok Jo, Boon Kiat Oh, Megan Taylor Tillman, Max E. Lee, Jun-Young Lee, Elena Hernández-Martínez, Christo (…)2026-06-10✓ Author reviewed
🤖 AI

An LLM-Native Psychometric Instrument Does Not Predict LLM Behavior: Evidence Across 25 Models

Nonostante la dimostrazione di un'elevata affidabilità interna, un nuovo strumento psicometrico derivato dalle affordance comportamentali degli LLM non riesce a predire il comportamento effettivo degli LLM, rivelando un distacco critico tra le auto-valutazioni dei modelli e le azioni osservate che pone un rischio significativo per le pipeline di valutazione LLM-as-judge.

Juan Manuel Contreras2026-06-10✓ Author reviewed
⚛️ quantum physics

Most incompatible measurements and sum-of-squares optimisation

Questo articolo fa progredire la quantificazione dell'incompatibilità di misura nei sistemi quantistici a dimensione finita derivando limiti universali analitici attraverso nuove misure genitrici, formalizzando la loro costruzione tramite l'ottimizzazione somma-di-quadrati e dimostrando la loro applicazione nella certificazione dello steering quantistico ad alta dimensionalità.

Sébastien Designolle2026-06-10✓ Author reviewed
💬 NLP

τ\tau-Rec: A Verifiable Benchmark for Agentic Recommender Systems

Il documento introduce τ\tau-Rec, un benchmark verificabile per sistemi di raccomandazione agentici che sostituisce le valutazioni soggettive basate su LLM con ricompense strutturate e un meccanismo di elicitazione con tag di rivelazione, rivelando un significativo divario di affidabilità negli attuali agenti conversazionali dove anche i modelli migliori faticano a soddisfare costantemente i vincoli del compito.

Bharath Sivaram Narasimhan, Karthik R Narasimhan2026-06-10✓ Author reviewed
🔬 condensed matter

Dissipative response of driven bead-spring-dashpot chains

Questo articolo dimostra numericamente che, mentre il lavoro dissipato nel tirare una catena polimerica in assenza di attrito interno aumenta costantemente con la lunghezza della catena, la presenza di attrito interno introduce una relazione dipendente dalla rigidezza in cui la dissipazione aumenta o diminuisce con la lunghezza della catena a seconda della rigidezza della trappola di trazione, invalidando così la semplice correlazione smorzamento-dissipazione osservata nei sistemi a singolo modo.

R. Kailasham2026-06-10✓ Author reviewed