Bei jeder Arbeit auf dieser Seite hat mindestens ein/e der ursprünglichen Autor*innen unsere verständliche Erklärung gesehen und begutachtet — entweder durch Bestätigung der Genauigkeit oder durch Korrekturwünsche, die wir anschließend umgesetzt haben. Eine Bestätigung bedeutet keine formelle Freigabe jedes Satzes, aber die Erklärung ist von den Menschen geprüft worden, die das Paper geschrieben haben.

1206 von Autoren geprüfte Arbeiten · 651–660 / 1206

🔭 astrophysics

Gaia FGK Benchmark Stars: Selecting Infrared Lines for Abundance Determination

Diese Studie etabliert einen homogenen, reproduzierbaren Satz robuster Absorptionslinien im Nahinfrarot-Bereich der Y-, J- und H-Bänder für Gaia-FGK-Benchmarksterne, indem sie CRIRES-Spektren quantitativ gegen Labordaten und synthetische Modelle evaluiert und letztlich zuverlässige Übergänge für Elemente wie Mg, Si, Ca, Fe und Sr identifiziert, um Infrarot-Abundanzbestimmungen zu verbessern.

Scarlet Elgueta, Paula Jofré, Claudia Aguilera-Gómez, Ditte Slumstrup, Álvaro Rojas-Arriagada, Ulrike Heiter, Laia Casam (…)2026-06-10✓ Author reviewed
💬 NLP

MIRAGE: A Polarity-Flipping Encoding Subspace in LLM Agents

Das Paper stellt MIRAGE vor, ein Echtzeit-Überwachungssystem, das die Datenexfiltration durch LLM-Agenten erkennt, indem es einen gemeinsamen, niedrigdimensionalen Kodierungs-Subraum im Residualstrom des Modells identifiziert und dabei eine signifikant höhere Erkennungsgenauigkeit als Methoden erreicht, die nur auf den Ausgaben basieren, da es die zugrunde liegende Berechnung statt der Oberflächenmerkmale ausliest.

Pratibha Revankar, Kargi Chauhan, Jihye Kim, Sadiba Nusrat Nur, Vincent Siu, Chenguang Wang2026-06-10✓ Author reviewed
💬 NLP

WebChallenger: A Reliable and Efficient Generalist Web Agent

WebChallenger ist ein Generalist-Webagenten-Framework, das durch die Einführung von PageMem und drei architektonischen Mechanismen, welche die menschlichen kognitiven Vorteile in selektiver Aufmerksamkeit, beständigem Gedächtnis und prozeduraler Flüssigkeit nachahmen, eine Spitzenleistung auf mehreren Benchmarks unter Verwendung kosteneffizienter Standardmodelle erzielt.

Jayoo Hwang, Xiaowen Zhang, Vedant Padwal2026-06-10✓ Author reviewed
🔬 physics

Systematic comparison of VMEC and HINT equilibrium calculations for finite-beta LHD plasmas

Diese Arbeit vergleicht systematisch VMEC- und HINT-Gleichgewichtsberechnungen für Plasmen der Large Helical Device, wobei sie aufzeigt, dass beide Codes bei niedrigem Beta übereinstimmen, sich jedoch bei höheren Beta-Werten unterscheiden, da HINT die Randstochastizität und das Aufbrechen der Flussflächen erfasst, welche die Annahme geschachtelter Flussflächen von VMEC nicht darstellen kann.

Albert Civit-Bertran, Yasuhiro Suzuki, Shimpei Futatani2026-06-10✓ Author reviewed
🔭 astrophysics

Learning the Universe with the 2nd Generation of CAMELS: Varying 35 parameters of the IllustrisTNG model in (50Mpc/h)^3 boxes

Dieses Paper präsentiert die zweite Generation des CAMELS-Projekts, welches 1.192 kosmologische Simulationen mit achtmal größeren Volumina als seinen Vorgänger umfasst, um einen 35-dimensionalen Parameterraum zu untersuchen, und zeigt auf, dass diese größeren Volumina zwar die auf neuronalen Netzen basierende Parameterinferenz verbessern, die Gewinne jedoch aufgrund von Modenkopplung und Parameterentartungen sublinear ausfallen.

Shy Genel, Yongseok Jo, Boon Kiat Oh, Megan Taylor Tillman, Max E. Lee, Jun-Young Lee, Elena Hernández-Martínez, Christo (…)2026-06-10✓ Author reviewed
🤖 AI

An LLM-Native Psychometric Instrument Does Not Predict LLM Behavior: Evidence Across 25 Models

Obwohl es eine hohe interne Reliabilität aufweist, scheitert ein neuartiges psychometrisches Instrumentarium, das aus den Verhaltensaffordanzen von LLMs abgeleitet wurde, daran, tatsächliches LLM-Verhalten vorherzusagen, was eine kritische Diskrepanz zwischen Selbstberichten der Modelle und beobachteten Handlungen offenbart, die ein erhebliches Risiko für LLM-as-Judge-Evaluations-Pipelines darstellt.

Juan Manuel Contreras2026-06-10✓ Author reviewed
⚛️ quantum physics

Most incompatible measurements and sum-of-squares optimisation

Diese Arbeit schreitet die Quantifizierung der Messinkompatibilität in endlichdimensionalen Quantensystemen voran, indem sie durch neuartige Eltern-Messungen analytische universelle Schranken herleitet, deren Konstruktion mittels Summe-der-Quadrate-Optimierung formalisiert und deren Anwendung bei der Zertifizierung von hochdimensionalem Quanten-Steering demonstriert.

Sébastien Designolle2026-06-10✓ Author reviewed
💬 NLP

τ\tau-Rec: A Verifiable Benchmark for Agentic Recommender Systems

Das Papier stellt τ\tau-Rec vor, einen verifizierbaren Benchmark für agentische Empfehlungssysteme, der subjektive LLM-basierte Evaluierungen durch strukturierte Belohnungen und einen mit Reveal-Tags versehenen Elicitationsmechanismus ersetzt und eine signifikante Zuverlässigkeitslücke bei aktuellen konversationellen Agenten aufzeigt, bei der selbst die besten Modelle Schwierigkeiten haben, Aufgabenbeschränkungen konsistent einzuhalten.

Bharath Sivaram Narasimhan, Karthik R Narasimhan2026-06-10✓ Author reviewed
🔬 condensed matter

Dissipative response of driven bead-spring-dashpot chains

Diese Arbeit zeigt numerisch auf, dass während die dissipierte Arbeit beim Ziehen einer Polymerkette ohne interne Reibung konsistent mit der Kettenlänge ansteigt, das Vorhandensein interner Reibung eine steifigkeitsabhängige Beziehung einführt, bei der die Dissipation je nach Steifigkeit der Zugfalle mit der Kettenlänge entweder zu- oder abnimmt, wodurch die in Einmoden-Systemen beobachtete einfache Dämpfungs-Dissipations-Korrelation ungültig wird.

R. Kailasham2026-06-10✓ Author reviewed