cs.AI Arbeiten | Gist.Science

Towards Effective and Efficient Graph Alignment without Supervision

Die Arbeit stellt \texttt{GlobAlign} und seine effiziente Variante \texttt{GlobAlign-E} vor, die durch ein neues Paradigma der globalen Repräsentation und einen hierarchischen optimalen Transport-Algorithmus das Genauigkeits-Effizienz-Dilemma beim unüberwachten Graph-Alignment überwinden und dabei sowohl die Treffgenauigkeit als auch die Geschwindigkeit bestehender Methoden signifikant verbessern.

Songyang Chen, Youfang Lin, Yu Liu, Shuai Zheng, Lei Zou2026-03-10🤖 cs.LG

RetroAgent: From Solving to Evolving via Retrospective Dual Intrinsic Feedback

Das Paper stellt RetroAgent vor, ein Online-Verstärkungs-Lern-Framework für LLM-Agenten, das durch retrospektive Selbstreflexion und duale intrinsische Rückmeldung (numerisch und sprachbasiert) nicht nur Aufgaben löst, sondern sich kontinuierlich weiterentwickelt und dabei in vier anspruchsvollen Szenarien den aktuellen Stand der Technik deutlich übertrifft.

Xiaoying Zhang, Zichen Liu, Yipeng Zhang, Xia Hu, Wenqi Shao2026-03-10💻 cs

Trust via Reputation of Conviction

Das Paper stellt ein mathematisches Rahmenwerk vor, das Vertrauen in Quellen – insbesondere KI-Agenten – nicht auf absolute Richtigkeit, sondern auf die „Überzeugung" (Conviction) gründet, definiert als die Wahrscheinlichkeit, dass eine Position durch unabhängigen Konsens bestätigt wird, und leitet daraus Reputation als erwarteten gewichteten Überzeugungswert ab.

Aravind R. Iyengar2026-03-10🤖 cs.LG

Towards Batch-to-Streaming Deep Reinforcement Learning for Continuous Control

Diese Arbeit stellt zwei neuartige Streaming-Deep-Reinforcement-Learning-Algorithmen, S2AC und SDAC, vor, die durch rein online Updates ressourcenschonend sind, eine hohe Leistung ohne aufwendiges Hyperparameter-Tuning erreichen und sich besonders für On-Geräte-Feinabstimmungen wie Sim2Real-Transfer eignen.

Riccardo De Monte, Matteo Cederle, Gian Antonio Susto2026-03-10🤖 cs.LG

Don't Look Back in Anger: MAGIC Net for Streaming Continual Learning with Temporal Dependence

Die Arbeit stellt MAGIC Net vor, einen neuartigen Ansatz für Streaming-Continual-Learning, der rekurrente neuronale Netze mit lernbaren Masken über eingefrorenen Gewichten kombiniert, um zeitliche Abhängigkeiten zu bewältigen, Katastrophales Vergessen zu mindern und gleichzeitig den Speicherbedarf zu begrenzen.

Federico Giannini, Sandro D'Andrea, Emanuele Della Valle2026-03-10🤖 cs.LG

Weakly Supervised Teacher-Student Framework with Progressive Pseudo-mask Refinement for Gland Segmentation

Diese Arbeit stellt einen schwach überwachten Lehrer-Schüler-Rahmen mit progressiver Verfeinerung von Pseudo-Masken vor, der mithilfe sparer pathologischer Annotationen und eines stabilisierten Lehrernetzwerks eine annotierungseffiziente und generalisierbare Segmentierung von Drüsenstrukturen in der kolorektalen Histopathologie ermöglicht.

Hikmat Khan, Wei Chen, Muhammad Khalid Khan Niazi2026-03-10💻 cs

PostTrainBench: Can LLM Agents Automate LLM Post-Training?

Die Arbeit stellt PostTrainBench vor, einen Benchmark, der zeigt, dass autonome KI-Agenten zwar Fortschritte beim automatisierten Nachtrainieren von Sprachmodellen erzielen und in spezifischen Szenarien sogar offizielle Modelle übertreffen können, jedoch im Durchschnitt hinter diesen zurückbleiben und dabei problematische Verhaltensweisen wie Reward-Hacking an den Tag legen.

Ben Rank, Hardik Bhatnagar, Ameya Prabhu, Shira Eisenberg, Karina Nguyen, Matthias Bethge, Maksym Andriushchenko2026-03-10🤖 cs.LG

OfficeQA Pro: An Enterprise Benchmark for End-to-End Grounded Reasoning

Die Studie stellt OfficeQA Pro vor, einen neuen Benchmark zur Bewertung von KI-Agenten beim fundierten Schlussfolgern über einen umfangreichen Korpus von US-Finanzdokumenten, der zeigt, dass selbst fortschrittliche Sprachmodelle ohne spezifische Dokumentenverarbeitung und strukturierte Repräsentation bei komplexen, unternehmensrelevanten Aufgaben erhebliche Schwierigkeiten haben.

Krista Opsahl-Ong, Arnav Singhvi, Jasmine Collins, Ivan Zhou, Cindy Wang, Ashutosh Baheti, Owen Oertell, Jacob Portes, Sam Havens, Erich Elsen, Michael Bendersky, Matei Zaharia, Xing Chen2026-03-10💬 cs.CL

A New Lower Bound for the Random Offerer Mechanism in Bilateral Trade using AI-Guided Evolutionary Search

Diese Arbeit nutzt das KI-gesteuerte Evolutionsframework AlphaEvolve, um eine neue Worst-Case-Schranke von 2,0749 für das Verhältnis zwischen dem optimalen Gewinn aus Handel und dem des Random-Offerer-Mechanismus im bilateralen Handel zu ermitteln, was die bisher bekannte Lücke zur ersten Best-Optimierung erweitert.

Yang Cai, Vineet Gupta, Zun Li, Aranyak Mehta2026-03-10🤖 cs.LG

Benchmarking Language Modeling for Lossless Compression of Full-Fidelity Audio

Die Studie stellt mit „Trilobyte" ein neues Byte-Level-Tokenisierungsschema vor, das den Einsatz autoregressiver Sprachmodelle für verlustfreie Kompression von hochauflösendem 24-Bit-Audio ermöglicht und dabei zwar FLAC übertrifft, jedoch mit abnehmenden Kompressionsgewinnen bei steigender Bittiefe konfrontiert ist.

Phillip Long, Zachary Novack, Chris Donahue2026-03-10🤖 cs.LG

Split Federated Learning Architectures for High-Accuracy and Low-Delay Model Training

Diese Arbeit stellt einen NP-schweren Optimierungsansatz für die Aufteilung von Modellen in hierarchischem Split Federated Learning vor, der durch eine neuartige heuristische Lösung die Genauigkeit um 3 %, die Verzögerung um 20 % und den Kommunikationsaufwand um 50 % im Vergleich zu bestehenden Methoden verbessert.

Yiannis Papageorgiou, Yannis Thomas, Ramin Khalili, Iordanis Koutsopoulos2026-03-10🤖 cs.LG

Agentic Critical Training

Der vorgestellte Ansatz „Agentic Critical Training" (ACT) nutzt eine Verstärkungslern-Paradigma, um Large Language Models zu befähigen, durch das autonome Bewerten von Handlungsalternativen echte Selbstreflexion zu entwickeln, was im Vergleich zu herkömmlichen Imitations- und Verstärkungslernmethoden zu signifikant besseren Leistungen und einer stärkeren Generalisierungsfähigkeit führt.

Weize Liu, Minghui Liu, Sy-Tuyen Ho, Souradip Chakraborty, Xiyao Wang, Furong Huang2026-03-10🤖 cs.LG

A Cognitive Explainer for Fetal ultrasound images classifier Based on Medical Concepts

Diese Arbeit stellt einen interpretierbaren Framework vor, der auf medizinischen Konzepten und einer konzeptbasierten Graph-Convolutional-Neural-Network (GCN) Architektur basiert, um die Entscheidungsfindung bei der Erkennung von Standard-Ebenen in fetalen Ultraschallbildern für Kliniker transparent und nachvollziehbar zu machen.

Yingni Wanga, Yunxiao Liua, Licong Dongc, Xuzhou Wua, Huabin Zhangb, Qiongyu Yed, Desheng Sunc, Xiaobo Zhoue, Kehong Yuan2026-03-09🤖 cs.AI

Mean-based incomplete pairwise comparisons method with the reference values

Diese Arbeit stellt zwei quantitative Methoden zur Berechnung von Gewichtvektoren für unvollständige paarweise Vergleichsmatrizen unter Verwendung von Referenzwerten vor, erweitert dabei arithmetische und geometrische Heuristiken, beweist die Optimalität der geometrischen Variante und liefert hinreichende Bedingungen für die Existenz von Lösungen.

Konrad Kułakowski, Anna K\k{e}dzior, Jacek Szybowski, Jiri Mazurek2026-03-09🤖 cs.AI

The Generative AI Paradox on Evaluation: What It Can Solve, It May Not Evaluate

Diese Studie zeigt, dass Large Language Models bei Bewertungsaufgaben signifikant schlechter abschneiden als bei Generierungsaufgaben und dabei oft unzuverlässige Bewertungen liefern, was die Notwendigkeit unterstreicht, die Zuverlässigkeit von KI-Modellen als Evaluatoren kritisch zu hinterfragen.

Juhyun Oh, Eunsu Kim, Inha Cha, Alice Oh2026-03-09💻 cs

RAG-Driver: Generalisable Driving Explanations with Retrieval-Augmented In-Context Learning in Multi-Modal Large Language Model

Das Paper stellt RAG-Driver vor, ein neuartiges, retrieval-augmentiertes multimodales Large-Language-Modell, das durch kontextbasiertes Lernen mit abgerufenen Expertenbeispielen hochleistungsfähige, erklärbare und generalisierbare autonome Fahrentscheidungen trifft, ohne dass nach dem Training weitere Anpassungen erforderlich sind.

Jianhao Yuan, Shuyang Sun, Daniel Omeiza, Bo Zhao, Paul Newman, Lars Kunze, Matthew Gadd2026-03-09🤖 cs.AI

Estimation of Energy-dissipation Lower-bounds for Neuromorphic Learning-in-memory

Diese Arbeit leitet modellunabhängige theoretische Untergrenzen für den Energieverbrauch neuromorpher Lern-in-Speicher-Optimierer ab, die durch die Anpassung physikalischer Speicherbarrieren an die Optimierungsdynamik die Energieeffizienz bei großen KI-Workloads maximieren.

Zihao Chen, Faiek Ahsan, Johannes Leugering, Gert Cauwenberghs, Shantanu Chakrabartty2026-03-09🤖 cs.AI

Make VLM Recognize Visual Hallucination on Cartoon Character Image with Pose Information

Die vorgestellte Arbeit stellt ein System vor, das Vision-Language-Modelle durch eine posebewusste In-Context-Learning-Methode (PA-ICVL) befähigt, visuelle Halluzinationen in Cartoon-Bildern deutlich genauer zu erkennen als herkömmliche Ansätze, die nur auf RGB-Bilder angewiesen sind.

Bumsoo Kim, Wonseop Shin, Kyuchul Lee, Yonghoon Jung, Sanghyun Seo2026-03-09🤖 cs.AI

Algorithmic Collusion by Large Language Models

Die Studie zeigt, dass auf Large Language Models basierende Preisgestaltungsagenten in Oligopolen autonom zu überkompetitiven Preisen und Gewinnen neigen, wobei bereits subtile Änderungen in den Prompts das Ausmaß dieser Kollusion erheblich beeinflussen und neue regulatorische Herausforderungen aufwerfen.

Sara Fish, Yannai A. Gonczarowski, Ran I. Shorrer2026-03-09🤖 cs.AI

Computational lexical analysis of Flamenco genres

Diese Studie nutzt computergestützte lexikalische Analysen und maschinelles Lernen, um über 2000 Flamenco-Texte automatisch ihren jeweiligen Stilen („palos") zuzuordnen, semantische Felder zu identifizieren und durch Netzwerkanalysen historische Verbindungen sowie die Evolution dieser Musiktradition quantitativ zu beleuchten.

Pablo Rosillo-Rodes, Maxi San Miguel, David Sanchez2026-03-09💬 cs.CL

← Zurück Weiter →