cs.AI papers | Gist.Science

Offline Dynamic Inventory and Pricing Strategy: Addressing Censored and Dependent Demand

Dit paper introduceert twee nieuwe datagedreven algoritmen die offline versterkte leer- en overlevingsanalyse technieken combineren om optimale prijs- en voorraadbeheerstrategieën te leren in een omgeving met gecensureerde en afhankelijke vraag, waarbij de uitdagingen van ontbrekende winstinformatie en het verlies van de Markov-eigenschap worden overwonnen door het probleem te benaderen als een hoog-ordelijk Markov-beslissingsproces.

Korel Gundem, Zhengling Qi2026-03-12📊 stat

Scalable Multi-Task Learning through Spiking Neural Networks with Adaptive Task-Switching Policy for Intelligent Autonomous Agents

Dit paper introduceert SwitchMT, een nieuwe methode die adaptief taakwisselbeleid en diepe spiking Q-netwerken combineert om schaalbaar en energiezuinig meertaakleren voor autonome agenten mogelijk te maken zonder taakinterferentie of toegenomen netwerkcomplexiteit.

Rachmad Vidya Wicaksana Putra, Avaneesh Devkota, Muhammad Shafique2026-03-12🤖 cs.AI

Large Language Model Psychometrics: A Systematic Review of Evaluation, Validation, and Enhancement

Dit overzichtspaper introduceert het interdisciplinaire veld van LLM-psychometrie, waarin psychometrische principes worden toegepast om grote taalmodellen te evalueren, valideren en verbeteren met het oog op mensgerichte AI.

Haoran Ye, Jing Jin, Yuhang Xie, Xin Zhang, Guojie Song2026-03-12💬 cs.CL

REI-Bench: Can Embodied Agents Understand Vague Human Instructions in Task Planning?

Dit paper introduceert REI-Bench, het eerste benchmark voor robottaakplanning dat systematisch de negatieve impact van vage referentiële uitdrukkingen in menselijke instructies analyseert en een effectieve oplossing biedt via taakgerichte contextcognitie om robots toegankelijker te maken voor niet-experts zoals ouderen en kinderen.

Chenxi Jiang, Chuhao Zhou, Jianfei Yang2026-03-12💬 cs.CL

Training with Pseudo-Code for Instruction Following

Dit paper introduceert een trainingsmethode waarbij LLM's worden gefinetuned met instructies die zijn aangevuld met pseudo-code, wat leidt tot aanzienlijke verbeteringen in het volgen van instructies en redeneertaken zonder de prestaties op andere gebieden te schaden.

Prince Kumar, Rudra Murthy, Riyaz Bhat, Danish Contractor2026-03-12💬 cs.CL

LLLMs: A Data-Driven Survey of Evolving Research on Limitations of Large Language Models

Deze data-gedreven survey analyseert de groeiende onderzoeksstroom naar beperkingen van grote taalmodellen (LLLMs) tussen 2022 en 2025, waarbij redeneren als meest bestudeerd thema naar voren komt en een significant verschuiving in onderzoekstrends tussen ACL en arXiv wordt vastgesteld.

Aida Kostikova, Zhipin Wang, Deidamea Bajri, Ole Pütz, Benjamin Paaßen, Steffen Eger2026-03-12💬 cs.CL

Consistency-based Abductive Reasoning over Perceptual Errors of Multiple Pre-trained Models in Novel Environments

Dit artikel introduceert een consistentie-gebaseerde abductieve redeneerframework dat testtijd-logische regels en meerdere pre-getrainde modellen combineert om prestatieverlies door distributieverschuivingen in nieuwe omgevingen effectief te mitigeren en zo zowel de precisie als het recall significant te verbeteren.

Mario Leiva, Noel Ngu, Joshua Shay Kricheli, Aditya Taparia, Ransalu Senanayake, Paulo Shakarian, Nathaniel Bastian, John Corcoran, Gerardo Simari2026-03-12🤖 cs.AI

Comparative Analysis of Modern Machine Learning Models for Retail Sales Forecasting

Deze studie concludeert dat voor de verkoopvoorspelling in de detailhandel, ondanks de complexiteit van de data, geavanceerde deep learning-modellen onderpresteren ten opzichte van geoptimaliseerde boomgebaseerde ensemble-methoden zoals XGBoost, wat aantoont dat de afstemming op de probleemkarakteristiek belangrijker is dan architecturale complexiteit.

Luka Hobor, Mario Brcic, Lidija Polutnik, Ante Kapetanovic2026-03-12🤖 cs.LG

Self-Improving Loops for Visual Robotic Planning

Dit paper introduceert SILVR, een methode waarbij een video-model voor robotplanning zichzelf iteratief verbetert via zelfverzamelde trajecten, waardoor robuuste prestaties worden bereikt op nieuwe taken zonder menselijke beloningsfuncties of expertdemonstraties.

Calvin Luo, Zilai Zeng, Mingxi Jia, Yilun Du, Chen Sun2026-03-12🤖 cs.AI

Learning What Reinforcement Learning Can't: Interleaved Online Fine-Tuning for Hardest Questions

Dit paper introduceert ReLIFT, een nieuwe trainingsmethode die reinforcement learning en online fine-tuning afwisselt om de beperkingen van RL te overwinnen en modellen effectief nieuwe kennis en redeneervermogens voor de moeilijkste vragen aan te leren.

Lu Ma, Hao Liang, Meiyi Qiang, Lexiang Tang, Xiaochen Ma, Zhen Hao Wong, Junbo Niu, Chengyu Shen, Runming He, Yanhao Li, Bin Cui, Wentao Zhang2026-03-12🤖 cs.AI

Differential Privacy in Machine Learning: A Survey from Symbolic AI to LLMs

Dit survey biedt een uitgebreid overzicht van differentiele privacy in machine learning, waarbij het de evolutie van de theorie, de integratie in modellen en de praktische evaluatie bespreekt om veilige en verantwoorde AI-systemen te bevorderen.

Francisco Aguilera-Martínez, Fernando Berzal2026-03-12🤖 cs.AI

Locality-aware Parallel Decoding for Efficient Autoregressive Image Generation

Dit paper introduceert Locality-aware Parallel Decoding (LPD), een methode die autoregressieve beeldgeneratie aanzienlijk versnelt door een flexibele parallelle architectuur en een lokale generatievolgorde te combineren, waardoor het aantal stappen drastisch wordt verminderd zonder in te leveren op de kwaliteit.

Zhuoyang Zhang, Luke J. Huang, Chengyue Wu, Shang Yang, Kelly Peng, Yao Lu, Song Han2026-03-12🤖 cs.AI

Technological folie à deux: Feedback Loops Between AI Chatbots and Mental Illness

Dit artikel waarschuwt dat de interactie tussen kwetsbare gebruikers met mentale gezondheidsproblemen en AI-chatbots, versterkt door cognitieve vooroordelen en het meegaande gedrag van de bots, kan leiden tot geloofsontstabilisatie en afhankelijkheid, wat urgente gecoördineerde actie vereist op het gebied van klinische praktijk, AI-ontwikkeling en regelgeving.

Sebastian Dohnány, Zeb Kurth-Nelson, Eleanor Spens, Lennart Luettgau, Alastair Reid, Iason Gabriel, Christopher Summerfield, Murray Shanahan, Matthew M Nour2026-03-12🧬 q-bio

What Makes Code Generation Ethically Sourced?

Dit artikel introduceert het concept van ethisch gegenereerde code (ES-CodeGen), ontwikkelt een taxonomie met elf dimensies op basis van een literatuuroverzicht en een enquête onder 32 professionals, en benadrukt de noodzaak om sociale aspecten en codekwaliteit te integreren in de volledige levenscyclus van codegeneratiemodellen.

Zhuolin Xu, Chenglin Li, Qiushi Li, Shin Hwei Tan2026-03-12🤖 cs.AI

IntrinsicWeather: Controllable Weather Editing in Intrinsic Space

IntrinsicWeather is een diffusion-gebaseerd framework dat bewerkbare weersimulatie mogelijk maakt door een inverse en een forward renderer te combineren in de intrinsieke ruimte, wat leidt tot superieure controle en robuustheid voor toepassingen zoals autonoom rijden.

Yixin Zhu, Zuo-Liang Zhu, Jian Yang + 3 more2026-03-12🤖 cs.AI

Shadow in the Cache: Unveiling and Mitigating Privacy Risks of KV-cache in LLM Inference

Dit paper introduceert drie nieuwe aanvallen die gevoelige invoer van grote taalmodellen via de KV-cache kunnen reconstrueren en stelt KV-Cloak voor, een lichtgewicht verdedigingsmechanisme dat deze privacyrisico's effectief neutraliseert zonder de prestaties of nauwkeurigheid van het model te beïnvloeden.

Zhifan Luo, Shuo Shao, Su Zhang, Lijing Zhou, Yuke Hu, Chenxu Zhao, Zhihao Liu, Zhan Qin2026-03-12💬 cs.CL

The Yokai Learning Environment: Tracking Beliefs Over Space and Time

Dit paper introduceert het Yokai Learning Environment (YLE), een uitdagende nieuwe benchmark voor zero-shot coördinatie die de beperkingen van de bestaande Hanabi-benchmark blootlegt door te vereisen dat agenten geloofsoverdracht, ambiguïteit en spelbeëindiging beheren, waardoor wordt aangetoond dat huidige toonaangevende methoden in YLE falen terwijl ze in Hanabi uitstekend presteren.

Constantin Ruhdorfer, Matteo Bortoletto, Johannes Forkel, Jakob Foerster, Andreas Bulling2026-03-12🤖 cs.AI

From Next Token Prediction to (STRIPS) World Models

Dit onderzoek toont aan dat zowel gespecialiseerde symbolische modellen als standaard transformatoren met stick-breaking-attention effectief STRIPS-wereldmodellen kunnen leren uit actietraces om planning over onbekende toestanden en doelen mogelijk te maken, waarbij de standaardtransformatoren echter beter generaliseren en makkelijker te optimaliseren zijn.

Carlos Núñez-Molina, Vicenç Gómez, Hector Geffner2026-03-12🤖 cs.AI

Global Minimizers of Sigmoid Contrastive Loss

Dit artikel biedt een theoretische verklaring voor de voordelen van het synchroniseren van trainbare inverse temperatuur en bias onder de sigmoid-verliesfunctie, zoals gebruikt in SigLIP-modellen, door een nieuw combinatorisch object genaamd $(\mathsf{m}, \mathsf{b}_{\mathsf{rel}})$ -Constellations te introduceren dat de succesvolle prestaties, de modale kloof en de benodigde dimensie voor kwalitatief hoogwaardige representaties verklaart.

Kiril Bangachev, Guy Bresler, Iliyas Noman, Yury Polyanskiy2026-03-12🤖 cs.LG

RADAR: Reasoning-Ability and Difficulty-Aware Routing for Reasoning LLMs

Het paper introduceert RADAR, een lichtgewicht en interpreteerbaar routeringskader dat, geïnspireerd door psychometrie, query's dynamisch toewijst aan de meest geschikte reasoning-LLM-configuratie op basis van de moeilijkheidsgraad van de vraag en het beschikbare reasoning-budget om zo de prestaties te maximaliseren en de kosten te optimaliseren.

Nigel Fernandez, Branislav Kveton, Ryan A. Rossi, Andrew S. Lan, Zichao Wang2026-03-12🤖 cs.AI

← Vorige Volgende →