cs.LG papers | Gist.Science

Boosting Cross-problem Generalization in Diffusion-Based Neural Combinatorial Solver via Inference Time Adaptation

Deze paper introduceert DIFU-Ada, een trainingsvrij raamwerk voor adaptatie tijdens de inferentie dat het vermogen van diffusiegebaseerde neurale combinatorische optimalisatieoplossers aanzienlijk verbetert om zonder extra training te generaliseren over verschillende probleemgroottes en -types, zoals het overschakelen van het Traveling Salesman Problem naar varianten zoals het Prize Collecting TSP.

Haoyu Lei, Kaiwen Zhou, Yinchuan Li, Zhitang Chen, Farzan Farnia2026-03-12🤖 cs.LG

Is CLIP ideal? No. Can we fix it? Yes!

Deze paper toont aan dat de geometrie van CLIP fundamenteel beperkt is in het tegelijkertijd verwerken van complexe visuele-taalkundige relaties, en lost dit op door een nieuwe methode genaamd Dense Cosine Similarity Maps (DCSMs) voor te stellen die de semantische topologie behoudt en de prestaties op diverse benchmarks verbetert.

Raphi Kang, Yue Song, Georgia Gkioxari, Pietro Perona2026-03-12🤖 cs.LG

Are Deep Speech Denoising Models Robust to Adversarial Noise?

Deze studie toont aan dat diepe spraakruisreductiemodellen kwetsbaar zijn voor psychoakoestisch verborgen adversariële ruis die de output onbegrijpelijk maakt zonder dat de ruis zelf waarneembaar is, wat dringende maatregelen vereist voordat deze systemen veilig in kritieke toepassingen kunnen worden ingezet.

Will Schwarzer, Neel Chaudhari, Philip S. Thomas, Andrea Fanelli, Xiaoyu Liu2026-03-12⚡ eess

Learn to Bid as a Price-Maker Wind Power Producer

Deze paper introduceert een online leeralgoritme dat windenergieproducenten met een grote marktaandelen in staat stelt om hun biedingen in de Duitse energiemarkt strategisch te optimaliseren en onbalanskosten te minimaliseren door het biedingsprobleem te modelleren als een contextuele multi-armed bandit.

Shobhit Singhal, Marta Fochesato, Liviu Aolaritei + 1 more2026-03-12⚡ eess

An Algorithm to perform Covariance-Adjusted Support Vector Classification in Non-Euclidean Spaces

Dit artikel introduceert een Cholesky-SVM-algoritme dat de beperkingen van traditionele SVM's in niet-Euclidische ruimtes overbrugt door de covariantie van de data in de optimalisatie te integreren, wat leidt tot aanzienlijk betere classificatieprestaties dan bestaande methoden.

Satyajeet Sahoo, Jhareswar Maiti2026-03-12📊 stat

Rethinking Few-Shot Image Fusion: Granular Ball Priors Enable General-Purpose Deep Fusion

Deze paper introduceert een nieuwe few-shot beeldfusiemethode die onvolledige prioren combineert met een lichtgewicht neurale netwerk via het Granular Ball Pixel Computation-algoritme, waardoor effectieve fusieregels kunnen worden geleerd met slechts tien beeldparen zonder echte gefuseerde supervisie.

Minjie Deng, Yan Wei, An Wu, Yuncan Ouyang, Hao Zhai, Qianyao Peng2026-03-12⚡ eess

Offline Dynamic Inventory and Pricing Strategy: Addressing Censored and Dependent Demand

Dit paper introduceert twee nieuwe datagedreven algoritmen die offline versterkte leer- en overlevingsanalyse technieken combineren om optimale prijs- en voorraadbeheerstrategieën te leren in een omgeving met gecensureerde en afhankelijke vraag, waarbij de uitdagingen van ontbrekende winstinformatie en het verlies van de Markov-eigenschap worden overwonnen door het probleem te benaderen als een hoog-ordelijk Markov-beslissingsproces.

Korel Gundem, Zhengling Qi2026-03-12📊 stat

Score Matching Diffusion Based Feedback Control and Planning of Nonlinear Systems

Dit paper introduceert een deterministisch diffusiemodel voor de regeling en planning van niet-lineaire systemen, waarbij een feedbackwet wordt ontworpen om de toestandsdichtheid via een 'denoising'-proces te sturen naar een gewenste doelformatie.

Karthik Elamvazhuthi, Darshan Gadginmath, Fabio Pasqualetti2026-03-12⚡ eess

Scalable Multi-Task Learning through Spiking Neural Networks with Adaptive Task-Switching Policy for Intelligent Autonomous Agents

Dit paper introduceert SwitchMT, een nieuwe methode die adaptief taakwisselbeleid en diepe spiking Q-netwerken combineert om schaalbaar en energiezuinig meertaakleren voor autonome agenten mogelijk te maken zonder taakinterferentie of toegenomen netwerkcomplexiteit.

Rachmad Vidya Wicaksana Putra, Avaneesh Devkota, Muhammad Shafique2026-03-12🤖 cs.AI

Panda: A pretrained forecast model for chaotic dynamics

Dit paper introduceert Panda, een voorgetraind model dat, getraind op synthetische chaotische systemen, in staat is om zowel korte-termijnvoorspellingen als statistische verdelingen van onbekende chaotische dynamica, inclusief complexe real-world experimenten en partiële differentiaalvergelijkingen, zonder extra training nauwkeurig te voorspellen.

Jeffrey Lai, Anthony Bao, William Gilpin2026-03-12🌀 nlin

LLLMs: A Data-Driven Survey of Evolving Research on Limitations of Large Language Models

Deze data-gedreven survey analyseert de groeiende onderzoeksstroom naar beperkingen van grote taalmodellen (LLLMs) tussen 2022 en 2025, waarbij redeneren als meest bestudeerd thema naar voren komt en een significant verschuiving in onderzoekstrends tussen ACL en arXiv wordt vastgesteld.

Aida Kostikova, Zhipin Wang, Deidamea Bajri, Ole Pütz, Benjamin Paaßen, Steffen Eger2026-03-12💬 cs.CL

Consistency-based Abductive Reasoning over Perceptual Errors of Multiple Pre-trained Models in Novel Environments

Dit artikel introduceert een consistentie-gebaseerde abductieve redeneerframework dat testtijd-logische regels en meerdere pre-getrainde modellen combineert om prestatieverlies door distributieverschuivingen in nieuwe omgevingen effectief te mitigeren en zo zowel de precisie als het recall significant te verbeteren.

Mario Leiva, Noel Ngu, Joshua Shay Kricheli, Aditya Taparia, Ransalu Senanayake, Paulo Shakarian, Nathaniel Bastian, John Corcoran, Gerardo Simari2026-03-12🤖 cs.AI

CARTGen-IR: Synthetic Tabular Data Generation for Imbalanced Regression

Dit paper introduceert CARTGen-IR, een interpreteerbare methode voor het genereren van synthetische tabulaire data die het probleem van onevenwichtige regressie oplost door relevantie- en dichtheidsgeleide steekproefneming te combineren zonder willekeurige drempels, waardoor modellen beter presteren in gebieden met zeldzame doelwaarden.

António Pedro Pinheiro, Rita P. Ribeiro2026-03-12🤖 cs.LG

Comparative Analysis of Modern Machine Learning Models for Retail Sales Forecasting

Deze studie concludeert dat voor de verkoopvoorspelling in de detailhandel, ondanks de complexiteit van de data, geavanceerde deep learning-modellen onderpresteren ten opzichte van geoptimaliseerde boomgebaseerde ensemble-methoden zoals XGBoost, wat aantoont dat de afstemming op de probleemkarakteristiek belangrijker is dan architecturale complexiteit.

Luka Hobor, Mario Brcic, Lidija Polutnik, Ante Kapetanovic2026-03-12🤖 cs.LG

Learning What Reinforcement Learning Can't: Interleaved Online Fine-Tuning for Hardest Questions

Dit paper introduceert ReLIFT, een nieuwe trainingsmethode die reinforcement learning en online fine-tuning afwisselt om de beperkingen van RL te overwinnen en modellen effectief nieuwe kennis en redeneervermogens voor de moeilijkste vragen aan te leren.

Lu Ma, Hao Liang, Meiyi Qiang, Lexiang Tang, Xiaochen Ma, Zhen Hao Wong, Junbo Niu, Chengyu Shen, Runming He, Yanhao Li, Bin Cui, Wentao Zhang2026-03-12🤖 cs.AI

Sequential-Parallel Duality in Prefix Scannable Models

Dit artikel introduceert Prefix-Scannable Models (PSMs), een generalisatie van bestaande architecturen die door het toestaan van niet-associatieve operatoren (zoals softmax) de expressiviteit van transformatoren combineert met de efficiënte, lineaire inferentie van state space-modellen.

Morris Yau, Sharut Gupta, Valerie Engelmayer, Kazuki Irie, Stefanie Jegelka, Jacob Andreas2026-03-12🤖 cs.LG

Differential Privacy in Machine Learning: A Survey from Symbolic AI to LLMs

Dit survey biedt een uitgebreid overzicht van differentiele privacy in machine learning, waarbij het de evolutie van de theorie, de integratie in modellen en de praktische evaluatie bespreekt om veilige en verantwoorde AI-systemen te bevorderen.

Francisco Aguilera-Martínez, Fernando Berzal2026-03-12🤖 cs.AI

Silhouette-Driven Instance-Weighted $k$ -means

Dit paper introduceert K-Sil, een silhouette-gedreven variant van k-means die punten weegt op basis van hun toewijzingszekerheid en een adaptieve temperatuur gebruikt om de centroidupdates te verfijnen, wat leidt tot betere clusteringresultaten op diverse real-world datasets.

Aggelos Semoglou, Aristidis Likas, John Pavlopoulos2026-03-12🤖 cs.LG

The Yokai Learning Environment: Tracking Beliefs Over Space and Time

Dit paper introduceert het Yokai Learning Environment (YLE), een uitdagende nieuwe benchmark voor zero-shot coördinatie die de beperkingen van de bestaande Hanabi-benchmark blootlegt door te vereisen dat agenten geloofsoverdracht, ambiguïteit en spelbeëindiging beheren, waardoor wordt aangetoond dat huidige toonaangevende methoden in YLE falen terwijl ze in Hanabi uitstekend presteren.

Constantin Ruhdorfer, Matteo Bortoletto, Johannes Forkel, Jakob Foerster, Andreas Bulling2026-03-12🤖 cs.AI

Order Optimal Regret Bounds for Sharpe Ratio Optimization under Thompson Sampling

Dit artikel introduceert het SRTS-algoritme op basis van Thompson Sampling voor het maximaliseren van de Sharpe-ratio in een stochastisch bandit-probleem, waarbij het bewijst dat de regret logaritmisch is en orde-optimaal is, en experimenteel aantoont dat het bestaande methoden significantly overtreft.

Mohammad Taha Shah, Sabrina Khurshid, Gourab Ghatak2026-03-12🤖 cs.LG

← Vorige Volgende →

cs.LG