← Nieuwste papers
💻 computer science

DRL-Guided Neural Batch Sampling for Semi-Supervised Pixel-Level Anomaly Detection

Dit artikel stelt een semi-gecontroleerd deep reinforcement learning-framework voor dat een neurale batch sampler, een autoencoder en een predictor integreert om superieure nauwkeurigheid en lokalisatie te bereiken in industriële pixel-niveau anomaliedetectie met beperkte gelabelde data, waarbij de huidige state-of-the-art methoden op de MVTec AD-dataset wordt overtroffen.

Oorspronkelijke auteurs: Amirhossein Khadivi Noghredeh, Abdollah Safari, Fatemeh Ziaeetabar, Firoozeh Haghighi

Gepubliceerd 2026-08-18
📖 8 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Amirhossein Khadivi Noghredeh, Abdollah Safari, Fatemeh Ziaeetabar, Firoozeh Haghighi

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

In de fabrieken die alles bouwen, van printplaten tot voedselverpakkingen, is kwaliteitscontrole een meedogenloos spel van het vinden van het ene ding dat er niet thuishoort. Decennialang zijn machines getraind om deze gebreken op te sporen, maar ze kampen met een fundamenteel probleem: ze krijgen zelden te zien hoe een defect product eruitziet. Defecten zijn zeldzaam, duur om te creëren en vaak subtiel, zoals een haarlijn kras op een gepolijst oppervlak of een klein chipje in een glazen component. Vanwege deze schaarste hebben ingenieurs computers traditioneel geleerd om alleen de vorm van een perfect object te leren kennen. De computer onthoudt wat "normaal" is, en wanneer hij iets ziet dat afwijkt van die herinnering, markeert hij het als een defect. Deze aanpak heeft echter een blinde vlek. Als een computer te perfect leert hoe een normaal object eruitziet, kan hij in de war raken door de zeer kleine, stille fouten die er juist toe doen, of hij kan ze simpelweg negeren omdat ze niet lijken op de grote, overduidelijke fouten die hij verwachtte.

Een team onderzoekers van de Universiteit van Teheran heeft een nieuwe manier voorgesteld om dit puzzelstuk op te lossen, een manier die verder gaat dan simpelweg het perfectionisme onthouden. In plaats van te vertrouwen op een statisch geheugen van wat normaal is, hebben zij een systeem gecreëerd dat actief leert om naar problemen te zoeken. Hun methode, die gedetailleerd wordt beschreven in een recente studie, combineert drie verschillende instrumenten in één enkele, zelfverbeterende lus. Ten eerste beweegt een digitale "verkenner" over een afbeelding en beslist welke kleine secties een nadere inspectie waard zijn. Ten tweede probeert een reconstructiemotor die secties vanuit het geheugen te reconstrueren, waarbij wordt benadrukt waar het geheugen niet overeenkomt met de realiteit. Ten derde leert een classifier die deze fouten te lezen en een nauwkeurige kaart van het defect te tekenen. Door deze drie onderdelen met elkaar te laten communiceren, leert het systeem subtiele anomalieën te vinden met een nauwkeurigheid die voorgaande methoden moeite hadden te bereiken, terwijl het slechts een handvol bekende defecte voorbeelden gebruikt om het proces te sturen.

De kern van dit nieuwe framework is een digitale agent die fungeert als een nieuwsgierige inspecteur. In traditionele systemen scant een computer misschien een hele afbeelding in één keer of kijkt hij naar willekeurige fragmenten zonder een plan. Deze nieuwe agent gebruikt echter een techniek genaamd reinforcement learning, wat in essentie een leerproces van vallen en opstaan is dat wordt gedreven door beloningen. Stel je een persoon voor die door een groot magazijn loopt op zoek naar een specifiek type schade; die persoon loopt niet in een rechte lijn of controleert willekeurig elke doos. In plaats daarvan zoekt die persoon naar aanwijzingen, besluit welk gebied het meest verdacht lijkt, en verplaatst de aandacht vervolgens naar dat gebied. Deze digitale agent doet hetzelfde. Hij kijkt naar een afbeelding en besluit welk klein vierkantje hij als volgende moet onderzoeken op basis van wat hij tot nu toe heeft geleerd. Als hij een plek kiest die het systeem helpt het verschil te begrijpen tussen een goed onderdeel en een slecht onderdeel, ontvangt hij een beloning. Als hij een plek kiest die geen nieuwe informatie toevoegt, leert hij dat gebied in de toekomst te vermijden. Dit stelt het systeem in staat om zijn energie te richten op de meest informatieve delen van de afbeelding, in plaats van tijd te verspillen aan gebieden die duidelijk perfect zijn.

Zodra de agent een fragment selecteert, wordt dit doorgegeven aan een reconstructiemotor, een type neuraal netwerk dat ontworpen is om afbeeldingen te reconstrueren. Deze motor is uitgebreid getraind op perfecte, defectvrije monsters. Wanneer de motor een fragment van een goed deel van het product ontvangt, kan hij dit bijna perfect reconstrueren. Maar wanneer hij een fragment ontvangt dat een kras of een chip bevat, heeft hij moeite. Omdat hij dit specifieke defect niet tijdens zijn training heeft gezien, kan hij het niet nauwkeurig reconstrueren. Het verschil tussen wat de motor ziet en wat hij reconstrueert, creëert een "loss profile", een kaart van fouten die helder oplicht waar het defect verborgen zit. Deze kaart is de sleutel tot het succes van het systeem. In plaats van te proberen het defect direct uit de ruwe afbeelding te raden, analyseert het systeem deze kaart van reconstructiefouten, wat zelfs de kleinste imperfecties veel duidelijker zichtbaar maakt.

Het laatste puzzelstukje is een voorspeller, een gespecialiseerd netwerk dat deze foutenkaarten neemt en deze omzet in een duidelijke, binaire beslissing: deze pixel is goed, of deze pixel is slecht. Wat de aanpak van de onderzoekers uniek maakt, is hoe deze drie componenten — de verkenner, de motor en de voorspeller — samen leren. In veel eerdere pogingen tot soortgelijke systemen werden de onderdelen apart getraind of vertrouwden ze op rigide regels die hun vermogen om zich aan te passen beperkten. Hier gebruikt het systeem een semi-gesuperviseerde aanpak, wat betekent dat het leert van een grote hoeveelheid normale data en een zeer kleine set gelabelde defecte data. De onderzoekers ontdekten dat door bepaalde complexe mechanismen die in eerdere versies werden gebruikt te verwijderen en de manier waarop de voorspeller leert te vereenvoudigen, het systeem stabieler werd en beter werd in het generaliseren naar nieuwe soorten defecten. De agent leert een balans te vinden tussen twee concurrerende behoeften: het verkennen van nieuwe gebieden in de afbeelding om onbekende probleemlocaties te vinden, en het exploiteren van de gebieden waarvan hij al weet dat ze verdacht zijn om de detectie te verfijnen.

De resultaten van deze aanpak werden getest op een veelgebruikte collectie industriële afbeeldingen die bekend staat als de MVTec AD dataset, die hoogresolutiefoto's bevat van diverse objecten en texturen, van kabels en tandenborstels tot pillen en houten planken. De onderzoekers vergeleken hun methode met verschillende toonaangevende technieken, waaronder standaard deep learning-modellen en andere geavanceerde reconstructie-gebaseerde systemen. Het nieuwe framework presteerde consequent beter dan deze concurrenten. Gemiddeld verbeterde het het vermogen om defecten correct te identificeren en te lokaliseren met een aanzienlijke marge. In de meest uitdagende gevallen, waar de defecten extreem subtiel waren, liet de nieuwe methode een dramatische verbetering zien, waarbij hogere nauwkeurigheidsscores behaalde dan andere systemen en gebreken detecteerde die voorheen moeilijker te lokaliseren waren voor andere methoden. Bijvoorbeeld, in tests met transistoren en tandenborstels steeg de nauwkeurigheid van het systeem ruim boven de vorige beste resultaten, wat bewees dat de adaptieve bemonsteringsstrategie effectief de juiste gebieden targette.

Naast het louter vinden van de defecten, blonk het systeem ook uit in het exact aanwijzen van waar ze zich bevonden. In industriële omgevingen is weten dat een product gebrekkig is niet genoeg; de machine moet precies weten welk deel van het oppervlak beschadigd is, zodat het gerepareerd of weggegooid kan worden. De onderzoekers toonden aan dat hun methode schonere, preciezere kaarten van de schade produceerde. De visuele resultaten toonden scherpe grenzen rond krassen en duidelijke definities van ontbrekende delen, zelfs in complexe texturen zoals houtnerf of metalen roosters. Deze precisie is cruciaal omdat het het aantal valse alarmen vermindert, waarbij een perfect item per abuis wordt afgekeurd, en ervoor zorgt dat echte defecten niet worden over het hoofd gezien. Het systeem bereikte dit hoge niveau van prestatie zonder dat daarvoor enorme hoeveelheden gelabelde defecte data nodig waren, wat vaak de grootste flessenhals is in industriële automatisering.

De studie benadrukte ook het belang van hoe het systeem werd getraind. De onderzoekers ontdekten dat als de verschillende onderdelen van het systeem niet in de juiste volgorde aan elkaar werden geïntroduceerd, het hele proces instabiel kon worden. Zij ontwikkelden een specifiek trainingsschema waarbij de reconstructiemotor eerst leerde, gevolgd door de voorspeller, en tot slot de agent die de fragmenten selecteert. Deze stapsgewijze aanpak zorgde ervoor dat elk onderdeel stabiliseerde voordat het de toegevoegde complexiteit van de andere onderdelen op zich nam. Aan het einde van de training had het systeem een geavanceerde strategie geleerd voor het scannen van afbeeldingen, een strategie die veel efficiënter en effectiever was dan simpelweg alles scannen of vertrouwen op willekeurige gokken. De onderzoekers merkten op dat hoewel het systeem complexer is om op te zetten dan een eenvoudige scanner, de afruil een veel robuustere en betrouwbaardere detector is die de subtiele, real-world variaties in werkelijke fabrieken kan afhandelen.

Dit werk vertegenwoordigt een verschuiving in hoe machines leren te zien. In plaats van te proberen een computer te dwingen om elke mogelijke manier waarop een product kan breken te onthouden, hebben de onderzoekers het systeem geleerd om nieuwsgierig te zijn. Door het systeem de mogelijkheid te geven om te kiezen waar het naar kijkt en hoe het van zijn fouten leert, hebben zij een hulpmiddel gecreëerd dat zowel krachtig als aanpasbaar is. De bevindingen suggereren dat de toekomst van kwaliteitscontrole niet ligt in grotere databases van kapotte onderdelen, maar in slimmere algoritmen die weten hoe ze de naald in de hooiberg moeten vinden door te leren kijken op de juiste plekken. Het succes van deze methode op een diverse set industriële afbeeldingen geeft aan dat het een waardevol instrument kan zijn voor fabrikanten die hun inspectieprocessen willen verbeteren zonder de buitensporige kosten van het verzamelen van duizenden defecte monsters.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →