← Nieuwste papers
🤖 machine learning

ADMIL: Attention-Distilled Multiple Instance Learning for Selective Foundation Model Inference in Pathology

Het artikel introduceert ADMIL, een selectieve computieframework dat de aandacht van een op aandacht gebaseerd multiple instance learning-model (teacher) destilleert naar een lichtgewicht PriorNet-model om alleen de meest informatieve tegels te selecteren voor dure inferentie met een foundation model, waardoor de volledige prestaties van de teacher worden bereikt terwijl de computationele kosten bij pathologie-dia-analyse met meer dan 98% worden verminderd.

Oorspronkelijke auteurs: Duncan Stothers, Ren-Chin Wu, William Lotter

Gepubliceerd 2026-08-25
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Duncan Stothers, Ren-Chin Wu, William Lotter

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

In de wereld van de moderne geneeskunde heeft digitale pathologie de manier waarop artsen weefsel onderzoeken getransformeerd. In plaats van door een microscoop naar een enkel glazen objectglas te kijken, werken pathologen nu met enorme digitale afbeeldingen die 'whole-slide images' worden genoemd. Deze afbeeldingen zijn zo groot en gedetailleerd dat ze zijn opgedeeld in duizenden kleine vierkante stukjes, bekend als 'tiles', die elk een klein deel van het weefsel bevatten. Om te begrijpen wat er in het lichaam van een patiënt gebeurt, moeten computersystemen deze tiles analyseren om tekenen van ziekte, zoals kanker, te vinden. In de afgelopen jaren zijn krachtige kunstmatige intelligentiemodellen, vaak 'foundation models' genoemd, getraind om complexe patronen in deze tiles met ongelooflijke nauwkeurigheid te herkennen. Deze modellen fungeren als deskundige ogen, in staat om subtiele verschillen tussen gezond en ziek weefsel te onderscheiden. Er is echter een aanzienlijk probleem met het gebruik van deze modellen in een echt ziekenhuis: ze zijn extreem traag en duur in gebruik. Omdat een enkele weefseldia duizenden tiles kan bevatten, moet de computer elk afzonderlijk deel verwerken om tot een diagnose te komen. Deze uitputtende aanpak creëert een knelpunt, waardoor het moeilijk is om deze geavanceerde instrumenten snel genoeg te gebruiken voor de dagelijkse patiëntenzorg.

Onderzoekers van het Dana-Farber Cancer Institute en Harvard Medical School hebben een nieuwe methode ontwikkeld om dit probleem op te lossen zonder in te boeten op nauwkeurigheid. Ze creëerden een systeem genaamd ADMIL, wat staat voor 'Attention-Distilled Multiple Instance Learning'. De kern van het idee is simpel maar krachtig: niet elke tile op een dia is even belangrijk. Wanneer een getraind kunstmatige intelligentiemodel naar een dia kijkt, richt het zijn aandacht van nature op een zeer klein aantal regio's die de meest cruciale informatie bevatten, terwijl het de rest grotendeels negeert. Het nieuwe systeem leert dit gedrag na te bootsen. Het gebruikt een lichtgewicht, snel computerprogramma dat eerst de hele dia scant en voorspelt welke paar tiles het belangrijkste zijn. Alleen die geselecteerde tiles worden vervolgens naar het dure, trage deskundige model gestuurd voor een gedetailleerde analyse. Door het overgrote deel van de onbelangrijke tiles over te slaan, versnelt het systeem het proces drastisch.

De onderzoekers testten deze aanpak op drie verschillende medische uitdagingen met betrekking tot borstkanker, prostaatkanker en lymfekliermetastase. In elk geval begonnen ze met een volledig getraind deskundig model dat al had geleerd de ziekte te diagnosticeren door naar elke afzonderlijke tile te kijken. Vervolgens trainden ze hun nieuwe, snelle voorspeller om te raden naar welke tiles het deskundige model de aandacht zou hebben besteed. Zodra de voorspeller deze vaardigheid beheerste, bouwden ze een tweede versie van het diagnosesysteem dat alleen naar de top paar tiles keek die door de voorspeller waren gekozen. De resultaten waren opmerkelijk. Voor dia's met borstkanker bereikte het systeem hetzelfde hoge niveau van nauwkeurigheid als het volledige deskundige model door slechts vier tiles te analyseren van duizenden. Voor prostaatkanker had het slechts acht tiles nodig. Zelfs voor de complexere taak van de lymfeklier waren slechts 128 tiles nodig om de prestaties van het uitputtende systeem te evenaren. Dit betekent dat de nieuwe methode voorkomt dat het dure computermodel op meer dan 98 procent van de tiles wordt uitgevoerd, wat een enorme besparing oplevert in rekenkracht en tijd.

Om te waarborgen dat deze snelheid niet voortkwam uit simpelweg gokken of geluk hebben, vergeleken de onderzoekers hun methode met verschillende alternatieven. Ze testten wat er zou gebeuren als ze willekeurige tiles zouden kiezen om te analyseren, en ontdekten dat deze aanpak veel slechter presteerde, vooral wanneer het aantal tiles klein was. Ze vergeleken hun systeem ook met een theoretische "perfecte" versie die precies wist welke tiles het deskundige model zou kiezen. Hun nieuwe methode kwam zeer dicht in de buurt van dit perfecte scenario, wat bewees dat het succesvol de specifieke patronen leerde die het deskundige model gebruikte om beslissingen te nemen. De studie toonde ook aan dat de snelle voorspeller niet zomaar willekeurige tiles koos; het identificeerde correct de specifieke vormen en structuren in het weefsel die van belang zijn voor de diagnose. Wanneer de onderzoekers naar de afbeeldingen keken, zagen ze dat de door het nieuwe systeem geselecteerde tiles dezelfde kankerkenmerken bevatten die het deskundige model had benadrukt.

De studie suggereert dat de zware computationele kosten van de huidige kunstmatige intelligentie in de pathologie vaak onnodig zijn. De deskundige modellen zijn in staat om het juiste antwoord te vinden, maar ze verspillen energie aan het verwerken van achtergrondinformatie die het uiteindelijke resultaat niet verandert. Door een kleiner, sneller model te leren om als een poortwachter te fungeren, kan het systeem de ruis wegfilteren en zich alleen op het signaal richten. Deze aanpak vervangt de krachtige deskundige modellen niet; in plaats daarvan stelt het ons in staat om ze efficiënter te gebruiken. De onderzoekers ontdekten dat de methode consistent werkte bij verschillende soorten kanker en verschillende groottes van weefselmonsters. Ze testten ook of het systeem gevoelig was voor de hoeveelheid data waarop het was getraind, en vonden dat het robuust bleef, zelfs wanneer het met minder informatie werd getraind. Hoewel het systeem een kleine hoeveelheid extra werk introduceert tijdens de trainingsfase, zijn de besparingen tijdens het daadwerkelijke gebruik enorm. Dit werk biedt een praktisch pad vooruit om geavanceerde, hoog-nauwkeurige kunstmatige intelligentie in klinische omgevingen te brengen waar snelheid en kosten cruciale factoren zijn, zodat patiënten de voordelen van deze krachtige instrumenten kunnen ontvangen zonder te hoeven wachten op trage computerverwerking.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →