← Nieuwste papers
💻 computer science

Recurrent Contrastive Learning for Imbalanced Medical Image Classification

Dit artikel stelt Recurrent Contrastive Learning (RCL) voor, een nieuw framework dat een Temporal Memory Queue gebruikt om Temporal Anchors te genereren en de latente ondersteuningsregio van tail-klassen progressief uit te breiden, waardoor klassenonbalans wordt verminderd en beslissingsgrenzen in medische beeldclassificatie worden verbeterd.

Oorspronkelijke auteurs: Zhiyuan Zhu, Xinling Meng, Junxuan Yu, Jiongquan Chen, Qiongying Ni, Tuhang Shao, Yuhao Huang, Luping Zhou, Ruiyang Huang, Yuxue Wang, Rongliang Zhang, Xue Wang, Tianhong Tang, Likun Wang, Junbo Chen
Gepubliceerd 2026-08-05
📖 7 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Zhiyuan Zhu, Xinling Meng, Junxuan Yu, Jiongquan Chen, Qiongying Ni, Tuhang Shao, Yuhao Huang, Luping Zhou, Ruiyang Huang, Yuxue Wang, Rongliang Zhang, Xue Wang, Tianhong Tang, Likun Wang, Junbo Chen, Yong Jiang, Yongping Lu, Xin Yang

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een robot probeert te leren om verschillende soorten dieren in een dierentuin te herkennen. Als de dierentuin 1.000 leeuwen heeft maar slechts 5 tijgers, zal de robot heel goed worden in het spotten van leeuwen en waarschijnlijk vergeten hoe een tijger eruitziet, of erger nog, hij kan denken dat elk katachtig dier een leeuw is. Dit is een veelvoorkomend probleem in de wereld van medische AI genaamd "class imbalance" (klasse-onbalans). Artsen hebben bergen data voor veelvoorkomende ziekten, maar heel weinig voor zeldzame of ernstige ziekten. Wanneer AI-modellen worden getraind op deze ongelijkmatige data, worden ze bevooroordeeld naar de veelvoorkomende zaken en missen ze de zeldzame, kritieke gevallen. Om dit op te lossen, proberen wetenschappers meestal óf de robot meer foto's van de zeldzame dieren te laten zien (resampling), óf hem te vertellen dat hij extra goed moet opletten tijdens de lessen (reweighting). Maar er is een addertje onder het gras: deze methoden zorgen er vaak alleen voor dat de robot harder naar de weinige foto's van de zeldzame dieren kijkt, zonder dat ze de zeldzame dieren daadwerkelijk genoeg "ruimte" geven in het brein van de robot om duidelijk op te vallen.

Dit is waar een nieuwe studie door Zhiyuan Zhu en zijn team inspringt met een slim idee genaamd Recurrent Contrastive Learning (RCL). In plaats van alleen het kaartspel te herschikken of harder tegen de zeldzame dieren te schreeuwen, besloten ze een "geheugenbuffer" te bouwen die de zeldzame ziekten helpt om hun territorium in de geest van de AI uit te breiden. Denk aan een drukke dansvloer waar de populaire kinderen (veelvoorkomende ziekten) alle ruimte opeisen. De zeldzame kinderen (zeldzame ziekten) worden in een klein hoekje weggedrukt. De oplossing van de onderzoekers is om "geestdansers" uit vorige oefensessies mee te brengen—oude versies van de bewegingen van de zeldzame kinderen—om rond hen te staan en een beschermende bubbel te creëren. Deze bubbel duwt de populaire kinderen weg, waardoor de zeldzame ziekten de ruimte krijgen die ze nodig hebben om correct gezien en herkend te worden. Het team testte dit op drie verschillende medische datasets, waaronder carotis-echografiebeelden, afbeeldingen van diabetische retinopathie en knie X-rays, en vond dat hun methode de AI consequent beter hielp om de zeldzame condities te spotten dan eerdere technieken.

Het Probleem: Het "Populaire Kind"-effect in Medische AI

In de wereld van medische beeldvorming zijn niet alle ziekten gelijk aan elkaar. Sommige, zoals een gewone verkoudheid of een milde huiduitslag, komen heel vaak voor. Andere, zoals zeldzame genetische stoornissen of specifieke stadia van kanker, zijn veel minder frequent. Wanneer we een AI trainen om deze condities te diagnosticeren, is dat als het trainen van een student die slechts 1.000 voorbeelden van een gewone verkoudheid krijgt, maar slechts 5 voorbeelden van een zeldzame ziekte. Natuurlijk wordt de student (de AI) een expert in de gewone verkoudheid, maar raakt hij in de war wanneer hij de zeldzame ziekte ziet. Hij kan de zeldzame ziekte zelfs aanzien voor de gewone ziekte omdat de zeldzame ziekte in de "geest" van de AI niet genoeg ruimte heeft om op zichzelf te bestaan.

Het artikel wijst erop dat bestaande oplossingen proberen dit op te lossen door de AI meer voorbeelden van de zeldzame ziekte te tonen (resampling) of door de AI te vertellen om "extra aandacht te besteden" aan die weinige voorbeelden (reweighting). Hoewel deze methoden een beetje helpen, lossen ze het fundamentele probleem niet op: de zeldzame ziekten zijn nog steeds samengeperst in een klein, druk hoekje van de feature-ruimte van de AI. Ze zijn zo compact dat de veelvoorkomende ziekten gemakkelijk hun territorium kunnen "binnendringen", wat leidt tot fouten.

De Oplossing: Tijdreizende Geesten en Beschermende Bubbels

De auteurs stellen een nieuwe strategie voor genaamd Recurrent Contrastive Learning (RCL). Om te begrijpen hoe dit werkt, stel je het leerproces van de AI voor als een reeks trainingssessies door de tijd heen.

1. Het Geheugen van de Tijdreis (Temporal Memory Queue)
Normaal gesproken onthoudt een AI alleen de voorbeelden die hij ziet in de huidige batch van de training. RCL introduceert een speciale "Tijdmachine" genaamd de Temporal Memory Queue (TMQ). Deze wachtrij houdt niet alleen de huidige afbeeldingen vast; het slaat de "feature states" (het begrip van de AI van de afbeeldingen) op van eerdere trainingssessies. Het is alsof je een dagboek bijhoudt van wat de AI vorige week, vorige maand, enzovoort heeft geleerd. Dit stelt de AI in staat om terug te kijken naar hoe hij de zeldzame ziekten in het verleden begreep, zelfs als hij onlangs niet veel nieuwe voorbeelden van hen heeft gezien.

2. De Geestdansers (Temporal Anchors)
Hier zit de magische truc. Wanneer de AI probeert te leren over een zeldzame ziekte (een "tail class"), kijkt hij in zijn tijdreizende dagboek. Hij kiest de "geestdansers uit—oude feature-representaties van die zeldzame ziekte uit eerdere sessies. Deze geesten worden vervolgens gebruikt om een Temporal Anchor (TAR) te creëren.

Stel je voor dat de zeldzame ziekte een klein eiland is in een enorme oceaan. De veelvoorkomende ziekten zijn enorme continenten in de buurt. Zonder hulp spoelen de golven van de oceaan (de features van de veelvoorkomende ziekten) over het eiland heen, waardoor het moeilijk is om het eiland te onderscheiden. De TARs fungeren als een reeks boeien of een beschermende barrière rond het eiland. Deze boeien zijn gemaakt van de "geestversies" van het eiland uit het verleden. Door deze boeien rond de zeldzame ziekte te plaatsen, zorgt de AI er effectief voor dat het territorium van het eiland wordt uitgebreid. Het creëert een "bufferzone" die de veelvoorkomende ziekten wegduwt, zodat de zeldzame ziekte haar eigen duidelijke ruimte heeft.

3. De Recurrente Lus
Het proces is "recurrent", wat betekent dat het keer op keer gebeurt. Terwijl de AI traint, blijft hij zijn geheugenwachtrij bijwerken met nieuwe informatie, maar hij behoudt ook de oude ankers. Dit creëert een groeiend, uitbreidend veld rond de zeldzame ziekten, waardoor ze robuuster en gemakkelijker te onderscheiden zijn van de veelvoorkomende ziekten.

Wat Ze Hebben Gevonden: Een Helderder Beeld

Het team heeft deze methode getest op drie echte medische datasets:

  • Carotis Echografie: Afbeeldingen van bloedvaten in de nek om plaque te controleren (3.404 afbeeldingen).
  • Diabetische Retinopathie: Oogafbeeldingen om visusverlies te controleren (3.662 afbeeldingen).
  • Knie Osteoartritis: X-rays van knieën om de ernst van artrose te beoordelen (8.260 afbeeldingen).

In alle drie de gevallen toonde de RCL-methode consistente verbeteringen ten opzichte van de beste bestaande methoden.

  • Op de Carotis-dataset behaalde de nieuwe methode een Balanced Accuracy van 87,10%, waarmee het de vorige beste methode versloeg.
  • Op de Knie-dataset verbeterde de Balanced Accuracy met 9,09% vergeleken met het gebruik van enkel het basis AI-model zonder de speciale geheugentrucs.
  • Op de Oog-dataset behaalde de methode een Quadratic Weighted Kappa score van 0,92, wat een zeer hoge score is die wijst op een uitstekende overeenstemming met menselijke experts.

De onderzoekers visualiseerden ook wat er binnen het brein van de AI gebeurde met een techniek genaamd t-SNE (wat een kaart is die laat zien hoe dicht of ver verschillende dingen bij elkaar liggen). Ze zagen dat zonder hun methode, de zeldzame ziekten werden samengeperst in kleine, drukke puntjes. Met RCL hadden de zeldzame ziekten zich uitgebreid tot grotere, goed gedefinieerde gebieden met duidelijke "bufferzones" tussen hen en de veelvoorkomende ziekten. De "geestdansers" (ankers) hadden succesvol een beschermend veld gecreëerd dat voorkwam dat de veelvoorkomende ziekten de zeldzame ziekten wegdrongen.

Waarom Dit Belangrijk Is

Dit artikel suggereert dat we niet alleen meer data nodig hebben voor zeldzame ziekten; we hebben slimmere manieren nodig om de data die we al hebben te gebruiken. Door de geschiedenis van de AI zelf te gebruiken om een beschermend veld rond zeldzame condities te bouwen, kunnen we medische AI eerlijker en nauwkeuriger maken. Dit is cruciaal omdat het in de echte wereld levensbedreigend kan zijn om een zeldzame maar ernstige ziekte te missen. De auteurs merken op dat hoewel hun methode goed werkt, het momenteel enige handmatige afstelling van instellingen vereist (zoals hoeveel "geesten" er in het geheugen moeten worden gehouden). Toekomstig werk zal gericht zijn op het automatiseren van dit proces. Maar voor nu biedt deze "tijdreizende geheugen"-aanpak een veelbelovende nieuwe manier om ervoor te zorgen dat de zeldzaamste patiënten de aandacht krijgen die ze verdienen van onze AI-artsen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →