DualMiT-Net: Local-Global Transformer-Convolutional Fusion for Breast Mass Segmentation in Mammographic Regions of Interest
L'article présente DualMiT-Net, un réseau à deux branches qui fusionne les détails locaux de la masse provenant d'un encodeur Mix Transformer avec le contexte global du sein provenant d'un encodeur EfficientNet via un décodeur à porte spatiale afin d'atteindre l'état de l'art de la segmentation des masses mammaires sur l'ensemble de données CBIS-DDSM.
Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète
Le cancer du sein demeure l'un des défis de santé les plus importants auxquels les femmes sont confrontées aujourd'hui, pourtant la détection précoce offre une défense puissante. Lorsque la maladie est détectée alors qu'elle est encore localisée, le taux de survie à cinq ans dépasse quatre-vingt-dix-neuf pour cent. Pour trouver ces signes précoces, les médecins s'appuient sur les mammographies, qui sont des images de la poitrine obtenues par rayons X. Cependant, l'interprétation de ces images est une tâche exigeante. Les tumeurs, ou masses, se fondent souvent dans le tissu environnant, manquant de contours nets ou de contraste clair, et leurs formes peuvent être irrégulières et difficiles à tracer. Même pour les radiologues expérimentés, dessiner le contour exact d'une masse peut prendre du temps et varier d'un lecteur à l'autre. C'est ici que l'informatique intervient, avec pour objectif d'apprendre aux machines à percevoir ces frontières cachées avec la même précision qu'un œil humain s'efforce d'atteindre, mais avec la cohérence et la rapidité que seul un logiciel peut offrir.
Les chercheurs ont longtemps tenté d'aider les ordinateurs à comprendre les images médicales en utilisant l'apprentissage profond (deep learning), un type d'intelligence artificielle qui apprend en analysant des milliers d'exemples. Les premières tentatives utilisaient des réseaux qui étaient très doués pour repérer de petits détails locaux, mais qui éprouvaient parfois des difficultés à comprendre la vision globale des tissus environnants. Des modèles plus récents ont emprunté des idées à la façon dont les humains traitent la vision, utilisant des systèmes capables d'observer des parties distantes d'une image et de les relier entre elles. Pourtant, un défi spécifique subsistait pour les masses mammaires : un ordinateur doit voir le bord fin et dentelé de la tumeur pour la définir, mais il doit aussi voir la zone plus large du sein pour comprendre ce qui se trouve à côté de la tumeur. Un plan serré et rapproché montre le bord, tandis qu'un plan plus large montre le contexte, mais la plupart des modèles informatiques ont historiquement tenté de faire les deux avec une vue unique et fixe.
Pour résoudre ce problème, une équipe de chercheurs de la Lawrence Technological University a développé un nouveau système appelé DualMiT-Net. Au lieu de forcer l'ordinateur à choisir entre un gros plan et un plan large, ce système utilise deux « yeux » distincts pour regarder la même masse simultanément. Un œil se concentre étroitement sur la lésion, zoomant pour capturer la texture et la frontière précise de la masse. L'autre œil recule pour embrasser une vue plus large du tissu mammaire environnant, fournissant le contexte nécessaire pour comprendre où la masse s'arrête et où commence le tissu sain. Ces deux perspectives sont traitées par différentes parties du cerveau informatique, conçues respectivement pour gérer les détails fins et les schémas globaux.
La magie du système réside dans la façon dont ces deux vues communiquent entre elles. Pendant que l'ordinateur analyse l'image, il partage des informations entre la vue rapprochée et la vue large aux niveaux les plus profonds de son traitement. Ensuite, lorsqu'il construit l'image finale, il utilise une porte spéciale pour décider quelle quantité d'informations contextuelles larges doit être ajoutée au gros plan détaillé à chaque point précis. Cela permet au système de conserver les bords nets de la tumeur tout en utilisant le tissu environnant pour clarifier les zones confuses. Les chercheurs ont également constaté que nourrir l'ordinateur avec un type spécifique de préparation d'image aidait le plus. Ils ont pris la mammographie standard, ont ajusté sa luminosité pour mettre en évidence les détails les plus importants, et ont ajouté une couche d'information de texture qui répond aux motifs spécifiques trouvés dans le tissu mammaire, tels que les bords épineux souvent observés dans les tumeurs.
Lorsqu'il a été testé sur une large collection publique de mammographies contenant des centaines de cas, ce système à double vue a obtenu des performances d'une précision remarquable. Les chercheurs ont mesuré la qualité de la correspondance entre le contour de l'ordinateur et les contours tracés par des experts humains. Le système a obtenu un score de 0,9375 sur une échelle où une correspondance parfaite est de 1,0, un résultat constant sur plusieurs sessions d'entraînement. Ce score est nettement supérieur à celui de six autres modèles informatiques standards qui ont été testés dans les mêmes conditions exactes. Le nouveau système était meilleur pour récupérer la pleine surface de la tumeur et maintenir les lignes de contour proches des marques des experts, même dans les cas difficiles où la masse présentait un faible contraste ou des bords flous.
L'étude a également vérifié méticuleusement ce qui se passait lorsque des parties du système étaient retirées afin de voir quelles parties étaient réellement essentielles. Ils ont découvert que, bien que les outils spécifiques utilisés pour affiner l'image soient utiles, la force fondamentale du système provenait de l'idée simple d'utiliser deux vues différentes à la fois. Le système ne reposait pas sur un tour unique, mais sur la combinaison du détail local et du contexte global travaillant de concert. Bien que le modèle actuel nécessite que l'ordinateur sache déjà approximativement où se situe la masse, il représente une étape importante vers l'automatisation de la tâche difficile consistant à détourer ces tumeurs. En imitant la façon dont un radiologue pourrait déplacer son attention entre un détail et l'ensemble de l'image, cette nouvelle approche offre une manière plus fiable de définir les contours des masses mammaires, pouvant potentiellement aider les médecins à réaliser des diagnostics plus rapides et plus cohérents.
Noyé(e) sous les articles dans votre domaine ?
Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.