← Derniers articles
🤖 machine learning

How smoothing the affinity matrix affects neighborhood preservation in t-SNE

Cet article introduit une transformation de puissance par ligne appliquée à la matrice d'affinité t-SNE qui permet un lissage ou un accentuation dépendant des points, démontrant que l'accentuation améliore la préservation des plus proches voisins tandis que le lissage améliore la préservation du voisinage local plus large, surpassant ainsi les méthodes multi-échelles dans la plage médio-locale.

Auteurs originaux : Shirin Mohebi, Guillaume Bied, Jefrey Lijffijt

Publié 2026-08-19
📖 5 min de lecture🧠 Analyse approfondie

Auteurs originaux : Shirin Mohebi, Guillaume Bied, Jefrey Lijffijt

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez essayer de comprendre une ville immense et complexe en regardant une seule carte plane. Vous pouvez voir les points de repère majeurs et la façon dont les quartiers sont liés les uns aux autres, mais dès que l'on tente de projeter un monde tridimensionnel sur une surface bidimensionnelle, quelque chose est toujours perdu. C'est le défi quotidien des scientifiques travaillant avec des données de haute dimension, où chaque fragment d'information est décrit par des dizaines, voire des centaines de caractéristiques. Pour donner du sens à cela, ils utilisent une technique appelée réduction de dimensionnalité, qui agit comme un cartographe, écrasant des données complexes pour les transformer en un simple diagramme de dispersion que les humains peuvent réellement lire. Parmi les nombreux outils disponibles, une méthode est devenue la référence pour préserver les détails locaux de ces groupes de données : une technique connue sous le nom de t-SNE. Elle est célèbre pour maintenir les points qui sont proches ensemble dans les données d'origine proches ensemble dans l'image, ce qui la rend inestimable pour repérer des motifs dans tout, des types de cellules aux chiffres écrits à la main. Cependant, même cet outil puissant possède un défaut : bien qu'il soit excellent pour maintenir ensemble les voisins les plus proches, il peine parfois à préserver la structure plus large des voisinages, et la qualité de la carte peut varier considérablement d'une partie de l'image à l'autre.

Une équipe de chercheurs de l'Université de Gand s'est donné pour mission d'étudier pourquoi cela se produit et s'ils pouvaient améliorer la capacité de l'outil à montrer l'image complète. Ils se sont concentrés sur le cœur du processus t-SNE, une structure mathématique appelée matrice d'affinité. Vous pouvez considérer cette matrice comme un ensemble d'instructions qui dit à l'ordinateur à quel point deux points doivent être attirés l'un vers l'autre dans l'image finale. Dans la version standard de l'outil, ces instructions sont générées à l'aide d'une règle spécifique qui garantit que chaque point possède la même « perplexité », un concept qui se traduit approximativement par le nombre effectif de voisins dont un point se soucie. Les chercheurs ont remarqué qu'en pratique, cette règle crée souvent des instructions trop extrêmes. Pour de nombreux points, les instructions favorisent lourdement seulement quelques voisins très proches, ignorant les voisins légèrement plus distants qui font pourtant partie du même groupe local. C'est comme si le cartographe avait décidé que seule la personne debout immédiatement à côté de vous compte, tandis que la personne située à trois pas de vous est invisible.

Pour tester si ce focus extrême était le problème, les chercheurs ont introduit un ajustement simple qu'ils appellent une transformation de puissance. Il s'agit d'une manière contrôlée d'accentuer ou d'adoucir les instructions dans la matrice d'affinité. S'ils accentuaient les instructions, l'outil se concentrerait encore plus intensément sur les voisins les plus proches. S'ils les adoucissaient, l'outil répartirait l'attention de manière plus uniforme, accordant un poids significatif à un cercle de voisins plus large sans changer l'ordre de proximité. Ils ont mené des milliers d'expériences sur des ensembles de données réels, incluant des images de chiffres écrits à la main et des données génétiques de cellules cérébrales de souris, pour voir comment ces ajustements modifiaient les cartes finales.

Les résultats ont révélé un compromis clair qui dépend de l'échelle du voisinage examiné. Lorsque les chercheurs accentuaient les instructions, l'outil devenait exceptionnellement bon pour maintenir ensemble les voisins les plus proches, mais perdait sa capacité à maintenir les groupes locaux plus larges en place. Inversement, lorsqu'ils adoucissaient les instructions, l'outil améliorait sa capacité à préserver ces voisinages locaux plus larges. Les cartes adoucies montraient une séparation plus claire entre les différents groupes de données, empênant les groupes distincts de fusionner en un amas informe au centre de l'image. Crucialement, les chercheurs ont découvert que cette amélioration ne pouvait pas être obtenue simplement en demandant à l'outil standard de regarder plus de voisins en augmentant son réglage de perplexité. Changer la perplexité affecte chaque point de la même manière, mais la technique de lissage permet à l'outil de s'adapter différemment pour chaque point, créant une représentation plus nuancée et précise de la structure locale des données.

L'étude suggère que la manière dont t-SNE pondère ses voisins est un facteur critique, bien que souvent négligé, dans la façon dont il visualise les données. En lissant la matrice d'affinité, les chercheurs ont montré qu'il est possible d'améliorer la préservation des structures locales de portée intermédiaire sans sacrifier la vitesse ou l'évolutivité de l'outil. Cela ne signifie pas que la méthode standard est défaillante, mais plutôt qu'elle possède un biais spécifique envers les voisins les plus proches qui peut être ajusté. Pour les scientifiques qui doivent inspecter les détails fins des sous-structures de clusters, ou pour ceux qui veulent voir comment différents groupes se rapportent les uns aux autres à une échelle plus large, cette technique de lissage offre un moyen léger de déplacer le focus de la visualisation. Ce travail confirme que la qualité de ces cartes de données ne dépend pas seulement de l'optimisation de l'algorithme, mais aussi de la manière dont les relations initiales entre les points de données sont définies, offrant un nouveau levier aux chercheurs lorsqu'ils ont besoin que leurs cartes racontent une histoire plus complète.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →