← Derniers articles
🧠 neuroscience

A transformer-based model reveals sparse, stimulus-dependent orientation readout from macaque V1 population activity

Cette étude démontre qu'un modèle basé sur les transformers peut reconstruire avec précision l'orientation du stimulus à partir de l'activité de la population de V1 du macaque, révélant qu'un codage neural redondant soutient un mécanisme de lecture flexible, parcimonieux et dépendant du stimulus, médié par l'auto-attention.

Auteurs originaux : Wang, X., Tang, S., Yu, C.

Publié 2026-09-21
📖 6 min de lecture🧠 Analyse approfondie

Auteurs originaux : Wang, X., Tang, S., Yu, C.

Article original sous licence CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ⚕️ Ceci est une explication générée par l'IA d'un preprint qui n'a pas été évalué par des pairs. Ce n'est pas un avis médical. Ne prenez pas de décisions de santé basées sur ce contenu. Lire la clause de non-responsabilité complète

Le cortex visuel primaire, une fine couche de tissu située à l'arrière du cerveau, agit comme la première grande station de traitement de tout ce que nous voyons. Lorsque la lumière frappe l'œil, les signaux voyagent vers cette région, où des millions de neurones individuels s'activent en réponse à des caractéristiques spécifiques du monde visuel. L'une des propriétés les plus fondamentales que ces neurones détectent est l'orientation : l'angle sous lequel une ligne ou un bord est incliné. Des décennies de recherche ont montré que ces neurones ne sont pas uniformes ; chacun possède un angle préféré, tel un minuscule aiguille de boussole pointant dans une direction spécifique. Cependant, le cerveau ne repose pas sur un seul neurone pour nous dire quel angle il observe. Au lieu de cela, un stimulus visuel active une vaste foule chevauchante de milliers de neurones, chacun ayant des préférences légèrement différentes et des niveaux d'activité variables. Cela crée un code complexe et redondant où la même information est dispersée à travers une large population. Le grand mystère pour les neuroscientifiques a longtemps été de savoir comment le cerveau parvient à filtrer cette foule massive et bruyante pour extraire une réponse unique et précise sur le monde. Si chaque neurone contribue un peu, comment le cerveau décide-t-il d'écouter les uns plutôt que les autres, et écoute-t-il tous ces neurones de manière égale ?

Pour résoudre cette énigme, les chercheurs se sont tournés vers un nouvel outil puissant issu du domaine de l'intelligence artificielle : un modèle basé sur les « transformers ». Conçu à l'origine pour le traitement du langage, ce type de programme informatique est particulièrement efficace pour déterminer quelles parties d'une entrée complexe sont les plus importantes pour une tâche spécifique. L'équipe, dirigée par des scientifiques de l'Université de Pékin et de l'Université du Zhejiang, a appliqué ce modèle à des données biologiques réelles. Ils ont enregistré l'activité de plus de 1 000 neurones simultanément dans le cortex visuel de sept macaques éveillés. Les singes voyaient des images simples de motifs rayés, connus sous le nom de stimuli de Gabor, à divers angles. Les chercheurs ont ensuite injecté les réponses calciques collectives de ces neurones dans leur modèle informatique, en lui demandant de reconstruire l'image exacte que le singe avait vue. Le but n'était pas seulement de voir si l'ordinateur pouvait deviner l'angle, mais d'observer comment il décidait à quels neurones prêter attention pendant le processus.

Les résultats ont été frappants. Le modèle informatique a reconstruit les images rayées avec une précision incroyable, capturant l'orientation des lignes avec une erreur moyenne de moins d'un degré. Ce niveau de précision surpassait de loin ce que les modèles informatiques plus simples pouvaient accomplir, prouvant que l'architecture transformer était particulièrement adaptée pour décoder ce signal biologique complexe. Mais la véritable percée est venue de l'observation de l'« esprit » du modèle. Tandis que l'ordinateur traitait les données, il générait une carte d'attention, montrant exactement quel poids il attribuait à chaque neurone lors de sa prise de décision. Les chercheurs ont découvert que le modèle ne traitait pas les 1 000 neurones comme des partenaires égaux. Au lieu de cela, pour un angle donné, la reconstruction était dominée par un groupe minuscule et épars de seulement deux ou trois neurones. Ces neurones spécifiques n'étaient pas choisis au hasard ; c'étaient ceux dont les angles préférés correspondaient à l'image présentée, et c'étaient ceux qui recevaient les signaux d'« attention » les plus forts du reste du réseau.

Cette découverte remet en question une hypothèse commune selon laquelle le cerveau devrait moyenner les signaux de milliers de neurones pour obtenir une image claire. L'étude suggère que, bien que le cerveau stocke l'information de manière redondante à travers une large population, il lit cette information de manière hautement sélective et flexible. Le modèle a révélé que ces neurones clés étaient spéciaux non seulement parce qu'ils aimaient le bon angle, mais aussi parce qu'ils étaient les plus indépendants de leurs voisins, présentant moins de bruit partagé ou de variabilité. De plus, le modèle a montré qu'il pouvait affiner les signaux de ces quelques neurones clés, augmentant efficacement le volume de l'information la plus utile tout en diminuant le bruit provenant du reste de la foule. Ce processus a permis au système d'extraire une orientation précise à partir d'une mer chaotique d'activité.

L'indice le plus convaincant de ce système flexible est venu d'une expérience de type « et si ». Les chercheurs ont retiré le petit groupe de neurones fortement pondérés du modèle et lui ont demandé d'essayer à nouveau. Au lieu d'échouer, le modèle s'est rapidement adapté. Il a recruté un nouvel ensemble différent de neurones de substitution possédant des propriétés similaires à celles des neurones retirés. Ces nouveaux neurones étaient également réglés sur le bon angle et ont été capables de reprendre la tâche de décodage de l'orientation avec la même haute précision. Cela démontre que le cerveau ne repose pas sur un ensemble fixe et immuable de neurones « stars ». Au contraire, la capacité de lire l'information visuelle est un processus dynamique, où une population redondante de cellules fournit un filet de sécurité, permettant au système de passer à d'autres sous-ensembles de neurones si nécessaire sans perdre en précision.

L'étude confirme que le cortex visuel fonctionne sur un principe de stockage redondant mais de lecture parcimonieuse et dépendante du stimulus. Le cerveau détient la même information à de nombreux endroits, assurant ainsi la robustesse, mais lorsqu'il doit prendre une décision, il concentre ses ressources sur un sous-ensemble très restreint et hautement efficace de la population. Ce mécanisme permet à la fois la stabilité d'un large réseau et la vitesse et la précision d'une lecture focalisée. En utilisant un modèle transformer pour décoder l'activité de réels neurones, les chercheurs ont ouvert une fenêtre claire sur la manière dont le cerveau pourrait résoudre le problème de l'extraction de détails spécifiques à partir d'un code massif et chevauchant. Les conclusions suggèrent que l'efficacité du cerveau ne provient pas d'un nombre moindre de neurones, mais d'une façon intelligente et flexible de choisir lesquels comptent le plus à un instant donné.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →