Striatal interneuron microcircuits gate reinforcement to stabilize adaptive choice
Este estudio identifica un microcircuito desinhibidor en el estriado dorsomedial que involucra interneuronas de tirosina hidroxilasa y somatostatina que regula las señales de refuerzo para transformar los resultados inmediatos de los ensayos en políticas conductuales estables y adaptativas.
Artículo original bajo licencia CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA de un preprint que no ha sido revisado por pares. No es consejo médico. No tome decisiones de salud basándose en este contenido. Leer descargo de responsabilidad completo
Cada día, tomamos innumerables pequeñas decisiones, desde decidir qué ruta tomar para ir al trabajo hasta elegir un plato de un menú. Algunas de estas elecciones se aprenden mediante el ensayo y error, un proceso en el que nuestro cerebro sopesa el éxito o el fracaso de una acción frente al resultado que esta produjo. Este aprendizaje ocurre en una región específica del cerebro llamada estriado, una estructura profunda que actúa como un centro de procesamiento de información sobre recompensas y castigos. Dentro de este centro, un tipo de célula nerviosa conocida como neurona de proyección espinosa actúa como el mensajero principal, enviando señales que impulsan nuestro comportamiento hacia adelante. Los científicos han comprendido durante mucho tiempo que estas células mensajeras están controladas por entradas excitatorias, pero el papel de las células inhibitorias locales —aquellas que actúan como frenos o filtros dentro del propio estriado— ha seguido siendo un misterio. Comprender cómo funcionan estos frenos locales es crucial porque podrían ser la clave de cómo adaptamos nuestros hábitos cuando las reglas del mundo camben, pasando de una estrategia exitosa a una nueva cuando nuestras viejas formas de actuar dejan de funcionar.
Un equipo de investigadores dirigió recientemente su atención al estriado dorsomedial para descubrir cómo estos circuitos inhibitorios locales influyen en el aprendizaje. Se centraron en un tipo específico de tarea de aprendizaje en la que un animal tenía que presionar o tirar de una palanca para obtener una recompensa, pero las reglas del juego cambiaban ocasionalmente. A veces, presionar era el movimiento correcto, y otras veces lo era tirar, y el animal tenía que descubrir el cambio basándose en si recibía una recompensa o no. Al observar la actividad de diferentes células nerviosas inhibitorias durante este proceso, los científicos descubrieron un circuito interno preciso que vincula el resultado inmediato de un solo ensayo con la estrategia más amplia que el animal utiliza para tomar decisiones. Descubrieron que dos tipos específicos de células inhibitorias, distinguidas por las proteínas que contienen, reaccionan de formas opuestas ante los mismos eventos. Un tipo, que contiene una proteína llamada somatostatina, se activa cuando un ensayo sale mal o cuando una recompensa llega de forma inesperada. El otro tipo, que contiene tirosina hidroxilasa, hace lo contrario: se silencia cuando un ensayo falla y entra en acción cuando se recibe una recompensa.
Los investigadores mapearon entonces cómo estos dos tipos de células se comunican entre sí y con las células mensajeras principales. Descubrieron que cuando las células de tirosina hidroxilasa están activas, suprimen las células de somatostatina. Esta supresión elimina un freno, permitiendo que las células mensajeras principales se disparen con mayor libertad. Esta cadena de eventos crea una vía donde un buen resultado desencadena una secuencia específica que potencia la actividad de las células responsables de impulsar la acción. Para probar si este circuito era realmente necesario para el aprendizaje, los científicos silenciaron temporalmente estas células en animales vivos. Cuando impidieron que las células de somatostatina funcionaran, los animales comenzaron a tomar la decisión equivocada repetidamente, aferrándose a una estrategia subóptima incluso cuando esta ya no era provechosa. Por el contrario, cuando silenciaron las células de tirosina hidroxilasa, los animales tuvieron dificultades para aprender de las recompensas positivas, fallando al reforzar el comportamiento correcto. Estos experimentos demostraron que este microcircuito específico actúa como una compuerta, decidiendo si el cerebro debe actualizar su comportamiento basándose en el resultado de un solo ensayo.
El estudio también analizó qué sucede dentro de las células después de que estos cambios de comportamiento ocurren. Cuando se inhibieron las células de somatostatina, los investigadores observaron que las conexiones entre las entradas excitatorias y las células mensajeras principales se fortalecían con el tiempo. Este fortalecimiento sugiere un cambio físico en el cableado del cerebro que podría explicar por qué los animales seguían tomando la misma decisión errónea mucho después de que terminara el experimento. Los hallazgos indican que este circuito desinhibidor hace más que simplemente reaccionar a un evento único; transforma el resultado inmediato de un ensayo en un cambio duradero de política. Al controlar el flujo de refuerzo a través de este bucle local específico, el cerebro puede estabilizar las elecciones adaptativas, asegurando que aprendamos de nuestros éxitos y fracasos de una manera que guíe nuestras acciones futuras.
¿Ahogado en artículos de tu campo?
Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.