← Últimos artículos
🧠 neuroscience

Cross-cue reconstruction of perceived 3D object structure from human visual cortex

Este estudio demuestra que la actividad de la fMRI en la corteza visual humana puede decodificarse para reconstruir estructuras de objetos 3D explícitas que son invariantes a las pistas de profundidad, generalizando con éxito desde imágenes de entrenamiento 2D hacia nuevos estímulos estereoscópicos 3D y, de este modo, externalizando el modelo de mundo 3D interno del cerebro.

Autores originales: Aoki, S. C., Tsukasa, R., Yang, S., Tanaka, M., Doi, E., Nakamura, T., Ho, J.-K., Kamitani, Y.

Publicado 2026-06-15
📖 4 min de lectura☕ Lectura para el café

Autores originales: Aoki, S. C., Tsukasa, R., Yang, S., Tanaka, M., Doi, E., Nakamura, T., Ho, J.-K., Kamitani, Y.

Artículo original bajo licencia CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ⚕️ Esta es una explicación generada por IA de un preprint que no ha sido revisado por pares. No es consejo médico. No tome decisiones de salud basándose en este contenido. Leer descargo de responsabilidad completo

Imagina que tu cerebro es como un maestro chef que puede probar una sopa y decirte exactamente qué ingredientes contiene, incluso si solo le das una sola cucharada. Pero en lugar de sopa, los "ingredientes" son las formas 3D de los objetos en el mundo, y la "cucharada" es la actividad eléctrica en tu cerebro.

Durante mucho tiempo, los científicos supieron que nuestros cerebros construyen una imagen 3D del mundo utilizando diferentes "pistas" (como las sombras, cómo se mueven nuestros ojos o cómo se superponen los objetos). Sin embargo, no podían ver la imagen 3D final que el cerebro crea porque está oculta dentro de nuestras cabezas. Podían ver las pistas, pero no el resultado.

Este artículo es como encontrar un anillo decodificador mágico que traduce esas señales cerebrales ocultas de nuevo en un objeto 3D visible. Así es como lo hicieron, usando una analogía simple:

El Traductor y el Plano
Piensa en los investigadores como si estuvieran construyendo una máquina de dos partes:

  1. El Traductor (El Decodificador): Esta parte aprende a leer las señales de fMRI de tu cerebro (el "ruido eléctrico" del cerebro) y las traduce en un código secreto. Este código no es una imagen; es una lista de instrucciones matemáticas que describen la forma de un objeto, como un plano para un modelo 3D.
  2. El Constructor (El Generador): Esta parte toma ese plano secreto y construye un modelo físico 3D a partir de miles de diminutos puntos (una "nube de puntos"), tal como una impresora 3D creando una escultura a partir de un archivo digital.

Las Tres Pruebas Difíciles
Para demostrar que esta máquina realmente estaba leyendo la forma y no solo adivinando, la sometieron a tres exámenes cada vez más difíciles:

  1. La Prueba del "Nuevo Sabor": Entrenaron a la máquina solo con imágenes de objetos cotidianos (como tazas y sillas). Luego, le mostraron escaneos cerebrales de objetos que nunca había visto antes (como un juguete alienígena extraño). La máquina construyó con éxito la forma 3D del nuevo objeto. No solo memorizó las formas antiguas; aprendió el lenguaje de las formas 3D.
  2. La Prueba de las "Gafas Mágicas": Esta fue la grande. Entrenaron a la máquina con imágenes planas en 2D. Luego, le mostraron escaneos cerebrales de personas mirando Estereogramas de Puntos Aleatorios (RDS). Estos son imágenes que parecen estática para el ojo humano, pero si las miras con gafas especiales (o cruzas los ojos), una forma 3D aparece. Crucialmente, la imagen 2D en la pantalla no tenía forma alguna; era solo ruido. Sin embargo, la máquina construyó la forma 3D correcta. Esto demostró que la máquina estaba leyendo la percepción 3D del cerebro, no solo copiando la imagen plana de la pantalla.
  3. La Prueba de la "Inclinación": Le mostraron a la máquina dos imágenes que parecían idénticas desde el frente (mismo contorno), pero una estaba inclinada de forma diferente en el espacio 3D. La máquina construyó correctamente el objeto con la inclinación específica, demostrando que comprendía la geometría de la profundidad, no solo el contorno 2D.

Donde Ocurre la Magia
Los investigadores descubrieron que esta "traducción" funcionaba mejor en la parte posterior y superior del cerebro (la vía dorsal), que es conocida por manejar la información espacial.

La Conclusión
Este estudio muestra que ahora podemos "externalizar" lo que el cerebro ve. Podemos tomar el modelo 3D invisible que tu cerebro construye a partir de diferentes pistas y convertirlo en un objeto 3D visible en la pantalla de una computadora. Es un paso hacia la lectura del "modelo de mundo" interno de tu cerebro: la forma en que tu cerebro predice cómo se ve el mundo, incluso cuando los datos brutos que llegan a tus ojos son incompletos o confusos.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →