← Últimos artículos
🔭 astrophysics

Galaxy Morphology Classification: Uncertainty Modeling and Out of Distribution Detection

Este artículo presenta un marco integral para la clasificación de la morfología de galaxias utilizando el conjunto de datos Galaxy Zoo DECaLS que combina la función de pérdida IsoMaxPlus con el Dropout de Monte Carlo para mejorar significativamente la detección de datos fuera de distribución y la cuantificación de la incertidumbre, manteniendo al mismo tiempo una alta precisión en la clasificación.

Autores originales: Prem Prakash, Shantanu Desai, P. K. Srijith

Publicado 2026-08-18
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Prem Prakash, Shantanu Desai, P. K. Srijith

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

El universo está lleno de miles de millones de galaxias, cada una de ellas una vasta isla de estrellas, gas y polvo. Durante casi un siglo, los astrónomos han clasificado estas islas cósmicas en familias basadas en sus formas: algunas son suaves y redondeadas como gigantescas bolas de luz, mientras que otras son espirales planas con brazos sinuosos. Esta clasificación, conocida como clasificación morfológica, no es solo una cuestión de catalogación; la forma de una galaxia cuenta una historia sobre su historia, cómo se formó y cómo ha cambiado con el tiempo. Sin embargo, a medida que los telescopios modernos capturan imágenes del cielo con una claridad y un volumen sin precedentes, la cantidad de galaxias se ha vuelto demasiado grande para que los ojos humanos las examinen una por una. Para mantener el ritmo, los científicos han recurrido a la inteligencia artificial, enseñando a las computadoras a reconocer estas formas automáticamente. Pero hay un inconveniente: los programas informáticos estándar suelen ser excesivamente confiados. Cuando encuentran una galaxia que parece extraña o distinta a cualquier cosa que hayan visto antes, la fuerzan en una categoría conocida y afirman estar seguros, ocultando potencialmente descubrimientos raros o nuevos tras un muro de falsa confianza.

Un equipo de investigadores del Instituto Indio de Tecnología de Hyderabad se propuso solucionar este problema construyendo una forma más inteligente para que las computadoras clasifiquen galaxias. Se centraron en un desafío específico llamado detección de "fuera de la distribución" (out-of-distribution), que es simplemente la capacidad de reconocer cuándo una imagen no pertenece a los grupos conocidos. Utilizando una colección masiva de imágenes de galaxias de la Dark Energy Camera Legacy Survey, entrenaron un sistema de aprendizaje profundo para no solo identificar las nueve formas estándar de las galaxias, sino también para admitir cuando no estaba seguro. Los investigadores probaron tres enfoques diferentes. El primero fue un método estándar utilizado como base. El segundo introdujo una nueva técnica que mide qué tan lejos están las características de una galaxia del centro de su grupo conocido, en lugar de simplemente adivinar una categoría. El tercero combinó esta medición de distancia con un método que ejecuta la misma imagen a través del cerebro de la computadora varias veces con ligeras variaciones, permitiendo al sistema calibrar su propia incertidumbre.

Los resultados mostraron que los nuevos métodos eran muy superiores al enfoque estándar. El sistema que utilizó la técnica basada en la distancia se volvió significativamente mejor para detectar galaxias inusuales, mejorando su capacidad para identificarlas correctamente como "desconocidas" en casi un 90 por ciento en comparación con la base, mientras seguía identificando correctamente las formas conocidas con un 97 por ciento de precisión. Crucialmente, este sistema aprendió a ser humilde. Cuando encontraba una galaxia que era difícil de clasificar o que parecía una mezcla de diferentes tipos, no forzaba una etiqueta. En su lugar, señalaba la incertidumbre, a menudo mostrando que la galaxia estaba lejos del centro de cualquier grupo de formas conocidas. Este comportamiento es vital para los futuros sondeos del cielo, donde el objetivo no es solo contar lo que conocemos, sino encontrar lo raro, lo extraño y lo previamente no visto.

Los investigadores también descubrieron que combinar el método de distancia con la técnica de múltiples pasadas hacía que el sistema fuera aún más fiable. Al ejecutar la imagen a través de la red muchas veces, la computadora podía ver si su respuesta cambiaba ligeramente con cada pasada. Si la respuesta vacilaba, el sistema sabía que estaba lidiando con algo ambiguo. Este enfoque redujo el error en las puntuaciones de confianza del sistema en aproximadamente un 73 por ciento, lo que significa que cuando la computadora decía que estaba segura, lo estaba genuinamente segura, y cuando decía que no estaba segura, estaba identificando correctamente un caso difícil. El estudio demostró que, al cambiar la forma en que la computadora mide la similitud —enfocándose en la distancia geométrica en lugar de solo la probabilidad—, podía crear una separación más clara entre las galaxias familiares y aquellas que son verdaderamente nuevas o extrañas.

Este trabajo no solo mejora la velocidad de clasificación; cambia la fiabilidad de todo el proceso. En el pasado, un sistema automatizado podría haber etiquetado erróneamente y con confianza una galaxia rara en proceso de fusión como una espiral común, borrando efectivamente un evento cósmico único del registro. El nuevo marco asegura que tales anomalías sean señaladas para la revisión humana. Los investigadores verificaron que la computadora estaba prestando atención a las partes correctas de las imágenes, como los brazos espirales o los bulbos centrales, en lugar de ruido aleatorio o artefactos de fondo. Cuando el sistema cometía un error, era a menudo porque la galaxia misma era confusa, con características que se mezclaban, y el sistema reflejaba correctamente esta confusión mediante una mayor incertidumbre.

Las implicaciones para la astronomía son significativas. Los próximos telescopios capturarán pronto imágenes de miles de millones de galaxias, un volumen que hace imposible la comprobación manual. Tener una herramienta que pueda clasificar automáticamente lo conocido mientras señala de manera fiable lo desconocido es esencial para descubrir la próxima generación de fenómenos cósmicos. Los investigadores señalaron que, si bien su método es altamente efectivo, requiere más potencia de cálculo para ejecutar las múltiples comprobaciones necesarias para la incertidumbre. Sin embargo, argumentan que este costo es un precio pequeño a pagar por la capacidad de confiar en el catálogo automatizado y asegurar que ninguna galaxia extraña o rara pase desapercibida. Al enseñar a las máquinas a reconocer los límites de su propio conocimiento, los astrónomos pueden finalmente dejar que las computadoras se encarguen del trabajo rutinario mientras centran su propia atención en los objetos más misteriosos y fascinantes del universo.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →