Image transmission through a multimode fibre in reflection mode with physics-guided deep learning towards ultrathin endoscopy
Este artículo presenta un marco de aprendizaje profundo guiado por la física que combina una matriz de transmisión de intensidad de valores reales reflejada con redes de restauración de imágenes para permitir la recuperación de imágenes en una sola toma y sin recuperación de fase a través de fibras multimodo en modo de reflexión, mejorando significamente la calidad de la imagen y la generalizabilidad para la endoscopia ultra delgada.
Artículo original bajo licencia CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA de un preprint que no ha sido revisado por pares. No es consejo médico. No tome decisiones de salud basándose en este contenido. Leer descargo de responsabilidad completo
Imagina intentar ver dentro del cuerpo humano sin realizar una incisión grande. Los médicos han dependido durante mucho tiempo de los endoscopios —tubos flexibles con cámaras— para observar pasajes estrechos como las vías respiratorias o los vasos sanguíneos. Sin embargo, obtener una imagen clara a través de un tubo que sea increíblemente delgado y flexible es un gran desafío de ingeniería. Los endoscopios delgados tradicionales suelen utilizar haces de miles de diminutos filamentos de vidrio, pero estos solo pueden producir imágenes con una textura similar a un panal de abejas y una nitidez limitada. Una alternativa más prometedora es un solo hilo ultra delgado de vidrio llamado fibra multimodo. Si bien esta fibra es lo suficientemente flexible como para retorcerse y girar a través de las esquinas más difíciles del cuerpo, dispersa la luz de forma tan profunda que, si se proyecta una imagen a través de ella, la luz que sale por el otro lado parece un desorden aleatorio de puntos brillantes. Durante años, los científicos han luchado por descifrar este desorden para recuperar la imagen original, especialmente cuando la fibra se utiliza en modo de "reflexión", donde el mismo hilo envía luz y captura la luz que rebota en el tejido.
Un equipo de investigadores del King's College London ha desarrollado ahora una nueva forma de resolver este rompecabezas, convirtiendo un moteado caótico de luz en una imagen clara en un solo instante. Su enfoque, detallado en un estudio reciente, combina un ingenioso cálculo basado en la física con un tipo de inteligencia artificial diseñada para limpiar imágenes. En lugar de intentar revertir la compleja dispersión de la luz de una sola vez, primero utilizan un mapa matemático para crear un boceto inicial borroso del objeto. Luego, una red informática especializada toma ese boceto y lo refina, rellenando los detalles faltantes y eliminando el ruido. Este proceso de dos pasos les permite ver a través de la fibra sin necesidad de equipos complejos para medir la fase de las ondas de luz, un requisito que ha dificultado la aplicación de métodos anteriores en entornos médicos reales.
Los investigadores construyeron un sistema en el que se envía un haz láser a través de una fibra multimodo de 2 metros de largo con un diámetro de núcleo de 600 micrómetros. En el extremo lejano, la luz golpea un objeto y rebota de regreso por la misma fibra. Debido a que la luz viaja de ida y vuelta, se dispersa dos veces, creando un patrón altamente complejo de puntos brillantes y oscuros en una cámara en el extremo cercano. Para dar sentido a esto, el equipo realizó primero un proceso de calibración. Proyectaron una serie de patrones conocidos sobre un espejo digital en la punta de la fibra y registraron cómo se dispersaba la luz en su camino de regreso. A partir de estas mediciones, construyeron una "matriz de transmisión de intensidad de valores reales reflejados". En términos sencillos, esto es una enorme tabla de consulta que predice cómo debería verse un patrón borroso y disperso para cualquier objeto dado, basándose puramente en la intensidad de la luz, sin necesidad de conocer la fase invisible de las ondas de luz.
Utilizando esta tabla de consulta, el sistema puede generar instantáneamente un primer intento de la imagen a partir de una sola captura de la luz dispersa. Esta imagen inicial no es perfecta; a menudo es granulosa y de bajo contraste, pero captura la forma básica y la disposición del objeto. Los investigadores luego introdujeron esta imagen tosca en cuatro tipos diferentes de redes de aprendizaje profundo, que son programas informáticos entrenados para reconocer y restaurar detalles visuales. Estas redes actúan como un editor digital, tomando el punto de partida granuloso y agudizando los bordes, aumentando el contraste y eliminando los puntos aleatorios para revelar una imagen clara. El equipo probó este método con tres conjuntos diferentes de imágenes: dígitos escritos a mano, fotos de ropa y escenas naturales. En todos los casos, la combinación de la tabla de consulta basada en la física y el limpiador de IA produjo resultados significativamente mejores que intentar que la IA adivinara la imagen a partir de la luz dispersa bruta por sí sola.
La verdadera prueba de este método llegó cuando los investigadores se preguntaron si podría manejar imágenes que nunca había visto. Entrenaron sus redes de IA utilizando solo imágenes de ropa, pero luego les pidieron que reconstruyeran imágenes de escenas naturales, como animales y paisajes, que se ven muy diferentes a la ropa. Cuando la IA intentaba hacer esto por su cuenta, sin la ayuda de la tabla de consulta basada en la física, los resultados eran pobres; el sistema no reconocía las nuevas formas y producía manchas borrosas e irreconocibles. Sin embargo, cuando la IA recibía primero el boceto tosco de la tabla de consulta, funcionaba notablemente bien. Logró reconstruir las escenas naturales, preservando la estructura de los objetos a pesar de no haber sido entrenada para ellos. Esto sugiere que el paso basado en la física proporciona una base sólida que ayuda a la IA a generalizar ante nuevas situaciones, en lugar de simplemente memorizar ejemplos específicos.
Para demostrar que el sistema funciona en el mundo real, los investigadores colocaron objetos físicos reales en la punta de la fibra, incluyendo una rejilla de ventilación metálica, una aguja de coser y una letra impresa. Estos objetos no formaban parte de ningún dato de entrenamiento. El sistema capturó la luz que rebotaba en estos elementos y, utilizando el mismo proceso de calibración e IA, reconstruyó imágenes claras de los agujeros de la rejilla, el eje de la aguja y los trazos de la letra. Los resultados fueron lo suficientemente nítidos como para distinguir detalles finos, demostrando que el método puede ir más allá de las simulaciones por computadora y manejar la naturaleza impredecible de la dispersión de la luz en el mundo real. Los investigadores señalaron que, aunque el sistema está actualmente limitado por la necesidad de recalibrarse si la fibra se dobla significamente o si cambia la temperatura, la capacidad de generar una imagen clara a partir de una sola captura sin mediciones de fase es un gran avance.
Este trabajo ofrece un camino prometedor hacia la endoscopia ultra delgada, donde una sonda tan fina como un cabello podría guiarse hacia las partes más profundas y estrechas del cuerpo para proporcionar imágenes de alta resolución en tiempo real. Al separar el problema en un primer paso guiado por la física y un segundo paso de limpieza basado en datos, los investigadores han creado un sistema que es tanto robusto como adaptable. No requiere los complejos montajes de interferometría que han obstaculizado intentos anteriores de imagen en modo de reflexión, lo que lo hace más práctico para el uso clínico. Los hallazgos sugieren que, al combinar la predictibilidad de la física con la adaptabilidad de la inteligencia artificial, los científicos pueden desbloquear el potencial de los endoscopios de fibra única, permitiendo potencialmente que los médicos vean dentro del cuerpo con un nivel de detalle y flexibilidad que antes era imposible.
¿Ahogado en artículos de tu campo?
Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.