← Últimos artículos
💰 quantitative finance

A multi-view contrastive learning framework for spatial embeddings in risk modelling

Este artículo propone un novedoso marco de aprendizaje contrastivo de múltiples vistas que genera incrustaciones espaciales de baja dimensión a partir de imágenes satelitales y datos de OpenStreetMap para mejorar la precisión predictiva y la interpretabilidad de los modelos de riesgo en aplicaciones de seguros y bienes raíces.

Autores originales: Freek Holvoet, Christopher Blier-Wong, Katrien Antonio

Publicado 2026-08-19
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Freek Holvoet, Christopher Blier-Wong, Katrien Antonio

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina intentar comprender el carácter de un lugar simplemente mirando un punto en un mapa. Durante décadas, las compañías de seguros y los analistas inmobiliarios han hecho exactamente esto, tratando una ubicación simplemente como un par de números: latitud y longitud. Esperaban que estas coordenadas les dijeran todo lo que necesitaban saber sobre el riesgo o el valor de una propiedad. Pero un punto en un mapa es silencioso; no sabe si se encuentra en un bullicioso centro urbano, en un tranquilo valle rural o en la ribera de un río propenso a inundaciones. No puede ver las tiendas cercanas, el tipo de edificios o la textura del paisaje. Cuando los analistas dependen únicamente de estos números brutos, sus modelos suelen perderse los sutiles patrones del mundo real que definen cómo viven las personas y cómo se comporta la naturaleza. Terminan trazando líneas artificiales y cuadradas alrededor de riesgos que fluyen suavemente a través de la tierra, de forma muy parecida a intentar describir un río serpenteante dibujando una serie de escalones rectos y rectangulares.

Para resolver esto, los investigadores han comenzado a utilizar una técnica llamada "embedding" (incrustación). Piensa en un embedding como una huella digital para un lugar. En lugar de ser solo un par de números, una ubicación se representa mediante una breve lista de valores que capturan su esencia: cómo se ve, qué la rodea y cómo encaja en el mundo circundante. Este artículo presenta una nueva forma de crear estas huellas digitales enseñando a una computadora a mirar un lugar desde múltiples ángulos a la vez. Los investigadores combinaron imágenes satelitales, que muestran la forma física del terreno, con mapas digitales de actividad humana, como la ubicación de escuelas, tiendas y parques. Al entrenar a una computadora para que vincule estas pistas visuales y contextuales con las coordenadas geográficas exactas, crearon un sistema que puede generar una descripción rica y detallada de cualquier ubicación utilizando únicamente su latitud y longitud.

El equipo, liderado por Freek Holvoet y colegas, construyó un conjunto de datos masivo de casi 96,000 ubicaciones en toda Europa. Para cada punto, recopilaron una foto satelital y un recuento detallado de servicios cercanos de un proyecto de mapa global. Luego, entrenaron un modelo computacional para que aprendiera la conexión entre los datos visuales y contextuales y las coordenadas específicas de ese punto. El modelo aprendió a decir: "Este patrón de edificios y espacios verdes pertenece a estas coordenadas específicas". Una vez que el modelo aprendió esta relación, pudo olvidar las imágenes y los mapas por completo. A partir de ese momento, podía tomar solo un par de coordenadas para cualquier nueva ubicación y generar instantáneamente una huella digital compleja que contenía toda la información aprendida sobre el entorno de ese lugar.

Los investigadores probaron este sistema en dos escenarios del mundo real muy diferentes. Primero, analizaron los precios de la vivienda en Francia. Compararon los modelos estándar que utilizaban solo coordenadas brutas frente a los modelos que utilizaban estas nuevas huellas digitales. Los resultados fueron claros: los modelos que utilizaban las huellas digitales predecían los precios con mucha más precisión. Más importante aún, los nuevos modelos podían "ver" el paisaje de una manera que los antiguos no podían. Cuando los investigadores visualizaron las predicciones, los modelos antiguos producían mapas de bloques antinaturales donde los precios saltaban abruptamente en líneas invisibles. Los nuevos modelos produjeron mapas suaves y realistas que identificaban correctamente las zonas de alto valor alrededor de París y en los Alpes, reconociendo al mismo tiempo los valores más bajos en las regiones rurales. Incluso demostraron que el sistema podía realizar predicciones sensatas en áreas donde nunca había visto una sola venta de vivienda, simplemente porque comprendía el carácter geográfico de esas regiones.

En una segunda prueba, el equipo aplicó el método al seguro contra inundaciones en Bélgica. Analizaron miles de reclamaciones de inundaciones para ver si las huellas digitales podían ayudar a clasificar las zonas por riesgo. Nuevamente, los modelos que utilizaban las huellas digitales superaron a aquellos que utilizaban las coordenadas brutas. Fueron mejores para distinguir entre vecindarios de alto y bajo riesgo, capturando la verdadera forma de las zonas de peligro a lo largo de los valles de los ríos, en lugar de forzarlas en cajas artificiales. El estudio también mostró que estas huellas digitales podían generarse en menos de un milisegundo, lo que las hace lo suficientemente rápidas como para usarse en la tarificación diaria de seguros.

Este trabajo sugiere que el futuro del análisis de riesgos reside en dotar a las computadoras de un sentido de lugar más rico. Al enseñar a las máquinas que una ubicación no es solo un punto en el espacio, sino un lugar con un contexto visual y social específico, los analistas pueden construir modelos que sean más precisos y más justos. Los investigadores demostraron que estas herramientas pueden entrenarse en computadoras estándar y adaptarse a diferentes regiones, ofreciendo una forma práctica de mejorar cómo calculamos los seguros y gestionamos el riesgo sin necesidad de acceder a datos sensibles o patentados para cada uno de los cálculos. El resultado es un sistema que ve el mundo más como lo hace un humano, entendiendo que dónde estás importa, pero lo que te rodea importa tanto como eso.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →