A multi-view contrastive learning framework for spatial embeddings in risk modelling
Cet article propose un nouveau cadre d'apprentissage contrastif multi-vues qui génère des plongements spatiaux de faible dimension à partir de l'imagerie satellitaire et des données OpenStreetMap afin d'améliorer la précision prédictive et l'interprétabilité des modèles de risque dans les applications d'assurance et d'immobilier.
Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète
Imaginez essayer de comprendre le caractère d'un lieu simplement en regardant un point sur une carte. Pendant des décennies, les compagnies d'assurance et les analystes immobiliers ont fait exactement cela, traitant un emplacement comme un simple couple de chiffres : la latitude et la longitude. Ils espéraient que ces coordonnées leur diraient tout ce qu'ils avaient besoin de savoir sur le risque ou la valeur d'une propriété. Mais un point sur une carte est silencieux ; il ne sait pas s'il se trouve dans un centre-ville animé, une vallée rurale paisible ou sur la rive d'une rivière sujette aux inondations. Il ne peut pas voir les boutiques à proximité, le type de bâtiments ou la texture du paysage. Lorsque les analystes s'appuient uniquement sur ces chiffres bruts, leurs modèles passent souvent à côté des motifs subtils et réels qui définissent la façon dont les gens vivent et dont la nature se comporte. Ils finissent par tracer des lignes artificielles et rectangulaires autour de risques qui circulent de manière fluide à travers la terre, un peu comme si l'on essayait de décrire une rivière sinueuse en dessinant une série de marches droites et rectangulaires.
Pour résoudre ce problème, des chercheurs ont commencé à utiliser une technique appelée « plongement » (embedding). Considérez un plongement comme une empreinte digitale numérique pour un lieu. Au lieu de n'être qu'un couple de chiffres, un emplacement est représenté par une courte liste de valeurs qui capturent son essence : ce à quoi il ressemble, ce qui l'entoure et comment il s'insère dans le monde plus large. Ce document présente une nouvelle façon de créer ces empreintes en apprenant à un ordinateur à observer un lieu sous plusieurs angles à la fois. Les chercheurs ont combiné des images satellites, qui montrent la forme physique du terrain, avec des cartes numériques de l'activité humaine, telles que l'emplacement des écoles, des magasins et des parcs. En apprenant à un ordinateur à faire correspondre ces indices visuels et contextuels avec les coordonnées géographiques exactes, ils ont créé un système capable de générer une description riche et détaillée de n'importe quel lieu en utilisant uniquement sa latitude et sa longitude.
L'équipe, dirigée par Freek Holvoet et ses collègues, a construit un ensemble de données massif de près de 96 000 localisations à travers l'Europe. Pour chaque endroit, ils ont rassemblé une photo satellite et un décompte détaillé des commodités à proximité à partir d'un projet de cartographie mondiale. Ils ont ensuite entraîné un modèle informatique pour apprendre la connexion entre les données visuelles et contextuelles et les coordonnées spécifiques de cet endroit. Le modèle a appris à dire : « Ce motif de bâtiments et d'espaces verts appartient à ces coordonnées spécifiques ». Une fois que le modèle a appris cette relation, il pouvait oublier entièrement les images et les cartes. À partir de ce moment, il pouvait prendre simplement un couple de coordonnées pour tout nouveau lieu et générer instantanément une empreinte digitale numérique complexe contenant toute l'information apprise sur les environs de ce lieu.
Les chercheurs ont testé ce système dans deux scénarios réels très différents. Premièrement, ils ont étudié les prix de l'immobilier en France. Ils ont comparé les modèles standards qui n'utilisaient que les coordonnées brutes avec des modèles utilisant les nouvelles empreintes digitales. Les résultats étaient clairs : les modèles utilisant les empreintes prédisaient les prix avec beaucoup plus de précision. Plus important encore, les nouveaux modèles pouvaient « voir » le paysage d'une manière que les anciens ne pouvaient pas. Lorsque les chercheurs ont visualisé les prédictions, les anciens modèles produisaient des cartes par blocs et non naturelles où les prix sautaient brusquement à des lignes invisibles. Les nouveaux modèles produisaient des cartes fluides et réalistes, identifiant correctement les zones de haute valeur autour de Paris et dans les Alpes, tout en reconnaissant les valeurs plus faibles dans les régions rurales. Ils ont même montré que le système pouvait faire des prédictions sensées pour des zones où il n'avait jamais vu une seule vente immobilière, simplement parce qu'il comprenait le caractère géographique de ces régions.
Dans un second test, l'équipe a appliqué la méthode à l'assurance contre les inondations en Belgique. Ils ont analysé des milliers de sinistres liés aux inondations pour voir si les empreintes digitales numériques pouvaient aider à classer les zones par risque. Là encore, les modèles utilisant les empreintes digitales ont surpassé ceux utilisant les coordonnées brutes. Ils étaient plus aptes à distinguer les quartiers à haut risque des quartiers à faible risque, capturant la véritable forme des zones de danger le long des vallées fluviales plutôt que de les forcer dans des boîtes artificielles. L'étude a également montré que ces empreintes digitales numériques pouvaient être générées en moins d'une milliseconde, ce qui les rend assez rapides pour être utilisées dans la tarification quotidienne des assurances.
Ce travail suggère que l'avenir de l'analyse des risques réside dans le fait de donner aux ordinateurs un sens du lieu plus riche. En apprenant aux machines que un lieu n'est pas seulement un point dans l'espace, mais un endroit doté d'un contexte visuel et social spécifique, les analystes peuvent construire des modèles qui sont plus précis et plus équitables. Les chercheurs ont démontré que ces outils peuvent être entraînés sur des ordinateurs standards et adaptés à différentes régions, offrant un moyen pratique d'améliorer la façon dont nous évaluons les assurances et gérons les risques sans avoir besoin d'accéder à des données sensibles ou propriétaires pour chaque calcul individuel. Le résultat est un système qui voit le monde plus comme un humain, comprenant que l'endroit où vous êtes importe, mais que ce qui vous entoure importe tout autant.
Noyé(e) sous les articles dans votre domaine ?
Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.