A multi-view contrastive learning framework for spatial embeddings in risk modelling
Dieses Paper schlägt ein neuartiges Multi-View-Contrastive-Learning-Framework vor, das aus Satellitenbildern und OpenStreetMap-Daten niedrigdimensionale räumliche Einbettungen generiert, um die Vorhersagegenauigkeit und Interpretierbarkeit von Risikomodellen in Versicherungs- und Immobilienanwendungen zu verbessern.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Stellen Sie sich vor, Sie versuchen, den Charakter eines Ortes zu verstehen, indem Sie nur auf einen Punkt auf einer Karte schauen. Jahrzehntelang haben Versicherungsgesellschaften und Immobilienanalysten genau das getan, indem sie einen Standort einfach als ein Paar Zahlen behandelten: Breitengrad und Längengrad. Sie hofften, dass diese Koordinaten ihnen alles sagen würden, was sie über das Risiko oder den Immobilienwert wissen mussten. Doch ein Punkt auf einer Karte schweigt; er weiß nicht, ob er in einem belebten Stadtzentrum, einem ruhigen ländlichen Tal oder an einem hochwassergefährdeten Flussufer liegt. Er kann die nahegelegenen Geschäfte, die Art der Gebäude oder die Textur der Landschaft nicht sehen. Wenn Analysten sich nur auf diese Rohzahlen verlassen, übersehen ihre Modelle oft die subtilen, realen Muster, die bestimmen, wie Menschen leben und wie die Natur sich verhält. Sie ziehen am Ende künstliche, kastenartige Linien um Risiken, die fließend über das Land verlaufen, ganz so, als würde man versuchen, einen gewundenen Fluss zu beschreiben, indem man eine Reihe von geraden, rechteckigen Stufen zeichnet.
Um dies zu lösen, haben Forscher begonnen, eine Technik namens „Embedding“ einzusetzen. Stellen Sie sich ein Embedding als einen digitalen Fingerabdruck eines Ortes vor. Anstatt nur eines Paares von Zahlen wird ein Standort durch eine kurze Liste von Werten repräsentiert, die sein Wesen erfassen: wie er aussieht, was ihn umgibt und wie er in die weitere Welt passt. Dieses Paper stellt eine neue Methode vor, um diese Fingerabdrücke zu erstellen, indem ein Computer lernt, einen Ort gleichzeitig aus mehreren Blickwinkeln zu betrachten. Die Forscher kombinierten Satellitenbilder, die die physische Gestalt des Landes zeigen, mit digitalen Karten menschlicher Aktivitäten, wie etwa dem Standort von Schulen, Geschäften und Parks. Indem sie einen Computer darauf trainierten, diese visuellen und kontextuellen Hinweise mit den exakten geografischen Koordinaten abzugleichen, schufen sie ein System, das in der Lage ist, eine reiche, detaillierte Beschreibung eines jeden Ortes allein unter Verwendung seines Breitengrades und Längengradess zu generieren.
Das Team unter der Leitung von Freek Holvoet und Kollegen baute einen massiven Datensatz von fast 96.000 Standorten in ganz Europa auf. Für jeden Punkt sammelten sie ein Satellitenfoto und eine detaillierte Anzahl von Annehmlichkeiten aus einem globalen Kartenprojekt. Dann trainierten sie ein Computermodell, um die Verbindung zwischen den visuellen und kontextuellen Daten und den spezifischen Koordinaten dieses Punktes zu erlernen. Das Modell lernte zu sagen: „Dieses Muster aus Gebäuden und Grünflächen gehört zu diesen spezifischen Koordinaten.“ Sobald das Modell diese Beziehung gelernt hatte, konnte es die Bilder und Karten vollständig vergessen. Von diesem Zeitpunkt an konnte es lediglich ein Paar Koordinaten für einen neuen Standort nehmen und augenblicklich einen komplexen digitalen Fingerabdruck generieren, der alle gelernten Informationen über die Umgebung dieses Ortes enthielt.
Die Forscher testeten dieses System in zwei sehr unterschiedlichen realen Szenarien. Zuerst untersuchten sie Hauspreise in Frankreich. Sie verglichen Standardmodelle, die nur Rohkoordinaten verwendeten, mit Modellen, die die neuen digitalen Fingerabdrücke nutzten. Die Ergebnisse waren eindeutig: Die Modelle, die die Fingerabdrücke verwendeten, sagten Preise wesentlich genauer voraus. Viel wichtiger war, dass die neuen Modelle die Landschaft auf eine Weise „sehen“ konnten, die die alten nicht konnten. Als die Forscher die Vorhersagen visualisierten, erzeugten die alten Modelle blockartige, unnatürliche Karten, auf denen die Preise abrupt an unsichtbaren Linien sprangen. Die neuen Modelle erzeugten glatte, realistische Karten, die wertvolle Gebiete um Paris und in den Alpen korrekt identifizierten, während sie gleichzeitig die niedrigeren Werte in ländlichen Regionen erkannten. Sie zeigten sogar, dass das System sinnvolle Vorhersagen für Gebiete treffen konnte, in denen es noch nie einen einzigen Hausverkauf gesehen hatte, einfach weil es den geografischen Charakter dieser Regionen verstanden hatte.
In einem zweiten Test wandte das Team die Methode auf die Hochwasserversicherung in Belgien an. Sie analysierten Tausende von Hochwasserfällen, um zu sehen, ob die digitalen Fingerabdrücke helfen könnten, Gebiete nach Risiko zu sortieren. Auch hier übertrafen die Modelle, die die Fingerabdrücke verwendeten, jene, die mit Rohkoordinaten arbeiteten. Sie waren besser darin, zwischen Hochrisiko- und Niedrigrisikogebieten zu unterscheiden, indem sie die wahre Form der Gefahrenzonen entlang der Flusstäler erfassten, anstatt sie in künstliche Kästen zu zwängen. Die Studie zeigte auch, dass diese digitalen Fingerabdrücke in weniger als einer Millisekunde generiert werden konnten, was sie schnell genug macht, um sie in der alltäglichen Versicherungsberechnung einzusetzen.
Diese Arbeit legt nahe, dass die Zukunft der Risikoanalyse darin liegt, Computern einen reicheren Sinn für den Ort zu geben. Indem man Maschinen lehrt, zu verstehen, dass ein Standort nicht nur ein Punkt im Raum ist, sondern ein Ort mit einem spezifischen visuellen und sozialen Kontext, können Analysten Modelle bauen, die genauer und fairer sind. Die Forscher demonstrierten, dass diese Werkzeuge auf Standardcomputern trainiert und an verschiedene Regionen angepasst werden können, was einen praktischen Weg bietet, wie wir unsere Versicherungen bepreisen und Risiken verwalten können, ohne für jede einzelne Berechnung auf sensible oder geschützte Daten zugreifen zu müssen. Das Ergebnis ist ein System, das die Welt eher so sieht wie ein Mensch: Es versteht, dass es zwar darauf ankommt, wo man ist, aber was einen umgibt, ebenso entscheidend ist.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.