← Neueste Arbeiten
🤖 machine learning

HERMES: Heterogeneous Edge-Relational Multi-Head Embedded SSM Attention for Traffic Conflict Prediction at Signalized Intersections

Dieses Paper schlägt HERMES vor, ein heterogenes, kantenbezogenes Graph-Neural-Network mit SSM-informierter Multi-Head-Attention, das Fahrzeuge und Fußgänger als Knoten sowie deren Interaktionen als relationsspezifische Kanten modelliert, um durch die effektive Erfassung heterogener Interaktionstopologien und sicherheitsbewusster zeitlicher Dynamiken eine leistungsstarke, übertragbare Vorhersage von Verkehrskonflikten an signalisierten Kreuzungen zu erreichen.

Ursprüngliche Autoren: Md Monzurul Islam, Subasish Das

Veröffentlicht 2026-07-24
📖 7 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Md Monzurul Islam, Subasish Das

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). ✨ Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, Sie beobachten eine belebte Straßenkreuzung aus einem hochgelegenen Fenster. Autos sausen vorbei, biegen ab und halten an, während Fußgänger durch die Zebrastreifen navigieren. Für einen Computer ist das kein chaotisches Durcheinander; es ist ein riesiges, bewegliches Puzzle, bei dem jedes Teilstück (ein Auto oder eine Person) ständig seine Meinung ändert und auf seine Nachbarn reagiert. Jahrzehntelang haben Experten für Verkehrssicherheit versucht vorherzusagen, wann diese Teile zusammenstoßen könnten. Früher warteten sie darauf, dass der eigentliche Unfall passierte, und untersuchten dann die Trümmer, aber das ist so, als würde man warten, bis ein Haus abbrennt, um etwas über Brandschutz zu lernen. Stattdessen begannen sie, nach „Beinahe-Unfällen“ zu suchen – jenen herzschlagbeschleunigenden Momenten, in denen ein Auto nur Zentimeter vor einem Fußgänger voll in die Eisen gehen muss. Diese werden als „Surrogat-Sicherheitsmaße“ bezeichnet. Betrachten Sie sie als die Version des „Beinahe-Passiert“-Detektors in der Welt des Verkehrs.

Die meisten herkömmlichen Computerprogramme betrachteten diese Beinahe-Unfälle jedoch immer nur paarweise, als würde man prüfen, ob Auto A zu nah an Auto B ist, und dann prüfen, ob Auto C zu nah am Fußgänger D ist, wobei ignoriert wird, dass das plötzliche Bremsen von Auto A dazu führen kann, dass Auto B ausweicht, was wiederum Fußgänger D erschreckt. Es war, als versuche man, einen komplexen Tanz zu verstehen, indem man immer nur zwei Tänzer gleichzeitig beobachtet. Dieses Paper stellt eine neue, intelligentere Methode vor, um den gesamten Tanzboden auf einmal zu beobachten. Es betrachtet die Kreuzung nicht als eine Liste separater Paare, sondern als ein lebendiges, atmendes Netz von Verbindungen, in dem jede Bewegung Wellen durch die Menge schlägt. Das Ziel ist einfach, aber lebenswichtig: Ein System zu bauen, das eine gefährliche Situation erkennen kann, bevor sie zur Tragödie wird, ohne jedes Mal „Fehlalarm“ zu schreien, wenn jemand nur wegen einer roten Ampel langsamer wird.

Der neue „Verkehrsdetektiv“: HERMES

Hier kommt HERMES ins Spiel, ein schicker Name für eine neue Art von Computergehirn, das darauf ausgelegt ist, Verkehrskonflikte an signalisierten Kreuzungen vorherzusagen. Die Forscher Md Monzurul Islam und Subasish Das von der Texas State University haben dieses System entwickelt, um das „Flachheits-Problem“ älterer Modelle zu lösen. Stellen Sie sich vor, Sie versuchen, eine Sinfonie zu beschreiben, indem Sie lediglich das Volumen jedes einzelnen Instruments separat auflisten; Sie würden die Harmonie und das Chaos verpassen. Alte Modelle taten mit dem Verkehr genau das: Sie machten die Szene zu einer flachen, langweiligen Liste von Zahlen. HERMES hingegen sieht die Kreuzung als einen heterogenen Graphen.

In einfachem Deutsch ist ein „Graph“ hier einfach eine Karte von Verbindungen. HERMES zeichnet eine Karte, auf der Autos und Fußgänger die Punkte (Knoten) sind und ihre Interaktionen die Linien (Kanten) darstellen, die sie verbinden. Aber es ist nicht irgendeine Karte; es ist eine heterogene Karte, was bedeutet, dass das System den Unterschied kennt, ob ein Auto mit einem anderen Auto, ein Auto mit einem Menschen oder ein Mensch mit einem anderen Menschen interagiert. Es behandelt diese Beziehungen unterschiedlich, so wie man ein Gespräch mit dem besten Freund anders behandeln würde als einen Plausch mit einem Fremden.

Was HERMES wirklich besonders macht, ist die Art und Weise, wie es „Surrogat-Sicherheitsmaße“ (SSMs) nutzt. Dies sind physikbasierte Hinweise wie die Zeit bis zur Kollision (Time-to-Collision – wie viele Sekunden bis zu einem Crash, wenn sich niemand bewegt) und DRAC (wie stark jemand bremsen müsste, um einen Crash zu vermeiden). Anstatt diese Zahlen einfach nur an das Ende einer Liste anzuhängen, bettet HERMES sie direkt in die Verbindungen zwischen den Punkten ein. Es ist, als würde man dem Computer eine Superkraft verleihen: Er sieht nicht nur, dass zwei Autos nah beieinander sind; er sieht, dass sie nah beieinander sind und schnell aufeinander zufahren, und er weiß, dass diese spezifische Kombination gefährlich ist.

Wie es funktioniert: Die Magie des Netzes

HERMES arbeitet in Schichten, wie beim Schälen einer Zwiebel oder beim Stapeln von Bausteinen.

  1. Die Graphen-Schicht: Es betrachtet eine Momentaufnahme der Kreuzung und baut ein Netz von Verbindungen auf. Es schenkt den „Kanten“ (den Linien zwischen den Punkten) besondere Aufmerksamkeit, die einen hohen Bremsbedarf (hohes DRAC) aufweisen. Wenn ein Auto voll in die Eisen gehen muss, hebt HERMES diese Verbindung sofort hervor.
  2. Die Attention-Schicht: Dies ist der „Multi-Head“-Teil. Stellen Sie sich vor, HERMES besitzt mehrere Brillenpaare, die jeweils die Szene durch eine andere Linse betrachten. Ein Paar konzentriert sich vielleicht auf die Geschwindigkeit, ein anderes auf die Richtung und ein drittes darauf, wie nah alle beieinander sind. Es kombiniert all diese Ansichten, um zu entscheiden, welche Interaktionen am kritischsten sind.
  3. Die Zeit-Schicht: Verkehr geschieht nicht in einem einzigen eingefrorenen Foto; er ist ein Film. HERMES beobachtet eine Sequenz dieser Graphen über die Zeit (speziell 8 Frames hintereinander). Es nutzt ein Gedächtnissystem (einen sogenannten LSTM), um sich zu merken, wie sich die Situation entwickelt hat. Sind die Autos näher gekommen? Ist der Fußgänger auf die Straße getreten? Indem es der Geschichte folgt, kann es das Ende vorhersagen, noch bevor es eintritt.

Die Ergebnisse: Eine nahezu perfekte Punktzahl

Die Forscher testeten HERMES mit über 109.000 Sequenzen von Verkehrsdaten aus einer belebten Kreuzung in San Marcos, Texas. Sie verglichen es mit einem ganzen Team anderer „Detektive“, darunter klassische statistische Modelle (wie XGBoost) und moderne Deep-Learning-Modelle (wie Transformer).

Die Ergebnisse waren beeindruckend. HERMES hat nicht nur gewonnen; es hat dominiert.

  • Genauigkeit: Es erreichte einen Wert namens AUC-ROC von 0,9898. In der Welt der Vorhersagemodelle ist ein Wert von 1,0 perfekt, und 0,5 entspricht dem bloßen Raten mit einer Münze. HERMES war unglaublich nah an der Perfektion.
  • Der „Fehlalarm“-Test: Dies ist der wichtigste Teil für den realen Einsatz. Wenn ein Sicherheitssystem jedes Mal „Crash!“ schreit, wenn ein Auto nur langsamer wird, wird niemand ihm zuhören. Die Forscher testeten, wie gut die Modelle echte Gefahren finden können, während sie die Fehlalarme sehr niedrig halten (speziell bei nur 5 % der sicheren Situationen, die fälschlicherweise markiert wurden).
    • Das beste bisherige Modell (ein Transformer) erkannte etwa 81 % der echten Konflikte bei dieser niedrigen Fehlalarmrate.
    • HERMES erkannte 95,7 % der Konflikte.
    • Das bedeutet, dass HERMES fast jede gefährliche Situation fand, während es kaum einen Fehlalarm auslöste.

Sie testeten auch, ob HERMES in einer anderen Stadt funktionieren könnte. Sie nahmen das in Texas trainierte Modell und ließen es in einer Kreuzung in Coldwater, Michigan, arbeiten, ohne es auf die neuen Daten neu zu trainieren. Dies nennt man „Zero-Shot Transfer“. Selbst ohne die neue Stadt gesehen zu haben, schnitt HERMS immer noch bemerkenswert gut ab und erkannte 91,45 % der Konflikte bei einer Fehlalarmrate von 5 %. Als sie dem System nur ein ganz kleines bisschen an Daten aus der neuen Stadt gaben (nur 20 % der Trainingssegmente), sprang die Leistung sogar noch höher und erkannte fast 98,7 % der Konflikte.

Was es nicht ist (und was es ausschließt)

Es ist wichtig zu wissen, was HERMES nicht tut. Das Paper argumentiert explizit gegen die Idee, dass man einfach nur ein einzelnes Paar von Verkehrsteilnehmern (wie ein Auto und einen Fußgänger) isoliert betrachten kann, um das Risiko zu verstehen. Die Studie zeigt, dass die Betrachtung von Interaktionen im Einzelnen oder das Abflachen der Szene zu einer einfachen Liste von Zahlen die komplexe Kette von Ursache und Wirkung, die zu Unfällen führt, übersieht.

Das Paper schließt zudem die Vorstellung aus, dass man eine massive Menge an neuen Daten von jedem einzelnen neuen Standort benötigt, um das System zum Laufen zu bringen. Obwohl das Hinzufügen von ein wenig lokalen Daten hilft, ist das System robust genug, um auch an einem neuen Ort gut zu funktionieren, indem es lediglich von einem anderen, ähnlichen Standort lernt.

Das Fazit

Dieses Paper legt nahe, dass die Zukunft der Verkehrssicherheit nicht nur aus besseren Kameras oder schnelleren Computern besteht, sondern aus einem besseren Verständnis. Indem HERMES den Verkehr als ein vernetztes Geflecht von Beziehungen betrachtet statt als eine Liste isolierter Ereignisse, kann es die Gefahr viel früher und genauer erkennen als je zuvor. Es ist ein kraftvoller Schritt hin zu einer Welt, in der Kreuzungen sicherer sind – nicht weil wir warten, bis Unfälle passieren, sondern weil wir die Beinahe-Unfälle erkennen und das Problem beheben können, bevor jemand verletzt wird. Die Autoren kommen zu dem Schluss, dass dieser Ansatz eine solide Grundlage für den Bau von Straßenverkehrs-Überwachungssystemen bietet, die intelligent genug sind, um den Unterschied zwischen einem beängstigenden Moment und einem echten Crash zu kennen.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →