Herding End-to-End Autonomous Driving via Neuro-Symbolic Safety Guards
Dit artikel introduceert een lichtgewicht, niet-trainbare neuro-symbolische veiligheidsbewaker die wordt gekoppeld aan end-to-end autonome rijaagents om expliciete verkeersregels af te dwingen door onveilige commando's te vervangen door veilige alternatieven, wat het aantal botsingen aanzienlijk vermindert en de succespercentages op long-tail benchmarks verbetert zonder de algehele rijprestaties aan te tasten.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je voor dat je een robot leert rijden door hem duizenden video's van auto's op de weg te laten zien. Dit wordt "end-to-end" leren genoemd, waarbij de robot naar de camera kijkt en direct beslist hoe hij het stuur moet draaien of het gaspedaal moet indrukken, precies zoals een menselijk brein dat doet. Het is geweldig in het herkennen van patronen; als hij een rode auto voor zich ziet, weet hij dat hij moet afremmen omdat hij dat al een miljoen keer heeft gezien. Maar hier komt het lastige deel: de robot is een patroonherkenningsmachine, geen regelvolger. Hij begrijpt niet echt waarom hij voor een rood licht moet stoppen of hoe de natuurkunde werkt. Hij gokt alleen op basis van wat hij eerder heeft gezien. Als hij een vreemde situatie tegenkomt die hij niet in zijn trainingsvideo's heeft gezien — zoals een enorme opblaasbare eend die de weg blokkeert of een geschilderde muur die op een oprit lijkt — kan hij het fout hebben en crashen. Dit is een groot probleem, want zelfs als een robotbestuurder 99% van de tijd perfect rijdt, kan die ene fout catastrofaal zijn. We hebben een manier nodig om de robot vrij te laten rijden, maar met een vangnet dat hem opvangt als hij iets gevaarlijks probeert te doen.
Dit artikel introduceert een slimme oplossing genaamd een "neuro-symbolische veiligheidsbewaker". Denk aan de robotbestuurder als een getalenteerde maar impulsieve tiener die leert autorijden, en de veiligheidsbewaker als een strenge, regelvolgende ouder die op de passagiersstoel zit. De tiener (de robot) neemt alle beslissingen over het rijden en stelt voor waarheen hij wil gaan. Maar voordat de auto daadwerkelijk beweegt, controleert de ouder (de veiligheidsbewaker) het plan van de tiener aan de hand van een eenvoudige lijst met onbreekbare regels, zoals "rij nooit een voetganger aan" of "stop voor een rood licht". Als het plan van de tiener veilig is, zegt de ouder niets en laat hij hem rijden. Maar als de tieler een rood licht negeert of tegen een muur aanrijdt, grijpt de ouder onmiddellijk in en stuurt de auto naar het dichtstbijzijnde veilige alternatief. Het beste eraan is dat de ouder niets nieuws hoeft te leren en de manier waarop de tiener leert niet verandert. Ze staan er gewoon, klaar om in te grijpen wanneer dat absoluut noodzakelijk is.
De onderzoekers hebben dit idee getest met een zeer slimme, geavanceerde robotbestuurder genaamd TransFuser v6. Ze plaatsten de veiligheidsbewaker voor de bestuurder en lieten hem door een reeks lastige, zeldzame rijsituaties gaan die de robot nog nooit eerder had gezien. De resultaten waren indrukwekkend. Wanneer de robot deze onbekende, gevaarlijke situaties tegenkwam, hielp de veiligheidsbewaker hem om 15% vaker succesvol te zijn. Nog belangrijker nog: het verminderde gevaarlijke botsingen met wel 53%. De bewaker maakte de robot niet alleen veiliger; het maakte hem betrouwbaarder zonder de algehele scores van het rijden te verlagen. Het artikel laat zien dat door een lichtgewicht, op regels gebaseerde "beschermengel" aan het einde van een leersysteem toe te voegen, we de flexibiliteit van een slimme robot kunnen behouden terwijl we ervoor zorgen dat hij nooit de basiswetten van de natuurkunde en het verkeer overtreedt. De auteurs maten deze verbeteringen in computersimulaties, wat aantoont dat deze aanpak een belangrijke stap kan zijn naar het maken van autonome voertuigen die we echt kunnen vertrouwen.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.