← Nieuwste papers
💻 computer science

Efficient Residual YOLOv12-L Atrous Squeeze LightGBM Optimized Fuzzy CatBoost Network for Vehicle Identification in Traffic Environments

Dit artikel stelt het RYAS-LOFCN-framework voor, dat een Residual Atrous Squeeze Attention Network integreert met FPN en een op YOLOv12-L gebaseerd LightGBM-geoptimaliseerd Fuzzy CatBoost-netwerk om beperkingen bij het detecteren van verre en visueel gelijkaardige verkeersobjecten te overwinnen, waarbij een nauwkeurigheid van 98,63% en een precisie van 98,56% wordt bereikt bij voertuigidentificatie.

Oorspronkelijke auteurs: R Kiranmai, R Deeptha

Gepubliceerd 2026-09-23
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: R Kiranmai, R Deeptha

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ✨ Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Verkeerscamera's observeren de wereld in beweging, waarbij ze een constante stroom van voertuigen, voetgangers en fietsers vastleggen die door stadsstraten en snelwegen weven. Voor computers om deze scène te begrijpen, moeten ze eerst de bewegende objecten scheiden van de statische achtergrond, een proces dat segmentatie wordt genoemd, en vervolgens precies identificeren wat elk object is. Deze taak wordt ongelooflijk moeilijk wanneer het uitzicht druk is, wanneer het licht verschuift van fel zonlicht naar diepe schaduw, of wanneer objecten ver weg zijn. Op die verre plekken lijken auto's en mensen klein en samengedrukt, hun details vervaagd door de enorme afstand en de complexiteit van de weg eromheen. Traditionele computer vision-systemen worstelen hier vaak mee, waarbij ze kleine figuren kwijtraken of afzonderlijke mensen samenvoegen tot één verwarrende vlek. Ze falen ook wanneer het licht verandert, waardoor schaduwen ontstaan die lijken op delen van een persoon of voertuig, of wanneer de achtergrond gebroken en gefragmenteerd is.

Om deze hardnekkige problemen op te lossen, hebben onderzoekers aan het SRM Institute of Science and Technology in Chennai, India, een nieuw systeem ontwikkeld dat is ontworpen om het verkeer duidelijker dan ooit tevoren te zien. Hun aanpak, beschreven in een recente studie, combineert twee krachtige fasen: één die zorgvuldig de vormen van objecten uit de achtergrond snijdt, en een andere die identificeert wat die vormen zijn. Het team heeft een systeem gebouwd dat speciale aandacht besteedt aan de kleine, verre details die andere methoden missen, terwijl het ook leert om de verwarrende ruis te negeren die wordt veroorzaakt door schaduwen en drukke straten. Door hun creatie te testen op een grote collectie echte verkeersvideo's, ontdekten ze dat hun methode met opmerkelijke precisie kon onderscheiden tussen een auto, een lopende persoon en een fietser, zelfs wanneer de omstandigheden verre van perfect waren.

De kern van dit nieuwe systeem ligt in de manier waarop het de visuele informatie verwerkt nog voordat het probeert de objecten te benoemen. De onderzoekers realiseerden zich dat standaardmethoden vaak niet in staat zijn om verre objecten te zien omdat het proces van het vereenvoudigen van een afbeelding de zwakke details van dingen in de verte de neiging heeft weg te wassen. Om dit op te lossen, introduceerden ze een techniek die het "gezichtsveld" van de camera uitbreidt zonder de scherpte van het beeld te verliezen. Stel je voor dat je naar een verre bergketen kijkt; een standaardlens zou de toppen misschien vervagen, maar deze nieuwe methode houdt de randen scherp terwijl het tegelijkertijd de enorme ruimte eromheen begrijpt. Dit stelt het systeem in staat om een voetganger ver in de verte net zo duidelijk te zien als een vrachtwagen direct voor de camera. Bovendien gebruikt het systeem een gelaagde aanpak om de scène tegelijkertijd op verschillende groottes te bekijken, zodat ervoor wordt gezorgd dat zowel een kleine fiets als een grote bus de nodige aandacht krijgen. Het maakt ook gebruik van een filtermechanisme dat leert om de achtergrondrommel, zoals bomen of wegmarkeringen, te negeren en zich alleen te concentreren op de bewegende delen die er toe doen.

Zodra het systeem erin is geslaagd de objecten van de achtergrond te scheiden, gaat het over naar de tweede fase: identificatie. Dit is waar het systeem zijn volgende uitdaging tegenkomt, aangezien druk verkeer vaak ervoor zorgt dat de contouren van verschillende mensen of voertuigen elkaar raken of overlappen, wat het moeilijk maakt om te zien waar de één eindigt en de ander begint. Het nieuwe model pakt dit aan door een reeks intelligente controles te gebruiken die kijken naar de vorm en structuur van de gedetecteerde objecten. Het kan het verschil zien tussen een persoon en een fietser, zelfs als ze erg op elkaar lijken, en het kan de verwarring aanpakken die wordt veroorzaakt door schaduwen die een persoon eruit kunnen laten zien als twee aparte entiteiten. Het systeem past zich ook aan veranderingen in licht aan, waardoor het garandeert dat een voertuig dat een tunnel uitrijdt en de zon in rijdt, nog steeds correct wordt herkend. Door deze geavanceerde controles te combineren, vermijdt het model de veelvoorkomende fout om afzonderlijke mensen samen te voegen tot één massa of een klein object volledig te missen.

Toen de onderzoekers hun systeem testten op een dataset die honderden verkeersscenario's bevatte, inclusief dichte menigten en wisselende weersomstandigheden, waren de resultaten opmerkelijk. In hun simulaties behaalde het model een nauwkeurigheidspercentage van 98,63%, wat betekent dat het het overgrote deel van de voertuigen, voetgangers en fietsers correct identificeerde en lokaliseerde. Het behield ook een hoog niveau van precisie, met een score van 98,56%, wat aangeeft dat het zelden een schaduw voor een persoon of een boom voor een auto aanzag. Het systeem presteerde zelfs beter bij het vinden van aanwezige objecten, met een recall-percentage van 98,6%, wat aantoont dat het zeer weinig doelwitten miste. Deze cijfers waren aanzienlijk hoger dan die van andere toonaangevende modellen die momenteel in gebruik zijn, die vaak worstelden met dezelfde complexe omstandigheden. Het nieuwe systeem bleek ook efficiënt, omdat het minder rekenkracht vereist dan zijn concurrenten, wat suggereert dat het uiteindelijk kan draaien op kleinere, snellere apparaten zoals die in autonome auto's of verkeersbewakingsstations.

De studie benadrukt dat de sleutel tot dit succes niet alleen het gebruik van één krachtig hulpmiddel was, maar eerder het samenweven van verschillende gespecialiseerde technieken die elkaars zwakheden opvullen. Het vermogen van het systeem om de "perspectiefcompressie" van verre objecten en de "maskercoalescentie" van drukke scènes aan te pakken, vertegenwoordigt een belangrijke stap voorwaarts in hoe machines het verkeer waarnemen. Hoewel de onderzoekers opmerken dat hun werk via simulaties is uitgevoerd en dat de implementatie in de echte wereld op edge-apparaten een toekomstig doel is, bieden de resultaten een sterke basis voor meer betrouwbare verkeersmonitoring. Door het mogelijk te maken voor computers om de kleine details in een chaotische omgeving te zien, brengt dit werk ons dichter bij een toekomst waarin verkeerssystemen direct en accuraat kunnen reageren op de complexe stroom van mensen en voertuigen op onze wegen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →