← Derniers articles
🤖 machine learning

Data collection from highways: a geometric, class-agnostic approach to embedded vehicle counting

Cet article propose un pipeline de détection de trafic purement géométrique et agnostique de la classe pour les dispositifs embarqués qui permet un comptage des véhicules et une estimation de la vitesse en temps réel sans modèles d'apprentissage profond, démontrant une précision et une efficacité supérieures par rapport aux bases de référence de suivi lors de déploiements sur le terrain tout en mettant en évidence les contraintes géométriques critiques pour les applications en périphérie.

Auteurs originaux : Lucas Gouveia Omena Lopes, William W. M. Lira, Alexandre M. Lima, Thales M. A. Vieira

Publié 2026-08-11
📖 8 min de lecture🧠 Analyse approfondie

Auteurs originaux : Lucas Gouveia Omena Lopes, William W. M. Lira, Alexandre M. Lima, Thales M. A. Vieira

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez que vous soyez debout sur une autoroute très fréquentée, essayant de compter combien de voitures passent chaque minute. Dans le monde de l'ingénierie du trafic, connaître ce nombre, c'est comme connaître le battement de cœur d'une ville ; cela aide les planificateurs à décider où construire de nouvelles routes ou comment synchroniser les feux de signalisation. Pendant des décennies, la manière la plus intelligente de le faire consistait à utiliser des ordinateurs de « deep learning » (apprentissage profond) — des cerveaux numériques entraînés à reconnaître des formes spécifiques comme « voiture », « bus » ou « camion ». Ces systèmes sont comme des gardes de sécurité très observateurs capables d'identifier un véhicule, de suivre sa trajectoire et de le compter. Cependant, ces cerveaux numériques ont un gros problème : ils ne connaissent que ce qu'on leur a enseigné. Si un étrange tracteur agricole, un tas de cargaison tombée ou une charrette tirée par un âne passe devant eux, l'ordinateur pourrait être confus car il n'a pas été entraîné pour voir ces choses. De plus, ces ordinateurs intelligents sont gourmands en électricité et nécessitent un matériel puissant et coûteux pour fonctionner, ce qui les rend difficiles à installer sur de simples poteaux le long de la route.

Ce document explore une approche différente, beaucoup plus simple : au lieu d'essayer de reconnaître ce que est l'objet, le système remarque simplement qu'un quelque chose bouge. Il traite la route comme un gigantesque fil invisible. Si une ombre ou une tache de mouvement traverse une ligne spécifique, cela compte comme un véhicule. Les auteurs appellent cela une approche « agnostique de la classe », ce qui signifie qu'elle ne se soucie pas de la classe ou du type de l'objet ; elle se soucie seulement du mouvement. La grande question qu'ils abordent est la suivante : pouvons-nous construire un système de comptage si simple qu'il peut fonctionner sur un petit ordinateur bon marché (comme un Raspberry Pi), fonctionner sans aucune donnée d'entraînement, et tout de même accomplir la tâche ? Ils soutiennent que parfois, l'astuce géométrique la plus simple est meilleure qu'une IA complexe et gourmande, surtout quand vous devez compter des choses que vous n'avez même pas encore vues.


Le fil invisible : Compter les voitures sans savoir ce qu'elles sont

Les auteurs de ce document ont décidé de prendre du recul par rapport à la méthode de comptage de voitures de haute technologie et « intelligente ». Au lieu de construire un cerveau numérique qui apprend à reconnaître une voiture, ils ont construit un système qui agit comme un garde très simple et très rapide debout sur un pont. Ce garde ne se soucie pas de savoir si ce qui passe devant lui est une voiture, un camion ou un robot géant ; il s'intéresse seulement au fait que quelque chose bouge à travers une ligne spécifique.

La « magie » de la ligne invisible
Imaginez que vous jouez à un jeu vidéo où vous devez attraper des objets qui tombent. Habituellement, vous essaieriez d'identifier chaque objet d'abord. Mais ce document suggère une astuce plus simple : tracez simplement une ligne sur l'écran. Si quelque chose traverse cette ligne, vous cliquez sur un bouton. Dans le monde réel, cette « ligne » est un logiciel appelé « boucle virtuelle ». C'est comme les vieilles boucles métalliques enfouies dans la route qui déclenchent les feux de signalisation, mais au lieu d'être enterrées dans l'asphalte, elle est dessinée sur l'écran de la caméra.

Le système fonctionne en trois étapes simples :

  1. L'arrière-plan : La caméra apprend à quoi ressemble la route vide.
  2. La différence : Elle compare l'image actuelle à la route vide. S'il y a une différence (une voiture en mouvement), elle la met en évidence sous la forme d'une « tache » blanche sur un écran noir.
  3. Le comptage : Elle vérifie si cette tache blanche touche la ligne invisible. Si c'est le cas, elle compte une unité.

Le génie ici est que le système ne demande jamais : « Est-ce une voiture ? » Il demande simplement : « Quelque chose a-t-il bougé à travers la ligne ? » Cela signifie qu'il peut compter une voiture, une vache ou un tas de détritus sans avoir besoin d'apprendre à quoi ces choses ressemblent.

Les deux règles de la route
Les chercheurs ont testé deux méthodes différentes pour rendre ce comptage précis.

  • Règle n°1 : L'estimation de la vitesse. La première méthode suppose que toutes les voitures se déplacent à peu près à la même vitesse. Ils ont réglé la largeur de la ligne invisible pour correspondre à la distance parcourue par une voiture en un seul cadre de vidéo. Si une voiture roule plus lentement que prévu, elle pourrait rester sur la ligne pendant deux images, et le système pourrait accidentellement la compter deux fois. Les calculs montrent que cette méthode devrait être précise à environ 86 % si les voitures roulent à une vitesse normale. C'est une bonne estimation, mais ce n'est pas parfait.
  • Règle n°2 : La carte auto-ajustable. La deuxième méthode est plus intelligente. Elle observe les taches de voitures en mouvement et comprend par elle-même où se trouvent les voies. Elle dessine ensuite une ligne invisible distincte pour chaque voie. Lorsqu'une voiture entre dans la ligne d'une voie, le système attend que la voiture quitte la ligne avant de la compter. Cela évise l'erreur du « double comptage ». Cette méthode offre également un bonus gratuit : en mesurant le temps qu'une voiture met pour traverser la ligne, le système peut deviner la vitesse à laquelle la voiture roulait.

Le test en conditions réelles : Petits ordinateurs, grands résultats
L'équipe a testé ces idées sur de petits ordinateurs bon marché appelés ordinateurs à carte unique (SBC), comme le Raspberry Pi. Ceux-ci ont la taille d'une carte de crédit et coûtent très peu cher, mais ils ne sont pas très puissants.

Ils ont comparé leur méthode simple de « fil invisible » à une méthode plus complexe qui tente de suivre la trajectoire de chaque voiture (comme un personnage de jeu vidéo). Les résultats ont été surprenants :

  • Sur un ordinateur de bureau standard, la méthode de suivi complexe était lente et se laissait souvent confondre.
  • Sur le petit Raspberry Pi, la méthode complexe a échoué lamentablement, ne comptant correctement que 37,5 % des voitures. Elle était trop lente et a dû réduire tellement la qualité de la vidéo qu'elle ne pouvait plus voir les voitures.
  • La méthode du « fil invisible », quant à elle, fonctionnait plus vite que le temps réel et comptait 91 % des voitures correctement.

Le revers de la médaille : Le « genou de résolution » et le « plancher de fréquence d'images »
Le document a également découvert des limites strictes, comme les lois de la physique pour les caméras numériques.

  • Le genou de résolution : Si l'image vidéo est trop petite (moins de 200 pixels de large), le système cesse de fonctionner. Les voitures en mouvement deviennent si minuscules que l'ordinateur ne peut plus les distinguer du bruit numérique. Mais une fois que l'image est assez grande, l'agrandir davantage ne sert plus à grand-chose ; cela gaspille simplement la puissance de l'ordinateur.
  • Le plancher de fréquence d'images : Si la caméra prend trop peu d'images par seconde (moins de 5 images par seconde), les voitures « sautent » par-dessus la ligne invisible. Imaginez une voiture se déplaçant si vite entre deux photos qu'elle était d'un côté de la ligne dans la première photo et de l'autre côté dans la seconde, n'ayant jamais touché la ligne entre les deux. Le système la manque complètement. Aucune intelligence logicielle ne peut corriger cela si la caméra ne prend pas des photos assez rapidement.

Pourquoi cela importe
Les auteurs concluent que si les détecteurs d'IA « intelligents » sont excellents lorsque vous avez beaucoup d'argent et de puissance, ils ne sont pas toujours les bons outils. Si vous devez compter des objets étranges (comme des équipements agricoles), si vous n'avez aucune donnée pour entraîner un ordinateur, ou si vous devez faire fonctionner un capteur sur une petite batterie solaire, cette méthode géométrique simple est la gagnante. Il ne s'agit pas d'être le plus précis dans absolument toutes les situations, mais d'être fiable, bon marché et capable de fonctionner partout sans avoir besoin d'un supercalculateur.

En fin de compte, ce document montre que parfois, la meilleure façon de résoudre un problème complexe n'est pas de construire un cerveau plus intelligent, mais de construire un piège plus simple et plus honnête.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →