← Derniers articles
💻 computer science

Loggia dei Lanzi: AI Thermography Enhancement Comparisons through 3D Photogrammetry

Cet article évalue l'efficacité de l'amélioration d'image basée sur l'IA par rapport à la super-résolution matérielle en photogrammétrie thermique en appliquant trois niveaux de résolution à un modèle 3D de la Loggia dei Lanzi à Florence, démontrant comment ces techniques améliorent la détection de caractéristiques et la précision du modèle 3D pour la documentation du patrimoine culturel.

Auteurs originaux : Scott McAvoy, Jonathan Klingspon, George Bent, Dave Pfaff, Aviral Agarwal, Maurizio Seracini, Falko Kuester

Publié 2026-08-04
📖 7 min de lecture🧠 Analyse approfondie

Auteurs originaux : Scott McAvoy, Jonathan Klingspon, George Bent, Dave Pfaff, Aviral Agarwal, Maurizio Seracini, Falko Kuester

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez que vous êtes un détective tentant de résoudre un mystère caché à l'intérieur d'un vieux mur de pierre épais. Vous ne pouvez pas simplement le démolir pour voir ce qu'il contient, car cela détruirait l'histoire. Au lieu de cela, vous utilisez une « caméra thermique » spéciale qui voit comment différentes parties du mur sont chaudes ou froides. Voyez cela comme des lunettes de vision nocturne pour la température : s'il y a une porte cachée ou un type de brique différent derrière le plâtre, cela pourrait retenir la chaleur différemment du reste du mur, se manifestant sous la forme d'une silhouette fantomatique sur votre écran. C'est ce qu'on appelle la thermographie.

Mais voici la partie délicate : ces caméras thermiques produisent généralement des images un peu floues, comme une vidéo à basse résolution d'un jeu vidéo des années 90. Pour rendre les images plus nettes, les scientifiques utilisent deux astuces principales. La première est une astuce matérielle appelée microscan, où la caméra tremble très légèrement (comme un tremblement de main) pour prendre de nombreux clichés rapides et les assembler en une image plus nette. La seconde, plus récente, est l'Intelligence Artificielle (IA). C'est comme un programme informatique super intelligent qui regarde une image floue et devine à quoi devraient ressembler les détails manquants, « hallucinant » de nouveaux pixels pour rendre l'image nette et haute définition.

La grande question pour les historiens et les architectes est la suivante : rendre l'image plus nette permet-il réellement de découvrir les secrets cachés ? Ou l'IA invente-t-elle des détails fictifs qui ont l'air cool mais qui ne sont pas réels ? Si l'ordinateur invente un motif de briques factice, il pourrait fausser la carte 3D que nous essayons de construire, nous conduisant à de mauv'aises conclusions sur l'histoire du bâtiment. Ce document explore précisément cette question, testant si ces mises à niveau de haute technologie sont une baguette magique ou simplement un filtre sophistiqué.


L'histoire de la Loggia et de la caméra thermique

L'histoire se déroule à la Loggia dei Lanzi, une célèbre galerie en plein air à Florence, en Italie, construite il y a des siècles. C'est une structure massive avec de grandes arches de pierre et un plafond voûté, visitée chaque année par des millions de personnes. Comme elle est très ancienne, elle a été modifiée de nombreuses fois. Il y a probablement des portes cachées, des fenêtres murées et différents types de pierres enfouis sous des couches de plâtre. Les chercheurs voulaient utiliser des caméras thermiques pour trouver ces secrets sans toucher au mur.

En décembre 2025, une équipe de scientifiques a installé son équipement dans la Loggia. Ils ont utilisé une caméra thermique haut de gamme (la FLIR T1020 HD) pour prendre 161 photos du mur du fond. La météo était parfaite pour cela : il faisait froid dehors (environ 11 °C) mais l'intérieur du bâtiment était plus chaud. Cette différence de température faisait ressortir les caractéristiques cachées sur la caméra thermique, comme de la vapeur s'élevant d'une tasse de cacao chaud par une journée d'hiver.

La grande course de la résolution

L'équipe ne s'est pas contentée de prendre les photos et de s'arrêter là. Elle voulait voir si elle pouvait améliorer les images en utilisant trois méthodes différentes, puis voir laquelle les aiderait à construire la meilleure carte 3D du mur. Ils ont traité les images comme une course avec six coureurs différents :

  1. Le Coureur Natif : La photo originale, non éditée, provenant directement de la caméra (1024 × 768 pixels). C'est le groupe « témoin » — ce dont nous sommes partis.
  2. Le Coureur Matériel (UltraMax) : L'astuce intégrée de la caméra qui utilise de minuscules secousses pour combiner 16 images en une seule plus nette (2048 × 1536 pixels).
  3. Le Coureur Mathématique (Bicubique) : Une astuce informatique simple et classique qui se contente d'étirer l'image pour l'agrandir, sans ajouter de nouveaux détails réels. C'est la base du « faire semblant jusqu'à ce que ça marche ».
  4. Le Coureur IA n°1 (SwinIR) : Un modèle d'IA intelligent généralement entraîné sur des photos normales, et non sur des images thermiques, juste pour voir s'il pouvait deviner les détails.
  5. Le Coureur IA n°2 (DifIISR) : Une IA très avancée qui utilise un processus de « diffusion » (comme le dévoilement progressif d'une image à partir du bruit) conçu spécifiquement pour les images thermiques.
  6. Le Coureur IA n°3 (TongJi/DRCT) : Le vainqueur d'une récente compétition mondiale pour rendre les images thermiques plus nettes, qui zoome dans l'image par un facteur massif (8 fois plus grand !).

Le grand test : « Plus net » signifie-t-il « Meilleur » ?

C'est ici que l'intrigue tourne. Habituellement, quand nous voyons une photo floue devenir plus nette, nous supposons qu'elle est meilleure. Mais les chercheurs ne regardaient pas seulement les images ; ils les utilisaient pour construire un modèle 3D du mur. Ils ont injecté les six versions des images dans un programme informatique qui tente de déterminer la forme du mur en faisant correspondre les points entre les photos.

Voyez cela comme un puzzle. Si les pièces du puzzle ont des bords clairs et réels, vous pouvez construire un château parfait. Si les pièces du puzzle ont des bords factices dessinés par un ordinateur, le château aura peut-être l'air cool de face, mais il s'effondrera ou aura une apparence étrange de côté.

Les Résultats :

  • L'Image Native (L'Originale) : Étonnamment, la photo originale, non éditée, a produit la carte 3D la plus précise et la plus fiable. Elle présentait le moins d'erreurs et les points les plus cohérents.
  • Le Coureur Matériel (UltraMax) : Celui-ci s'en est bien sorti. Il était légèrement meilleur que le simple étirement mathématique, mais sans faire de bond spectaculaire. C'était la seule version « améliorée » qui n'a pas trop perturbé la carte 3D. Elle était la plus proche de la qualité originale.
  • Les Coureurs IA (Les versions « Magiques ») : C'est la grande surprise. Les modèles d'IA qui rendaient les images les plus nettes et les plus détaillées ont en réalité rendu les cartes 3D pires.
    • Les modèles d'IA ont créé beaucoup de « bruit ». Ils ont inventé des textures et des détails factices qui paraissaient superbes sur une image isolée, mais qui ne correspondaient pas lorsqu'ils étaient vus sous différents angles.
    • Lorsque l'ordinateur a tenté de construire le mur en 3D à l'aide de ces images d'IA, il a été confondu. Les détails « faux » ne s'alignaient pas, ce qui rendait le modèle 3D instable et imprécis.
    • L'IA la plus agressive (celle qui agrandissait l'image 8 fois) a rempli la carte 3D de millions de points, mais tous étaient regroupés dans des endroits bizarres, laissant les parties lisses du mur complètement vides. C'était comme avoir un million de pièces de puzzle qui ne s'emboîtent que dans les coins, laissant le milieu du puzzle vide.

Ce que cela signifie pour l'histoire

L'article conclut que pour le travail spécifique de cartographie de bâtiments historiques afin de découvrir des secrets cachés, plus de pixels ne signifient pas plus de vérité.

Les modèles d'IA sont excellents pour rendre les images jolies pour une affiche de musée ou un jeu vidéo. Ils peuvent deviner à quoi une texture pourrait ressembler. Mais quand vous devez mesurer un mur avec précision pour trouver une porte cachée, ces suppositions sont dangereuses. Elles introduisent des « hallucinations » — des détails qui n'existent pas.

Les chercheurs suggèrent que si vous voulez trouver des caractéristiques cachées dans un bâtiment historique, il vaut mieux prendre une bonne photo stable avec la caméra et éventuellement utiliser l'astuce matérielle intégrée de la caméra (UltraMax) si nécessaire. Mais il faut être très prudent quant à l'utilisation de l'IA pour « corriger » l'image, car l'IA pourrait vous mentir sur ce qui se trouve réellement sur le mur.

En bref : Ne laissez pas l'ordinateur deviner l'histoire. La carte thermique originale, même si elle paraît un peu floue, raconte la véritable histoire de la Loggia dei Lanzi. L'IA peut donner l'impression d'un film en haute définition, mais pour un scientifique tentant de résoudre un mystère, la photo originale à basse résolution est la seule qui ne possède pas de rebondissement fictif.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →