The Cretogram Dataset for Isolated Character Recognition in Archaic and Classical Crete
Cet article présente Cretogram, un nouveau jeu de données composé de 11 611 caractères épigraphiques isolés et annotés manuellement provenant de la Crète archaïque et classique, et évalue son utilité pour la reconnaissance computationnelle en utilisant HOG-SVM et des modèles d'apprentissage profond, atteignant un score macro-F1 maximal de 95,53 % avec ResNet-18 tout en soulignant les confusions de caractères spécifiques inhérentes aux variations locales de l'écriture.
Article original sous licence CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète
L'étude de l'écriture ancienne donne souvent l'impression de lire un livre dont les pages auraient été arrachées, dont l'encre aurait pâli et dont les lettres auraient été remodelées par des siècles d'érosion. Dans le domaine de l'épigraphie, qui est l'étude des inscriptions gravées dans la pierre ou coulées dans le métal, les chercheurs se sont longtemps appuyés sur leur propre regard pour déchiffrer ces marques. Ils comparent la courbe d'une lettre gravée dans une cité grecque à la même lettre gravée dans une autre, cherant les différences subtiles qui révèlent où une pierre a été fabriquée ou quand elle a été écrite. Pour l'île de Crète, cette tâche est particulièrement complexe. Durant les périodes archaïque et classique, l'île n'était pas une culture d'écriture unique et unifiée, mais une collection de traditions locales. Chaque cité-État a développé ses propres légères variations dans la manière de tracer son alphabet. Une lettre qui ressemble à un « A » standard dans une ville peut avoir une forme différente dans une vallée voisine. Ces petites variations sont la clé pour comprendre l'histoire et la géographie du monde antique, mais elles sont aussi incroyablement difficiles à apprendre pour un ordinateur, car celui-ci doit distinguer une véritable différence de style d'une simple tache ou d'un morceau de pierre cassé.
Une équipe de chercheurs de l'Université Aristote de Thessalonique a relevé ce défi en créant une nouvelle ressource numérique appelée Cretogram. Leur objectif était d'apprendre à un ordinateur à reconnaître ces lettres crétoises anciennes de manière isolée, sans l'aide des mots environnants qui donnent habituellement un contexte au lecteur humain. Pour ce faire, ils ne se sont pas contentés de scanner de vieilles photographies ; ils sont retournés aux dessins et aux transcriptions érudits que les experts ont perfectionnés pendant des décades. À partir de 187 inscriptions spécifiques, ils ont soigneusement extrait 11 611 caractères individuels. Chaque caractère a été nettoyé, standardisé à une taille uniforme et étiqueté avec son identité correcte, mais surtout, les chercheurs ont conservé un lien numérique avec la pierre d'origine. Cette connexion est vitale car elle permet de tester le système de manière réaliste : les chercheurs ont entraîné le système sur certaines inscriptions, puis lui ont demandé d'identifier des lettres provenant d'inscriptions complètement différentes qu'il n'avait jamais vues auparavant. Cette méthode garantit que l'ordinateur apprend les formes réelles des lettres, et non simplement le style spécifique d'un seul tailleur de pierre.
Les résultats de cette expérience montrent que l'intelligence artificielle moderne peut effectivement maîtriser ces formes anciennes, bien qu'elle soit confrontée à des obstacles spécifiques. Les chercheurs ont testé trois approches différentes du problème. Une méthode utilisait une technique traditionnelle qui examine les bords et les angles des formes. Une deuxième méthode utilisait un réseau neuronal compact et sur mesure, qui est un type de programme informatique conçu pour imiter la façon dont le cerveau traite les motifs visuels. La troisième méthode utilisait un système pré-entraîné beaucoup plus vaste, qui avait déjà appris à reconnaître des millions d'images quotidiennes, telles que des chats et des voitures, avant d'être adapté à ces lettres anciennes. Le système le plus large a obtenu les meilleurs résultats, identifiant correctement la lettre dans près de 98 pour cent des cas de test. Il a réussi à distinguer les nombreuses variations locales de l'alphabet crétois, prouvant qu'une machine peut apprendre à voir les différences subtiles qui définissent ces traditions d'écriture anciennes.
Cependant, l'étude a également révélé là où la machine peine encore, soulignant les limites de l'observation d'une seule lettre dans le vide. L'ordinateur a fréquemment confondu certaines paires de lettres, comme l'epsilon et le digamma, ou le gamma et le lambda. Dans beaucoup de ces cas, la confusion n'était pas un échec du logiciel, mais le reflet de l'ambiguïté du matériel source lui-même. Parfois, une lettre est gravée avec un trait faible ou brisé, ou sa forme dépend entièrement des lettres qui l'entourent pour avoir un sens. Sans le contexte du mot complet, même un expert humain pourrait hésiter. Les chercheurs ont constaté que lorsqu'ils permettaient à l'ordinateur de voir des lettres de la même inscription lors des phases d'entraînement et de test, ses performances s'amélioraient légèrement. Cela suggère que l'ordinateur bénéficie de la vision du style cohérent d'un seul tailleur de pierre, mais le test rigoureux de la reconnaissance d'une lettre provenant d'une pierre totalement nouvelle reste le défi le plus difficile et le plus important.
La portée de ce travail réside dans le jeu de données lui-même. En mettant ces 11 611 images à la disposition d'autres chercheurs, ainsi que le code utilisé pour les tester, les auteurs ont fourni un terrain d'entente pour les études futures. Ils ont montré que si les ordinateurs peuvent désormais lire ces lettres anciennes avec une grande précision, les cas les plus difficiles nécessitent souvent le type de contexte historique qu'un chercheur humain est le seul à pouvoir fournir. Le projet ne prétend pas avoir résolu le mystère de l'écriture crétoise ancienne, mais il a construit un nouvel outil puissant pour l'examiner. Les chercheurs ont démontré qu'en combinant une recherche historique minutieuse avec l'apprentissage automatique moderne, il est possible de préserver et d'analyser les empreintes visuelles uniques des alphabets locaux qui ont survécu pendant plus de deux mille ans. Cette approche permet au monde numérique de respecter la complexité du passé, en reconnaissant que certaines réponses résident non seulement dans la forme d'une seule lettre, mais dans l'histoire de la pierre sur laquelle elle fut gravée.
Noyé(e) sous les articles dans votre domaine ?
Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.