← Ultimi articoli
💻 computer science

The Cretogram Dataset for Isolated Character Recognition in Archaic and Classical Crete

Questo articolo introduce Cretogram, un nuovo dataset di 11.611 caratteri epigrafici isolati e annotati manualmente provenienti dalla Creta arcaica e classica, e ne valuta l'utilità per il riconoscimento computazionale utilizzando HOG-SVM e modelli di deep learning, raggiungendo un punteggio macro-F1 massimo del 95,53% con ResNet-18, evidenziando al contempo specifiche confusioni tra i caratteri inerenti alle variazioni locali della scrittura.

Autori originali: Ilias Gotsikas, Pericles A. Mitkas, Niki Oikonomaki

Pubblicato 2026-09-22
📖 5 min di lettura🧠 Approfondimento

Autori originali: Ilias Gotsikas, Pericles A. Mitkas, Niki Oikonomaki

Articolo originale sotto licenza CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ✨ Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo

Lo studio della scrittura antica spesso sembra come cercare di leggere un libro in cui le pagine sono state strappate, l'inchiostro è sbiadito e le lettere sono state rimodellate da secoli di erosione. Nel campo dell'epigrafia, ovvero lo studio delle iscrizioni incise nella pietra o fuse nel metallo, gli studiosi si sono a lungo affidati ai propri occhi per decifrare questi segni. Essi confrontano la curva di una lettera incisa in una città greca con la stessa lettera incisa in un'altra, cercando sottili differenze che rivelino dove una pietra sia stata realizzata o quando sia stata scritta. Per l'isola di Creta, questo compito è particolarmente complesso. Durante i periodi Arcaico e Classico, l'isola non era una cultura di scrittura singola e unificata, ma una collezione di tradizioni locali. Ogni città-stato sviluppò le proprie lievi variazioni nel modo in cui disegnava il proprio alfabeto. Una lettera che appare come una "A" standard in una città potrebbe avere una forma diversa in una valle vicina. Queste piccole variazioni sono la chiave per comprendere la storia e la geografia del mondo antico, ma sono anche incredibilmente difficili da apprendere per un computer, poiché il computer deve distinguere tra una reale differenza di stile e una semplice macchia o un pezzo di pietra rotto.

Un team di ricercatori dell'Università Aristotele di Salonicco ha affrontato questa sfida creando una nuova risorsa digitale chiamata Cretogram. Il loro obiettivo era insegnare a un computer a riconoscere queste antiche lettere cretesi in isolamento, senza l'aiuto delle parole circostanti che solitamente forniscono un contesto al lettore umano. Per farlo, non si sono limitati a scansionare vecchie fotografie; sono tornati ai disegni e alle trascrizioni erudite che gli esperti hanno perfezionato in decenni. Da 187 iscrizioni specifiche, hanno estratto con cura 11.611 singoli caratteri. Ogni carattere è stato pulito, standardizzato in una dimensione uniforme e contrassegnato con la propria identità corretta, ma, cosa fondamentale, i ricercatori hanno mantenuto un collegamento digitale con la pietra originale da cui proveniva. Questa connessione è vitale perché permette al computer di essere testato in modo realistico: i ricercatori hanno addestrato il sistema su alcune iscrizioni e poi hanno chiesto di identificare lettere da iscrizioni completamente diverse che non aveva mai visto prima. Questo metodo assicura che il computer stia imparando le forme reali delle lettere, non solo memorizzando lo stile specifico di un singolo scalpellatore.

I risultati di questo esperimento mostrano che l'intelligenza artificiale moderna può effettivamente padroneggiare queste forme antiche, sebbene affronti ostacoli specifici. I ricercatori hanno testato tre approcci diversi al problema. Un metodo utilizzava una tecnica tradizionale che analizza i bordi e gli angoli delle forme. Un secondo metodo utilizzava una rete neurale compatta e costruita su misura, un tipo di programma informatico progettato per imitare il modo in cui il cervello elabora i modelli visivi. Il terzo metodo utilizzava un sistema molto più grande e pre-addestrato, che aveva già imparato a riconoscere milioni di immagini quotidiane, come gatti e auto, prima di essere adattato a queste lettere antiche. Il sistema più grande è stato il migliore, identificando correttamente la lettera in quasi il 98 percento dei casi di test. Ha distinto con successo le molte variazioni locali dell'alfabeto cretese, dimostrando che una macchina può imparare a vedere le sottili differenze che definiscono queste antiche tradizioni di scrittura.

Tuttove, lo studio ha anche rivelato dove la macchina incontra ancora difficoltà, evidenziando i limiti del guardare una singola lettera nel vuoto. Il computer ha spesso confuso determinati accoppiamenti di lettere, come epsilon e digamma, o gamma e lambda. In molti di questi casi, la confusione non era un fallimento del software, ma un riflesso dell'ambiguità del materiale sorgente stesso. A volte una lettera è incisa con un tratto debole o interrotto, o la sua forma dipende interamente dalle lettere accanto ad essa per avere senso. Senza il contesto della parola intera, persino un esperto umano potrebbe esitare. I ricercatori hanno scoperto che quando permettevano al computer di vedere lettere della stessa iscrizione sia durante la fase di addestramento che durante quella di test, le sue prestazioni miglioravano leggermente. Ciò suggerisce che il computer beneficia dal vedere lo stile coerente di un singolo scalpellatore, ma il test rigoroso di riconoscere una lettera da una pietra completamente nuova rimane la sfida più difficile e importante.

La portata di questo lavoro risiede nel dataset stesso. Rendendo queste 11.611 immagini disponibili ad altri ricercatori, insieme al codice utilizzato per testarle, gli autori hanno fornito un terreno comune per studi futuri. Hanno dimostrato che, sebbene i computer possano ora leggere queste lettere antiche con un'alta precisiono, i casi più difficili richiedono spesso il tipo di contesto storico che solo uno studioso umano può fornire. Il progetto non pretende di aver risolto il mistero della scrittura cretese antica, ma ha costruito un potente nuovo strumento per esaminarla. I ricercatori hanno dimostrato che, combinando una meticolosa erudizione storica con l'apprendimento automatico moderno, è possibile preservare e analizzare le uniche impronte visive degli alfabeti locali che sono sopravvissuti per oltre duemila anni. Questo approccio permette al mondo digitale di rispettare la complessità del passato, riconoscendo che alcune risposte risiedono non solo nella forma di una singola lettera, ma nella storia della pietra su cui è stata incisa.

Sommerso dagli articoli nel tuo campo?

Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.

Prova Digest →