The Cretogram Dataset for Isolated Character Recognition in Archaic and Classical Crete
Este artículo presenta Cretogram, un nuevo conjunto de datos de 11.161 caracteres epigráficos aislados y anotados manualmente de la Creta Arcaica y Clásica, y evalúa su utilidad para el reconocimiento computacional mediante HOG-SVM y modelos de aprendizaje profundo, alcanzando una puntuación macro-F1 máxima del 95,53% con ResNet-18 al tiempo que destaca confusiones de caracteres específicas inherentes a las variaciones locales de la escritura.
Artículo original bajo licencia CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo
El estudio de la escritura antigua a menudo se siente como intentar leer un libro donde las páginas han sido arrancadas, la tinta se ha desvanecido y las letras han sido remodeladas por siglos de erosión. En el campo de la epigrafía, que es el estudio de las inscripciones talladas en piedra o fundidas en metal, los estudiosos han dependido durante mucho tiempo de sus propios ojos para descifrar estas marcas. Comparan las curvas de una letra tallada en una ciudad griega con la misma letra tallada en otra, buscando diferencias sutiles que revelen dónde se hizo una piedra o cuándo fue escrita. Para la isla de Creta, esta tarea es particularmente compleja. Durante los períodos Arcaico y Clásico, la isla no era una cultura de escritura única y unificada, sino una colección de tradiciones locales. Cada ciudad-estado desarrolló sus propias ligeras variaciones en la forma de dibujar su alfabeto. Una letra que parece una "A" estándar en un pueblo puede tener una forma diferente en un valle vecino. Estas pequeñas variaciones son la clave para comprender la historia y la geografía del mundo antiguo, pero también son increíblemente difíciles de aprender para una computadora, porque la computadora debe distinguir entre una diferencia genuina de estilo y una simple mancha o un trozo de piedra roto.
Un equipo de investigadores de la Universidad Aristóteles de Tesalónica ha abordado este desafío creando un nuevo recurso digital llamado Cretogram. Su objetivo era enseñar a una computadora a reconocer estas antiguas letras cretenses de forma aislada, sin la ayuda de las palabras circundantes que usualmente le dan contexto a un lector humano. Para lograrlo, no se limitaron a escanear fotografías antiguas; regresaron a los dibujos y transcripciones eruditas que los expertos han perfeccionado durante décadas. A partir de 187 inscripciones específicas, extrajeron cuidadosamente 11.611 caracteres individuales. Cada carácter fue limpiado, estandarizado a un tamaño uniforme y etiquetado con su identidad correcta, pero crucialmente, los investigadores mantuvieron un vínculo digital con la piedra original de la que provenía. Esta conexión es vital porque permite que la computadora sea probada de una manera realista: los investigadores entrenaron al sistema con algunas inscripciones y luego le pidieron que identificara letras de inscripciones completamente diferentes que nunca había visto antes. Este método asegura que la computadora esté aprendiendo las formas reales de las letras, no solo memorizando el estilo específico de un solo tallador de piedra.
Los resultados de este experimento muestran que la inteligencia artificial moderna puede, de hecho, dominar estas formas antiguas, aunque enfrenta obstáculos específicos. Los investigadores probaron tres enfoques diferentes para el problema. Un método utilizó una técnica tradicional que observa los bordes y ángulos de las formas. Un segundo método utilizó una red neuronal compacta y personalizada, que es un tipo de programa informático diseñado para imitar la forma en que el cerebro procesa patrones visuales. El tercer método utilizó un sistema mucho más grande y preentrenado que ya había aprendido a reconocer millones de imágenes cotidianas, como gatos y autos, antes de ser adaptado a estas letras antiguas. El sistema más grande fue el que mejor funcionó, identificando correctamente la letra en casi el 98 por ciento de los casos de prueba. Logró distinguir con éxito entre las muchas variaciones locales del alfabeto cretense, demostrando que una máquina puede aprender a ver las sutiles diferencias que definen estas antiguas tradiciones de escritura.
Sin embargo, el estudio también reveló dónde todavía tiene dificultades la máquina, resaltando los límites de mirar una sola letra en el vacío. La computadora confundió con frecuencia ciertos pares de letras, como épsilon y digamma, o gamma y lambda. En muchos de estos casos, la confusión no fue un fallo del software, sino un refleño de la ambigüedad en el material de origen mismo. A veces, una letra es tallada con un trazo tenue o roto, o su forma depende enteramente de las letras que la acompañan para tener sentido. Sin el contexto de la palabra completa, incluso un experto humano podría dudar. Los investigadores encontraron que cuando permitían que la computadora viera letras de la misma inscripción tanto en su fase de entrenamiento como en la de prueba, su rendimiento mejoraba ligeramente. Esto sugiere que la computadora se beneficia al ver el estilo consistente de un solo tallador de piedra, pero la prueba estricta de reconocer una letra de una piedra completamente nueva sigue siendo el desafío más difícil y más importante.
La importancia de este trabajo reside en el conjunto de datos en sí. Al poner estos 11.611 imágenes a disposición de otros investigadores, junto con el código utilizado para probarlas, los autores han proporcionado un terreno común para futuros estudios. Han demostrado que, si bien las computadoras ahora pueden leer estas antiguas letras con alta precisión, los casos más difíciles a menudo requieren el tipo de contexto histórico que solo un erudito humano puede proporcionar. El proyecto no pretende haber resuelto el misterio de la escritura cretense antigua, pero ha construido una poderosa nueva herramienta para examinarla. Los investigadores han demostrado que, al combinar la cuidadosa erudición histórica con el aprendizaje automático moderno, es posible preservar y analizar las huellas visuales únicas de los alfabetos locales que han sobrevivido durante más de dos mil años. Este enfoque permite que el mundo digital respete la complejidad del pasado, reconociendo que algunas respuestas residen no solo en la forma de una sola letra, sino en la historia de la piedra sobre la que fue tallada.
¿Ahogado en artículos de tu campo?
Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.