The Cretogram Dataset for Isolated Character Recognition in Archaic and Classical Crete
Dit artikel introduceert Cretogram, een nieuwe dataset van 11.611 handmatig geannoteerde geïsoleerde epigrafische tekens uit de archaïsche en klassieke periode van Kreta, en evalueert het nut ervan voor computationele herkenning met behulp van HOG-SVM en deep learning-modellen, waarbij een hoogste macro-F1-score van 95,53% wordt behaald met ResNet-18, terwijl specifieke karakterverwarringen die inherent zijn aan de lokale variaties van het schrift worden belicht.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
De studie van oude schriftuur voelt vaak als het proberen te lezen van een boek waarvan de pagina's zijn uitgescheurd, de inkt is vervaagd en de letters zijn vervormd door eeuwen van verwering. In het vakgebied van de epigrafie, de studie van inscripties die in steen zijn gekerfd of in metaal zijn gegoten, hebben geleerden lang op hun eigen ogen vertrouwd om deze tekens te ontcijferen. Ze vergelijken de rondingen van een letter die in de ene Griekse stad is gekerfd met dezelfde letter die in een andere stad is gekerfd, op zoek naar subtiele verschillen die onthullen waar een steen is gemaakt of wanneer deze is geschreven. Voor het eiland Kreta is deze taak bijzonder complex. Tijdens de archaïsche en klassieke periodes was het eiland geen enkele, verenigde schrijfcultuur, maar een verzameling lokale tradities. Elke stadstaat ontwikkelde zijn eigen lichte variaties in de manier waarop zij hun alfabet tekenden. Een letter die er in één stad uitziet als een standaard "A", kan in een naburige vallei een andere vorm hebben. Deze kleine variaties zijn de sleutel tot het begrijpen van de geschiedenis en geografie van de antieke wereld, maar ze zijn ook ongelooflijk moeilijk voor een computer om te leren, omdat de computer onderscheid moet maken tussen een echt verschil in stijl en een simpele vlek of een afgebroken stuk steen.
Een team onderzoekers aan de Aristoteles Universiteit van Thessaloniki heeft deze uitdaging aangepakt door een nieuwe digitale bron genaamd Cretogram te creëren. Hun doel was om een computer te leren deze oude Kretenzische letters te herkennen in isolatie, zonder de hulp van de omliggende woorden die een menselijke lezer normaal gesproken context bieden. Om dit te doen, hebben ze niet simpelweg oude foto's gescand; ze gingen terug naar de wetenschappelijke tekeningen en transcripties die experts decennia lang tot perfectie hebben gebracht. Uit 187 specifieke inscripties hebben ze zorgvuldig 11.611 individuele karakters geëxtraheerd. Elk karakter werd opgeschoond, gestandaardiseerd naar een uniforme grootte en gelabeld met de juiste identiteit, maar cruciaal is dat de onderzoekers een digitale link behielden naar de oorspronkelijke steen waar het vandaan kwam. Deze verbinding is essentieel omdat het de computer op een realistische manier test: de onderzoekers trainden het systeem op sommige inscripties en vroegen het vervolgens om letters te identificeren van volkomen andere inscripties die het nog nooit eerder had gezien. Deze methode zorgt ervoor dat de computer de werkelijke vormen van de letters leert, en niet alleen de specifieke stijl van een enkele steenhouwer uit het hoofd leert.
De resultaten van dit experiment laten zien dat moderne kunstmatige intelligentie inderdaad deze oude vormen kan beheersen, hoewel het specifieke hindernissen tegenkomt. De onderzoekers testten drie verschillende benaderingen van het probleem. Eén methode gebruikte een traditionele techniek die kijkt naar de randen en hoeken van de vormen. Een tweede methode gebruikte een compact, op maat gemaakt neuraal netwerk, een type computerprogramma dat is ontworpen om de manier na te bootsen waarop het brein visuele patronen verwerkt. De derde methode gebruikte een veel groter, vooraf getraind systeem dat al miljoenen alledaagse afbeeldingen, zoals katten en auto's, had leren herkennen voordat het werd aangepast aan deze oude letters. Het grootste systeem presteerde het best en identificeerde de letter correct in bijna 98 procent van de testgevallen. Het slaagde erin om onderscheid te maken tussen de vele lokale variaties van het Kretenzische alfabet, wat bewees dat een machine de subtiele verschillen kan leren zien die deze oude schrijftradities definiëren.
Echter, de studie onthulde ook waar de machine nog steeds moeite mee heeft, wat de beperkingen van het kijken naar een enkele letter in een vacuüm benadrukt. De computer verwarde regelmatig bepaalde paren letters, zoals epsilon en digamma, of gamma en lambda. In veel van deze gevallen was de verwarring geen falen van de software, maar een reflectie van de ambiguïteit in het bronmateriaal zelf. Soms is een letter gekerfd met een vage of gebroken streek, of hangt de vorm ervan volledig af van de letters ernaast om betekenis te geven. Zonder de context van het volledige woord zou zelfs een menselijke expert aarzelen. De onderzoekers ontdekten dat wanneer ze de computer toestonden om letters van dezelfde inscriptie te zien tijdens zowel de trainings- als de testfase, de prestaties licht verbeterden. Dit suggereert dat de computer baat heeft bij het zien van de consistente stijl van een enkele steenhouwer, maar de strikte test van het herkennen van een letter van een volkomen nieuwe steen blijft de moeilijkste en belangrijkste uitdaging.
De betekenis van dit werk ligt in de dataset zelf. Door deze 11.611 afbeeldingen samen met de gebruikte code voor toekomstige studies beschikbaar te stellen aan andere onderzoekers, hebben de auteurs een gemeenschappelijke grond geboden. Ze hebben aangetoond dat hoewel computers deze oude letters nu met hoge nauwkeurigheid kunnen lezen, de moeilijkste gevallen vaak de soort historische context vereisen die alleen een menselijke geleerde kan bieden. Het project beweert niet het mysterie van het oude Kretenzische schrift te hebben opgelost, maar het heeft een krachtig nieuw instrument gebouwd om het te onderzoeken. De onderzoekers hebben aangetoond dat het, door zorgvuldige historische wetenschap te combineren met moderne machine learning, mogelijk is om de unieke visuele vingerafdrukken van lokale alfabetten te bewaren en te analyseren die meer dan tweeduizend jaar hebben overleefd. Deze aanpak stelt de digitale wereld in staat om de complexiteit van het verleden te respecteren, waarbij wordt erkend dat sommige antwoorden niet alleen liggen in de vorm van een enkele letter, maar in het verhaal van de steen waarop deze is gekerfd.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.