← Neueste Arbeiten
💻 computer science

The Cretogram Dataset for Isolated Character Recognition in Archaic and Classical Crete

Dieses Paper stellt Cretogram vor, einen neuen Datensatz aus 11.611 manuell annotierten isolierten epigraphischen Zeichen aus der archaischen und klassischen Kreta, und evaluiert dessen Nutzen für die computergestützte Erkennung unter Verwendung von HOG-SVM und Deep-Learning-Modellen, wobei ein höchster Makro-F1-Score von 95,53 % mit ResNet-18 erreicht wird, während gleichzeitig spezifische Zeichenverwechslungen hervorgehoben werden, die in den lokalen Variationen der Schrift inhärent sind.

Ursprüngliche Autoren: Ilias Gotsikas, Pericles A. Mitkas, Niki Oikonomaki

Veröffentlicht 2026-09-22
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Ilias Gotsikas, Pericles A. Mitkas, Niki Oikonomaki

Originalarbeit lizenziert unter CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ✨ Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Das Studium der antiken Schrift fühlt sich oft so an, als versuche man, ein Buch zu lesen, bei dem die Seiten herausgerissen wurden, die Tinte verblasst ist und die Buchstaben durch jahrhundertelange Verwitterung umgestaltet wurden. In der Epigraphik, der Lehre von den in Stein gemeißelten oder in Metall gegossenen Inschriften, haben sich Gelehrte lange Zeit auf ihre eigenen Augen verlassen, um diese Zeichen zu entziffern. Sie vergleichen die Kurven eines Buchstabens, der in einer griechischen Stadt eingemeißelt wurde, mit demselben Buchstaben in einer anderen Stadt und suchen nach subtilen Unterschieden, die verraten, wo ein Stein gefertigt oder wann er geschrieben wurde. Für die Insel Kreta ist diese Aufgabe besonders komplex. Während der archaischen und klassischen Epochen war die Insel keine einzelne, einheitliche Schreibkultur, sondern eine Sammlung lokaler Traditionen. Jede Stadtstaat entwickelte ihre eigenen leichten Variationen in der Art und Weise, wie sie ihr Alphabet zeichnete. Ein Buchstabe, der in einer Stadt wie ein Standard-„A“ aussieht, kann in einem benachbarten Tal eine andere Form haben. Diese kleinen Variationen sind der Schlüssel zum Verständnis der Geschichte und Geografie der antiken Welt, aber sie sind auch unglaublich schwierig für einen Computer zu erlernen, da der Computer zwischen einem echten stilistischen Unterschied und einem einfachen Fleck oder einem abgebrochenen Stück Stein unterscheiden muss.

Ein Team von Forschern der Aristoteles-Universität Thessaloniki hat sich dieser Herausforderung gestellt, indem es eine neue digitale Ressource namens Cretogram entwickelt hat. Ihr Ziel war es, einem Computer beizubringen, diese antiken kretischen Buchstaben isoliert zu erkennen, ohne die Hilfe der umgebenden Wörter, die einem menschlichen Leser normalerweise Kontext geben. Um dies zu erreichen, haben sie nicht einfach alte Fotografien gescannt; sie sind zurück zu den wissenschaftlichen Zeichnungen und Transkriptionen gegangen, die Experten über Jahrzehnte hinweg perfektioniert haben. Aus 187 spezifischen Inschriften haben sie sorgfältig 11.611 einzelne Zeichen extrahiert. Jedes Zeichen wurde bereinigt, auf eine einheitliche Größe standardisiert und mit seiner korrekten Identität versehen, aber entscheidend ist, dass die Forscher eine digitale Verbindung zum ursprünglichen Stein beibehielten, aus dem es stammt. Diese Verbindung ist wichtig, weil sie es ermöglicht, den Computer auf eine realistische Weise zu testen: Die Forscher trainierten das System mit einigen Inschriften und baten es dann, Buchstaben aus völlig anderen Inschriften zu identifizieren, die es zuvor noch nie gesehen hatte. Diese Methode stellt sicher, dass der Computer die tatsächlichen Formen der Buchstaben lernt und nicht nur den spezifischen Stil eines einzelnen Steinmetzes auswendig lernt.

Die Ergebnisse dieses Experiments zeigen, dass moderne künstliche Intelligenz diese antiken Formen tatsächlich meistern kann, obwohl sie vor spezifischen Hürden steht. Die Forscher testeten drei verschiedene Ansätze für das Problem. Eine Methode nutzte eine traditionelle Technik, die nach den Kanten und Winkeln der Formen sucht. Eine zweite Methode nutzte ein kompaktes, maßgeschneidertes neuronales Netz, eine Art von Computerprogramm, das darauf ausgelegt ist, die Art und Weise nachzuahmen, wie das Gehirn visuelle Muster verarbeitet. Die dritte Methode verwendete ein viel größeres, vortrainiertes System, das bereits Millionen von alltäglichen Bildern wie Katzen und Autos erkannt hatte, bevor es an diese antiken Buchstaben angepasst wurde. Das größte System schnitt am besten ab und identifizierte den Buchstaben in fast 98 Prozent der Testfälle korrekt. Es gelang ihm, zwischen den vielen lokalen Variationen des kretischen Alphabets zu unterscheiden, was bewies, dass eine Maschine lernen kann, die subtilen Unterschiede zu sehen, die diese antiken Schriftraditionen definieren.

Dennoch zeigte die Studie auch auf, wo die Maschine noch Schwierigkeiten hat, was die Grenzen des Betrachtens eines einzelnen Buchstabens im Vakuum verdeutlicht. Der Computer verwechselte häufig bestimmte Buchstabenpaare, wie Epsilon und Digamma oder Gamma und Lambda. In vielen dieser Fälle war die Verwechslung kein Versagen der Software, sondern ein Spiegelbild der Mehrdeutigkeit des Quellmaterials selbst. Manchmal ist ein Buchstabe mit einem schwachen oder gebrochenen Strich eingemeißelt, oder seine Form hängt vollständig von den benachbarten Buchstaben ab, um Sinn zu ergeben. Ohne den Kontext des vollständigen Wortes könnte selbst ein menschlicher Experte zögern. Die Forscher fanden heraus, dass die Leistung des Computers leicht verbesserte, wenn sie dem Computer erlaubten, während der Trainings- und Testphasen Buchstaben aus derselben Inschrift zu sehen. Dies deutet darauf hin, dass der Computer davon profitiert, den konsistenten Stil eines einzelnen Steinmetzes zu sehen, aber der strenge Test, einen Buchstaben von einem völlig neuen Stein zu erkennen, bleibt die schwierigste und wichtigste Herausforderung.

Die Bedeutung dieser Arbeit liegt im Datensatz selbst. Indem sie diese 11.611 Bilder zusammen mit dem verwendeten Code zum Testen anderen Forschern zur Verfügung stellen, haben die Autoren einen gemeinsamen Boden für zukünftige Studien geschaffen. Sie haben gezeigt, dass Computer diese antiken Buchstaben zwar mit hoher Genauigkeit lesen können, die schwierigsten Fälle jedoch die Art von historischem Kontext erfordern, den nur ein menschlicher Gelehrter bieten kann. Das Projekt beansprucht nicht, das Rätsel der antiken kretischen Schrift gelöst zu haben, aber es hat ein leistungsfähiges neues Werkzeug zu deren Untersuchung geschaffen. Die Forscher haben demonstriert, dass es möglich ist, durch die Kombination von sorgfältiger historischer Gelehrsamkeit mit modernem maschinellem Lernen die einzigartigen visuellen Fingerabdrücke lokaler Alphabete zu bewahren und zu analysieren, die seit über zweitausend Jahren überdauert haben. Dieser Ansatz ermöglicht es der digitalen Welt, die Komplexität der Vergangenheit zu respektieren, indem er anerkennt, dass einige Antworten nicht nur in der Form eines einzelnen Buchstabens liegen, sondern in der Geschichte des Steins, in den er eingemeißelt wurde.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →