← Neueste Arbeiten
📄 social_science

Multilingual Representation of Literary Discourse: The Experience of a Six-Language Parallel Corpus

Dieser Artikel stellt ein bahnbrechendes sechssprachiges Parallelkorpus von M. Auezovs *Der Pfad des Abai* in kasachischer, englischer, türkischer, usbekischer, uigurischer und aserbaidschanischer Sprache vor und analysiert dieses, wobei er dessen Wert für die Untersuchung der kreuzlinguistischen Äquivalenz sowie dessen potenzielle Anwendungen in den Übersetzungswissenschaften, der vergleichenden Linguistik und der KI-Entwicklung aufzeigt.

Ursprüngliche Autoren: Anar Fazylzhan¹, Aikerim Mursal¹, Kuralay Kuderinova¹, A. S. Barmenkulova¹, Sara Amirtayeva¹

Veröffentlicht 2026-07-15
📖 4 Min. Lesezeit☕ Kaffeepausen-Lektüre

Ursprüngliche Autoren: Anar Fazylzhan¹, Aikerim Mursal¹, Kuralay Kuderinova¹, A. S. Barmenkulova¹, Sara Amirtayeva¹

Originalarbeit lizenziert unter CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, Sie besitzen eine riesige, magische Bibliothek, in der jedes einzelne Buch in sechs verschiedenen Sprachen gleichzeitig geschrieben ist. Wenn Sie eine Seite auf Kasachisch aufschlagen, können Sie die passende Seite auf Englisch, Türkisch, Usbekisch, Uigurisch und Aserbaidschanisch sofort sehen, wie Soldaten in einer Parade nebeneinander aufgereiht. Dies ist nicht nur ein Stapel von Büchern; es ist ein hochmodernes „sechssprachiges paralleles Subkorpus“, das von Linguisten in Kasachstan aufgebaut wurde, und es gleicht einem riesigen, digitalen Mikroskop zur Untersuchung dessen, wie Geschichten zwischen Kulturen reisen.

Die Forscher haben nicht einfach wahllos Bücher in diese Bibliothek geworfen. Sie wählten sorgfältig eine Mischung aus klassischer Literatur (wie dem epischen Roman Der Weg des Abai von Mukhtar Auezov), Märchen und sogar einigen wissenschaftlichen Artikeln aus. Sie bauten eine Datenbank auf, die fast 1 Million Wörter (speziell 990.000 Token) über diese sechs Sprachen hinweg umfasst. Denken Sie an ein riesiges Puzzle, bei dem jedes Teil sechs verschiedene farbige Versionen hat, und die Wissenschaftler versuchen zu sehen, wie sich das Bild verändert, wenn man die Farben austauscht.

Hier ist die große Entdeckung: Wenn man eine Geschichte aus dem Kasachischen in andere Sprachen der „turkischen Sprachfamilie“ (wie Türkisch, Usbekisch, Uigurisch und Aserbaidschanisch) übersetzt, sehen die Sätze oft fast identisch aus und fühlen sich auch so an. Es ist, als würden sie das gleiche Outfit tragen. Da diese Sprachen eine ähnliche „agglutinierende“ Struktur teilen (bei der man kleine Wortstücke an das Ende eines Wortes heftet, um dessen Bedeutung zu verändern) und das Verb normalerweise an das Ende des Satzes stellen, bleiben die Übersetzungen der Originalquelle sehr nah. Die Forscher fanden heraus, dass in diesen Sprachen Struktur, Bedeutung und emotionaler Ton meist perfekt synchron verlaufen.

Doch als sie versuchten, dieselben kasachischen Geschichten ins Englische zu übersetzen, änderte sich das Outfit komplett. Englisch ist eine andere Art von Sprache; es heftet nicht auf die gleiche Weise Teile an Wörter und stellt das Verb in die Mitte des Satzes. Die Studie zeigt, dass Übersetzer die Sätze aufbrechen und die Möbel umstellen mussten, um die Geschichte im Englischen funktionieren zu lassen. Anstatt die exakte Struktur beizubehalten, konzentrierten sie sich darauf, das Gefühl und den Zweck der Szene zu bewahren. Wenn beispielsweise ein kasachischer Charakter einen speziellen, kulturell spezifischen Spitznamen oder einen tiefen emotionalen Seufzer verwendet, könnte die englische Version dies durch eine allgemeinere Phrase ersetzen, die denselben emotionalen Punkt vermittelt, auch wenn die Wörter völlig anders sind. Das Paper legt nahe, dass, während sich das „Skelett“ des Satzes im Englischen ändert, das „Herz“ der Botschaft immer noch da ist, nur anders gekleidet.

Das Team hat zudem ein spezielles „ID-Karten“-System für jedes Textstück in der Bibliothek erstellt. Bevor eine Geschichte in die Datenbank aufgenommen wird, erhält sie Details wie den Autor, den Übersetzer, den Zeitraum, in dem sie angesiedelt ist, und die Zielgruppe (Kinder, Erwachsene usw.). Das bedeutet, dass ein Forscher nach „traurigen Geschichten über Väter“ suchen kann und sofort passende Absätze in allen sechs Sprachen abrufen kann, um zu sehen, wie verschiedene Kulturen mit dieser spezifischen Emotion umgehen.

Die Autoren sind sich ihrer Ergebnisse sehr sicher, denn sie haben nicht nur geraten; sie haben Computerwerkzeuge genutzt, um Wortmuster zu zählen, und die Alignments manuell überprüft, um sicherzustellen, dass die Absätze perfekt übereinstimmen. Sie argumentieren gegen die Vorstellung, dass Übersetzung nur das Ersetzen eines Wortes durch ein anderes ist. Stattdessen zeigen sie, dass Übersetzung ein komplexer Tanz ist, bei dem sich die Schritte ändern, je nachdem, mit wem man tanzt. Wenn man mit einem Partner aus der turkischen Sprachfamilie tanzt, kann man genau dieselben Schritte machen. Wenn man jedoch mit dem Englischen tanzt, muss man neue Schritte improvisieren, um den Rhythmus beizubehalten.

Dieses Projekt wächst stetig weiter. Momentan ist es ein kraftvolles Werkzeug für Studenten, die das Übersetzen lernen, für Wissenschaftler, die untersuchen, wie Sprachen funktionieren, und für die zukünftige Entwicklung künstlicher Intelligenz, die Kasachisch spricht. Die Forscher legen nahe, dass, wenn sie mehr Bücher und Geschichten zu dieser sechssprachigen Bibliothek hinzufügen, sie zu einem noch schärferen Werkzeug für das Verständnis dessen werden, wie menschliche Kultur über Grenzen hinweg geteilt und transformiert wird. Sie haben noch nicht jedes Geheimnis der Sprache gelöst, aber sie haben ein sehr starkes Fundament gelegt, um es herauszufinden.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →