Fluency and Faithfulness in Human and Machine Literary Translation
Diese Studie analysiert über 130.000 übersetzte Absätze aus 106 Romanen, um eine konsistente negative Korrelation zwischen Flüssigkeit und Treue in der literarischen Übersetzung sowohl für Menschen als auch für Google Translate aufzuzeigen, wobei festgestellt wird, dass dieser Zielkonflikt für TranslateGemma schwächer oder nicht signifikant ist.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Stellen Sie sich vor, Sie versuchen, einen komplexen, schönen Roman aus einer fremden Sprache ins Englische zu übersetzen. Sie haben zwei Hauptziele, die Sie jedoch oft in entgegengesetzte Richtungen ziehen:
- Flüssigkeit: Das Englische soll glatt, natürlich klingen und so wirken, als wäre es von einem Muttersprachler geschrieben worden.
- Treue: Die Bedeutung und Struktur genau so zu bewahren, wie sie vom ursprünglichen Autor beabsichtigt wurden, auch wenn es etwas „fremd" oder holprig klingt.
Diese Arbeit stellt eine einfache Frage: Kämpfen diese beiden Ziele in der Welt der literarischen Übersetzung gegeneinander? Bedeutet es automatisch, dass Sie einen Teil der ursprünglichen Bedeutung verlieren, wenn eine Übersetzung natürlicher klingt?
Die Autoren, Sarah Griebel und Ted Underwood, entschieden sich, dies mit einer riesigen Bibliothek von 130.000 Absätzen aus 106 verschiedenen Romanen zu testen. Sie verglichen drei Arten von Übersetzern:
- Menschen: Professionelle menschliche Übersetzer.
- Google Translate: Ein traditionelles maschinelles Übersetzungssystem.
- TranslateGemma: Ein neueres, fortschrittliches KI-Modell (Large Language Model).
Die Werkzeuge: Wie sie den „Zugkampf" maßen
Um die Flüssigkeit zu messen, baten sie keine Menschen, den Text zu lesen. Stattdessen bauten sie einen „Detektiv-Bot". Dieser Bot war darauf trainiert, den Unterschied zwischen Texten zu erkennen, die ursprünglich auf Englisch geschrieben wurden, und Texten, die übersetzt worden waren.
- Der Trick: Um sicherzustellen, dass der Bot nicht nur basierend darauf riet, worum es in der Geschichte ging (den Wortschatz), reduzierten sie die Sätze auf ihr Skelett: die Wortarten (Nomen, Verben, Adjektive usw.).
- Die Logik: Wenn ein Absatz wie ein englisches Muttersprachler-Skelett aussieht, vergibt der Bot eine hohe „Flüssigkeits"-Punktzahl. Wenn es wie ein übersetztes Skelett aussieht (etwas holprig oder anders strukturiert), ist die Punktzahl niedriger.
Um die Treue zu messen, verwendeten sie ein Tool namens COMET-KIWI. Stellen Sie sich dies als einen „Bedeutungs-Checker" vor. Er betrachtet den Quelltext und die Übersetzung und versucht zu erraten: „Wie viel von der ursprünglichen Bedeutung wurde hier bewahrt?" Er benötigt keine perfekte menschliche Übersetzung zum Vergleich; er bewertet das Paar direkt.
Die große Entdeckung: Die „Längen"-Falle
Bevor sie die Hauptantwort fanden, stießen die Forscher auf ein Hindernis. Sie bemerkten, dass die Absatzlänge ihre Ergebnisse verfälschte.
- Die Analogie: Stellen Sie sich vor, Sie versuchen zu beurteilen, wie gut ein Schüler ein Buch zusammengefasst hat. Wenn der Schüler eine Zusammenfassung schreibt, die nur einen Satz lang ist, ist es schwierig, der gesamten Geschichte treu zu bleiben, aber es ist leicht, diesen einen Satz flüssig klingen zu lassen. Wenn sie eine 10-seitige Zusammenfassung schreiben, ist es schwieriger, sie perfekt flüssig zu halten, aber einfacher, alle Details zu bewahren.
- Die Erkenntnis: Lange Absätze erhielten tendenziell niedrigere Punktzahlen sowohl bei der Flüssigkeit als auch bei der Treue. Kurze Absätze erhielten bei beiden höhere Punktzahlen. Dies ließ es so aussehen, als ob Flüssigkeit und Treue nichts miteinander zu tun hätten, wobei in Wirklichkeit die Länge des Textes die verborgene Variable war, die an den Fäden zog.
Die wahre Antwort: Der Zielkonflikt
Sobald sie mathematisch die Länge der Absätze „kontrollierten" (Äpfel mit Äpfeln verglichen), trat ein klares Muster zutage: Es gibt einen Zielkonflikt.
Wenn eine Übersetzung flüssiger wird (muttersprachlicher klingt), neigt sie dazu, der ursprünglichen Bedeutung etwas weniger treu zu sein.
- Menschliche Übersetzer: Sie zeigten die stärkste Version dieses Zielkonflikts. Wenn Menschen den Text sehr natürlich klingen ließen, mussten sie oft die Bedeutung leicht anpassen, um dies zu erreichen.
- Google Translate: Zeigte ebenfalls diese negative Beziehung, wenn auch etwas schwächer.
- Die KI (TranslateGemma): Dies war die Überraschung. Die KI zeigte einen viel schwächeren, manchmal sogar nicht vorhandenen Zielkonflikt. Sie schien in der Lage zu sein, gleichzeitig flüssig und treu zu sein, oder zumindest war die Beziehung zwischen den beiden nicht so eindeutig wie bei Menschen.
Was bedeutet das?
Die Arbeit legt nahe, dass Sie in der literarischen Übersetzung nicht immer alles haben können.
- Wenn Sie wollen, dass der Text wie ein englischer Muttersprachler-Roman gelesen wird, müssen Sie möglicherweise einen kleinen Teil der ursprünglichen Struktur oder Bedeutung opfern.
- Wenn Sie sich starr an die ursprüngliche Struktur halten wollen, um jede Nuance zu bewahren, kann der Text etwas „fremd" oder weniger flüssig klingen.
Die Autoren weisen auch darauf hin, dass ihr „Flüssigkeits"-Detektor auf Bücher aus dem 19. und frühen 20. Jahrhundert trainiert wurde. Das bedeutet, dass er den Stil älterer englischer Literatur bevorzugt. Da menschliche Übersetzer oft versuchen, diesen historischen Stil zu treffen, könnten sie bei der Flüssigkeit besser abschneiden. Moderne KI, die auf modernen Internettexten trainiert wurde, könnte für den Detektor „zu modern" klingen, auch wenn sie grammatikalisch perfekt ist.
Zusammenfassung
Kurz gesagt beweist die Arbeit, dass in der Welt der Romanübersetzung Glätte und strikte Genauigkeit oft in einem sanften Zugkampf stehen. Eine Übersetzung so klingen zu lassen, als wäre sie ein englischer Muttersprachler-Roman, erfordert oft einen kleinen Kompromiss darin, wie streng sie der Originalvorlage folgt. Interessanterweise zeigen Menschen und ältere KI-Systeme diese Spannung deutlich, während neuere, intelligentere KI-Modeln diesen Balanceakt anders zu handhaben scheinen und es manchmal schaffen, sowohl glatt als auch genau zu sein, ohne denselben klaren Zielkonflikt.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.