← Nieuwste papers
💬 NLP

Fluency and Faithfulness in Human and Machine Literary Translation

Deze studie analyseert meer dan 130.000 vertaalde alinea's uit 106 romans om een consistente negatieve correlatie tussen vloeiendheid en trouw in literaire vertalingen voor zowel mensen als Google Translate aan het licht te brengen, terwijl wordt opgemerkt dat deze afweging voor TranslateGemma zwakker of niet-significant is.

Oorspronkelijke auteurs: Sarah Griebel, Ted Underwood

Gepubliceerd 2026-05-18
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Sarah Griebel, Ted Underwood

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je probeert een complexe, prachtige roman uit een vreemde taal naar het Engels te vertalen. Je hebt twee hoofddoelen, maar ze trekken je vaak in tegenovergestelde richtingen:

  1. Vlotheid: Het Engels laten klinken als een vloeiende, natuurlijke tekst die door een moedertaalspreker is geschreven.
  2. Getrouwheid: De betekenis en structuur exact houden zoals de oorspronkelijke auteur bedoelde, zelfs als het een beetje "vreemd" of onhandig klinkt.

Dit artikel stelt een simpele vraag: In de wereld van literaire vertaling, vechten deze twee doelen elkaar dan? Betekent het dat een vertaling natuurlijker klinkt automatisch dat je wat van de oorspronkelijke betekenis verliest?

De auteurs, Sarah Griebel en Ted Underwood, besloten dit te testen met een enorme bibliotheek van 130.000 alinea's uit 106 verschillende romans. Ze vergeleken drie soorten vertalers:

  • Mensen: Professionele menselijke vertalers.
  • Google Translate: Een traditioneel machinevertalingssysteem.
  • TranslateGemma: Een nieuwere, geavanceerde AI (Large Language Model).

De Tools: Hoe ze de "Touwkrans" maten

Om Vlotheid te meten, vroegen ze geen mensen om de tekst te lezen. In plaats daarvan bouwden ze een "detective-bot". Deze bot was getraind om het verschil te zien tussen tekst die oorspronkelijk in het Engels was geschreven en tekst die vertaald was.

  • De Truc: Om ervoor te zorgen dat de bot niet alleen gokte op basis van waarover het verhaal ging (de woordenschat), haalden ze de zinnen terug tot hun skelet: de woordsoorten (zelfstandige naamwoorden, werkwoorden, bijvoeglijke naamwoorden, etc.).
  • De Logica: Als een alinea eruitzag als een Engels skelet van een moedertaalspreker, gaf de bot een hoge "Vlotheid"-score. Als het eruitzag als een vertaald skelet (een beetje onhandig of anders gestructureerd), was de score lager.

Om Getrouwheid te meten, gebruikten ze een tool genaamd COMET-KIWI. Denk hierbij aan een "betekeniscontrole". Het kijkt naar de brontekst en de vertaling en probeert te raden: "Hoeveel van de oorspronkelijke betekenis heeft dit behouden?" Het heeft geen perfecte menselijke vertaling nodig om mee te vergelijken; het evalueert het paar direct.

De Grote Ontdekking: De "Lengte"-Valstrik

Voordat ze het hoofdartikel vonden, liepen de onderzoekers tegen een struikelblok aan. Ze merkten op dat de alinea-lengte hun resultaten verpestte.

  • De Analogie: Stel je voor dat je probeert te beoordelen hoe goed een student een boek heeft samengevat. Als de student een samenvatting schrijft die slechts één zin lang is, is het moeilijk om trouw te blijven aan het hele verhaal, maar is het makkelijk om die ene zin vloeiend te laten klinken. Als ze een samenvatting van 10 pagina's schrijven, is het moeilijker om het perfect vloeiend te houden, maar makkelijker om alle details te behouden.
  • De Bevinding: Lange alinea's hadden de neiging om lagere scores te krijgen op zowel vlotheid als getrouwheid. Korte alinea's kregen hogere scores op beide. Dit liet het lijken alsof vlotheid en getrouwheid niets met elkaar te maken hadden, terwijl in werkelijkheid de lengte van de tekst de verborgen variabele was die aan de touwtjes trok.

Het Echte Antwoord: De Afweging

Zodra ze wiskundig "corrigeerden" voor de lengte van de alinea's (appel met appel vergelijken), kwam een duidelijk patroon naar voren: Er is een afweging.

Wanneer een vertaling vloeiender wordt (meer als een moedertaalspreker klinkt), neigt deze iets minder getrouw te worden aan de oorspronkelijke betekenis.

  • Menselijke Vertalers: Zij toonden de sterkste versie van deze afweging. Wanneer mensen de tekst zeer natuurlijk lieten klinken, moesten ze vaak de betekenis iets aanpassen om dit te doen.
  • Google Translate: Toonde ook deze negatieve relatie, zij het iets zwakker.
  • De AI (TranslateGemma): Dit was de verrassing. De AI toonde een veel zwakkere, soms zelfs niet-bestaande afweging. Het leek in staat te zijn om tegelijkertijd vloeiend en getrouw te zijn, of in ieder geval was de relatie tussen de twee niet zo eenduidig als bij mensen.

Wat Betekent Dit?

Het artikel suggereert dat bij literaire vertaling je niet altijd alles kunt hebben.

  • Als je wilt dat de tekst perfect leest als een Engels moedertaalroman, moet je misschien een klein beetje van de oorspronkelijke structuur of betekenis opofferen.
  • Als je je strikt wilt houden aan de oorspronkelijke structuur om elke nuance te behouden, kan de tekst een beetje "vreemd" of minder vloeiend klinken.

De auteurs merken ook op dat hun "Vlotheids"-detector was getraind op boeken uit de 1800- en vroege 1900-er jaren. Dit betekent dat het de stijl van oudere Engelse literatuur bevoordeelt. Omdat menselijke vertalers vaak proberen die historische stijl te matchen, scoren ze mogelijk hoger op vlotheid. Moderne AI, die is getraind op moderne internettekst, kan voor de detector "te modern" klinken, zelfs als het grammaticaal perfect is.

Samenvatting

Kortom, het artikel bewijst dat in de wereld van het vertalen van romans, gladheid en strikte nauwkeurigheid vaak in een zachte touwkrans verkeren. Het laten klinken van een vertaling meer als een Engels moedertaalboek vereist vaak een kleine concessie aan hoe strikt het de oorspronkelijke tekst volgt. Interessant genoeg, terwijl mensen en oudere AI-systemen deze spanning duidelijk tonen, lijken nieuwere, slimmere AI-modellen deze balans anders aan te pakken, soms in staat om zowel vloeiend als nauwkeurig te zijn zonder dezelfde duidelijke afweging.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →