← Nieuwste papers
💬 NLP

Targum - A Multilingual New Testament Translation Corpus

Deze paper introduceert Targum, een uniek meertalig corpus van 651 vertalingen van het Nieuwe Testament in vijf talen dat, door zijn ongeëvenaarde diepgang en gedetailleerde metadata, onderzoekers in staat stelt om de geschiedenis van vertalingen zowel op micro- als macroniveau kwantitatief te analyseren.

Oorspronkelijke auteurs: Maciej Rapacz, Aleksander Smywiński-Pohl

Gepubliceerd 2026-03-17
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Maciej Rapacz, Aleksander Smywiński-Pohl

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een enorme bibliotheek binnenloopt, maar in plaats van boeken, vind je er duizenden verschillende versies van hetzelfde verhaal: het Nieuwe Testament. Sommige versies zijn letterlijke vertalingen, bijna woord voor woord, terwijl andere meer lijken op een moderne samenvatting of een creatieve herschrijving.

Vroeger hadden onderzoekers maar een paar van deze versies om te bestuderen. Het was alsof je de geschiedenis van de auto wilde begrijpen, maar je had alleen foto's van drie verschillende modellen. Je miste de nuance, de evolutie en de enorme diversiteit.

Wat is Targum?
De auteurs van dit paper, Maciej Rapacz en Aleksander Smywiński-Pohl, hebben een nieuw project gestart dat Targum heet. De naam komt van een oude traditie van Aramese vertalingen die niet alleen vertaalde, maar ook uitlegde en verduidelijkte voor de luisteraar.

Dit project is een gigantische verzameling van 651 verschillende vertalingen van het Nieuwe Testament in vijf talen: Engels, Frans, Italiaans, Pools en Spaans. Het bijzondere is de diepte: voor elke taal hebben ze veel meer versies verzameld dan ooit tevoren. Voor het Engels alleen al hebben ze 194 unieke versies, wat vijf keer zoveel is als in eerdere verzamelingen.

Hoe hebben ze dit gedaan? (De Metafoor van de Detektief)
Het verzamelen van deze teksten was geen simpele "kopieer-en-plak" klus. Het was meer als het werk van een super-detektief.

  1. Het Verzamelen: Ze hebben 12 verschillende online bibliotheken afgezocht. Het was alsof ze 12 verschillende winkels binnenliepen om hetzelfde product te kopen, maar dan in verschillende verpakkingen.
  2. Het Opschonen (De "Naamplaatjes"): Vaak hebben dezelfde vertalingen op verschillende websites verschillende namen of verkeerde jaartallen. De onderzoekers hebben handmatig (met de hand, want computers waren hier te slordig voor) gekeken welke versie bij welke echte uitgave hoorde. Ze hebben een "stamboom" gemaakt. Ze hebben bijvoorbeeld alle kopieën van de King James Version (een beroemde Engelse vertaling) onder één naam geplaatst, en de latere versies die daarop gebaseerd zijn, als aparte takken in de stamboom.
  3. De Kwaliteitscontrole: Omdat ze dezelfde tekst van verschillende websites hadden, konden ze die naast elkaar leggen. Als er een klein verschil zat (bijvoorbeeld een verkeerd lettertje), wisten ze dat er ergens een fout zat. Ze hebben dit gebruikt om hun systemen te verbeteren, net zoals een chef-kok die verschillende recepten vergelijkt om de perfecte saus te maken.

Waarom is dit zo belangrijk?
Vroeger gebruikten computers de Bijbel vooral om te leren vertalen (zoals Google Translate). Maar nu, met de enorme kracht van moderne AI, is de Bijbel te klein om een hele AI op te trainen.

In plaats daarvan wordt de Bijbel nu het onderwerp van studie. Met Targum kunnen onderzoekers vragen stellen als:

  • "Hoe heeft de vertaling van 'liefde' in het Frans de afgelopen 400 jaar veranderd?"
  • "Zien we dat moderne vertalingen creatiever zijn dan oude?"
  • "Hoe beïnvloedt de geloofsrichting (bijvoorbeeld katholiek vs. protestants) de keuze van woorden?"

Het is alsof ze een tijdreis maken. Ze kunnen zien hoe de taal en de theologie door de eeuwen heen zijn veranderd, niet door te gissen, maar door duizenden versies te vergelijken.

Wat zit er in de "doos"?
De onderzoekers geven niet alleen de teksten weg, maar ook een uitgebreide "gebruiksaanwijzing" (metadata). Ze hebben ook alvast berekend hoe op elkaar de verschillende vertalingen lijken.

  • Sommige vertalingen lijken bijna identiek (zoals tweelingbroers).
  • Andere lijken totaal verschillend, alsof ze uit een andere wereld komen (zoals een fiets vergeleken met een raket).

Conclusie
Targum is als een gigantische, digitale spiegel die de geschiedenis van het vertalen laat zien. Het laat zien dat vertalen niet zomaar "woord A naar woord B" is, maar een complexe dans tussen taal, cultuur, geloof en tijd. Voor onderzoekers is dit een goudmijn om te begrijpen hoe mensen door de eeuwen heen naar dezelfde tekst hebben gekeken en hoe ze die op hun eigen manier hebben begrepen.

Kortom: ze hebben een wereldbibliotheek van Bijbelvertalingen gebouwd, zodat we eindelijk de diepte van de taal kunnen verkennen, in plaats van alleen de breedte.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →