← Nieuwste papers
💬 NLP

Copy-Paste to Mitigate Large Language Model Hallucinations

Dit artikel introduceert CopyPasteLLM, een methode die hallucinaties in RAG-systemen vermindert door modellen te trainen om vaker tekst direct uit de verstrekte context te kopiëren, wat leidt tot een hogere feitelijke nauwkeurigheid met aanzienlijk minder trainingsdata.

Oorspronkelijke auteurs: Yongchao Long, Xian Wu, Yingying Zhang, Xianbin Wen, Yuxi Zhou, Shenda Hong

Gepubliceerd 2026-02-10
📖 3 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Yongchao Long, Xian Wu, Yingying Zhang, Xianbin Wen, Yuxi Zhou, Shenda Hong

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een superintelligente assistent hebt (een Large Language Model zoals ChatGPT). Deze assistent heeft een gigantisch geheugen vol met boeken en feiten die hij zelf heeft geleerd. Maar er is een probleem: soms is hij zo zelfverzekerd dat hij gaat "hallucineren". Dat betekent dat hij een antwoord geeft dat heel geloofwaardig klinkt, maar dat eigenlijk niet klopt met de informatie die je hem net hebt gegeven. Hij vertrouwt dan meer op zijn eigen (soms foutieve) geheugen dan op het document dat je voor zijn neus hebt gelegd.

Dit onderzoek introduceert een oplossing genaamd "Copy-Paste".

Hier is de uitleg in begrijpelijke taal:

De Metafoor: De Zelfverzekerde Professor vs. De Nauwkeurige Kopist

Stel je voor dat je een professor vraagt: "Wat staat er in dit specifieke medische rapport over deze patiënt?"

  • De huidige AI (De Zelfverzekerde Professor): De professor leest het rapport vluchtig, maar begint vervolgens een prachtig verhaal te houden op basis van alles wat hij de afgelopen 30 jaar heeft geleerd. Hij zegt: "Patiënten met deze symptomen hebben meestal ziekte X." Maar in dit specifieke rapport staat dat deze patiënt juist ziekte Y heeft. De professor "hallucineert" omdat zijn eigen kennis de overhand krijgt.
  • De Copy-Paste Methode (De Nauwkeurige Kopist): In plaats van te proberen alles in zijn eigen woorden te vertellen, krijgt de assistent een nieuwe instructie: "Gebruik de tekst uit het rapport als een soort bouwstenen. Knip de juiste zinnen uit het rapport en plak ze in je antwoord."

Hoe werkt het? (De drie stappen)

De onderzoekers hebben een systeem gebouwd dat de AI leert om een "kopist" te worden in plaats van een "verteller":

  1. De Oefenronde (Copy-Paste Prompting): Eerst leren ze de AI verschillende manieren om te kopiëren. Soms mag hij alleen zinnen uit het document pakken en ze in de juiste volgorde zetten (zoals een puzzel). Soms mag hij er een klein beetje "lijm" (eigen woorden) tussen gebruiken om het verhaal vloeiend te maken.
  2. De Training (CopyPasteLLM): De AI krijgt een soort "beloningssysteem". Als de AI een antwoord geeft dat heel erg lijkt op de tekst in het document, krijgt hij een compliment. Als hij begint te verzinnen met zijn eigen geheugen, krijgt hij een tik op de vingers. Het bijzondere is dat ze dit heel efficiënt doen: ze hebben maar heel weinig voorbeelden nodig om de AI dit aan te leren.
  3. Het Resultaat: De AI wordt een expert in het "geloven" van de tekst die hij krijgt. Zelfs als de tekst iets zegt dat tegenstrijdig is met wat de AI vroeger heeft geleerd (bijvoorbeeld: "De maan is gemaakt van kaas"), zal de AI nu braaf zeggen: "Volgens de tekst is de maan gemaakt van kaas", in plaats van te zeggen: "Nee, dat is onzin, de maan is van steen."

Waarom is dit belangrijk?

Dit is vooral cruciaal in gebieden waar fouten levens kunnen kosten, zoals de medische wereld. Als een arts een AI gebruikt om informatie uit een patiëntendossier te halen, wil hij geen "slimme mening" van een professor; hij wil de exacte feiten uit het dossier.

Kortom: De onderzoekers hebben de AI geleerd om minder te praten vanuit zijn eigen "ego" (zijn getrainde geheugen) en meer te kijken naar de "bewijsstukken" (de tekst die je hem geeft). Door simpelweg te kopiëren en te plakken, wordt de AI een veel betrouwbaardere assistent.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →