← Nieuwste papers
💻 computer science

From BM25 to Corrective RAG: Benchmarking Retrieval Strategies for Text-and-Table Documents

Deze studie benchmarkt tien ophaalstrategieën voor RAG-systemen op een financieel dataset met tekst-en-tabellen en concludeert dat een tweestaps-pipeline met hybride ophaling en neurale herschikking de beste prestaties levert, terwijl BM25 in dit domein superieur is aan dichte ophaling.

Oorspronkelijke auteurs: Meftun Akarsu, Recep Kaan Karaman, Christopher Mierbach

Gepubliceerd 2026-04-03
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Meftun Akarsu, Recep Kaan Karaman, Christopher Mierbach

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een enorme bibliotheek hebt, maar deze is niet gevuld met gewone boeken. De boeken zijn een raar mengsel van verhalen (tekst) en ingewikkelde rekenbladen met cijfers (tabellen). Je wilt een vraag stellen, bijvoorbeeld: "Hoeveel winst heeft Bedrijf X gemaakt in 2023?"

Deze paper is een groot experiment om te ontdekken: wat is de slimste manier om het juiste antwoord te vinden in zo'n chaotische bibliotheek?

De auteurs hebben tien verschillende "zoekstrategieën" getest. Hier is wat ze hebben ontdekt, vertaald in begrijpelijke taal:

1. De Grote Verrassing: Soms is een simpele zoekopdracht beter dan een slimme AI

In de wereld van AI denken veel mensen dat de nieuwste, slimste "semantische zoekmachine" (die begrijpt wat je bedoelt, niet alleen wat je schrijft) altijd wint.

  • De analogie: Stel je voor dat je een zoekmachine hebt die denkt als een filosoof (Dense Retrieval) en een die denkt als een bibliotheekmedewerker die exact op woorden let (BM25).
  • Het resultaat: Voor financiële documenten wint de bibliotheekmedewerker (BM25) vaak van de filosoof. Waarom? Omdat in financiën de exacte woorden belangrijk zijn (zoals "omzet", "aandeel", "2023"). Als de filosoof probeert te "gissen" naar de betekenis, mist hij de precieze cijfers. De simpele zoekopdracht die exact op die woorden zoekt, werkt hier beter.

2. De Winnaar: De "Tweestaps-Strategie"

De allerbeste manier om te zoeken bleek een combinatie te zijn, net als bij het vinden van een huwelijk.

  • Stap 1 (De Brede Netten): Je gebruikt eerst een combinatie van de "filosoof" en de "bibliotheekmedewerker" om een lange lijst met mogelijke antwoorden te maken. Dit heet Hybrid Retrieval.
  • Stap 2 (De Expert): Vervolgens laat je een super-slimme expert (een zogenaamde Cross-Encoder Reranker) die lange lijst nog eens doorlopen. Deze expert leest de vraag én het antwoord samen en zegt: "Nee, dit nummer is niet relevant, maar dit ene document is perfect!"
  • Het resultaat: Deze combinatie (Tweestaps) was veruit de beste. Het vond veel meer juiste antwoorden dan welke enkele methode dan ook.

3. Wat werkt NIET zo goed?

De auteurs testten ook enkele "slimme trucjes" die in andere situaties werken, maar hier faalden:

  • Het "Hypothetische Antwoord" (HyDE): De idee was: laat de AI eerst een verzonnen antwoord schrijven op je vraag, en zoek dan op dat verzonnen antwoord.
    • Waarom het faalde: Financiële vragen gaan over echte cijfers. Als de AI een verzonnen cijfer bedenkt (bijvoorbeeld "10 miljoen" in plaats van "12 miljoen"), gaat de zoekmachine in de war. Het is alsof je een verzonnen adres geeft aan een taxi; hij komt nooit op de juiste plek.
  • Meerdere vragen stellen: De AI proberen om je vraag in drie verschillende manieren te herschrijven.
    • Waarom het faalde: Financiële vragen zijn al heel specifiek. Het herschrijven bracht geen nieuwe inzichten, alleen maar extra werk.

4. De "Context" is Koning

Een andere slimme truc was om aan elk document een korte samenvatting toe te voegen voordat je het opslaat (bijvoorbeeld: "Dit document gaat over de jaarverslag van Apple in 2023").

  • Het resultaat: Dit hielp enorm. Het gaf de zoekmachine extra hints, alsof je aan de bibliotheekmedewerker zegt: "Zoek in het vakje 'Apple', niet in het hele gebouw."

5. Waarom is dit belangrijk voor jou?

De auteurs concluderen dat als je een systeem bouwt om vragen te beantwoorden over financiële documenten (of andere documenten met veel tabellen):

  1. Gebruik een combinatie: Koppel een simpele woord-zoeker aan een slimme AI-zoeker.
  2. Laat een expert nakijken: Laat een tweede, slimme AI de resultaten sorteren. Dit geeft het grootste voordeel.
  3. Wees voorzichtig met "verzonnen" antwoorden: Bij precieze cijfer-vragen werkt het niet om de AI eerst te laten dromen.
  4. Voeg context toe: Geef de documenten extra labels of samenvattingen voordat je begint.

Kort samengevat:
In een wereld vol complexe cijferbladen en teksten, is de slimste zoekmachine niet degene die het meest "slim" denkt, maar degene die precies luistert naar de woorden én daarna een expert laat nakijken. Het is een combinatie van grondigheid en slimme controle.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →