← Nieuwste papers
💬 NLP

SQL Query Engine: A Self-Healing LLM Pipeline for Natural Language to PostgreSQL Translation

Dit paper introduceert SQL Query Engine, een open-source, zelfgehoste dienst die natuurlijke taal omzet in gevalideerde PostgreSQL-query's via een tweestaps LLM-pijplijn met een zelfherstellende lus die fouten diagnoseert en corrigeert zonder regressies.

Oorspronkelijke auteurs: Muhammad Adeel Ijaz

Gepubliceerd 2026-04-21
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Muhammad Adeel Ijaz

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een gesprek voert met een zeer slimme, maar soms wat ongeduldige bibliothecaris. Je vraagt hem: "Laat me eens zien welke klanten vorige maand een boek hebben gekocht."

De bibliothecaris (de AI) probeert je vraag om te zetten in een instructie voor het archief (de database). Maar soms maakt hij een foutje: hij zoekt naar "klanten" in plaats van "klant", of hij gebruikt de verkeerde datum. In de oude wereld zou de bibliothecaris dan zeggen: "Fout! Ik snap het niet," en zou hij stoppen. Jij zou dan teleurgesteld zijn.

SQL Query Engine is een nieuw systeem dat deze bibliothecaris een onvermoeibare, zelfcorrigerende assistent geeft. Hier is hoe het werkt, vertaald naar alledaagse taal:

1. De Twee-Stage Dans

Het systeem werkt in twee stappen, net als het plotten van een route voordat je vertrekt:

  • Stap 1: De Schets (De Generatie)
    De AI kijkt eerst naar de structuur van de bibliotheek (de database). Hij maakt een kaartje met alle tafels en kolommen. Vervolgens probeert hij je vraag om te zetten in een perfecte instructie.

    • Het slimme trucje: Het maakt niet uit hoe de AI antwoordt. Of hij nu een strak JSON-formaat gebruikt, code in een blokje zet, of gewoon tekst typt. De "vertaler" (de parser) snapt het allemaal en haalt de instructie eruit.
  • Stap 2: De Testrit en de Reparatie (De Zelfheling)
    De instructie wordt naar de database gestuurd.

    • Situatie A (Het lukt!): Als de instructie werkt en er zijn resultaten, is het klaar. Geen gedoe.
    • Situatie B (Het mislukt!): Als de database zegt: "Fout! Die kolom bestaat niet," dan stopt het systeem niet. In plaats daarvan kijkt de AI naar de foutmelding (zoals een monteur die naar de motorluik kijkt). Hij denkt: "Ah, ik dacht 'order_date', maar het heet 'order_timestamp'. Ik ga het proberen met de juiste naam."
    • Hij probeert het opnieuw. En opnieuw, tot het werkt. Dit noemen ze zelfheling (self-healing).

2. De Drie Gouden Regels (Om domme fouten te voorkomen)

Om te voorkomen dat de AI een goed antwoord "oplost" tot een slecht antwoord, heeft het systeem drie veiligheidsnetten:

  1. De "Als het werkt, doe het dan niet" regel (Early-Accept):
    Als de AI een instructie geeft die werkt, stopt het systeem direct. De AI mag niet gaan "knutselen" aan iets dat al goed is. Dit voorkomt dat hij een goed antwoord per ongeluk kapot maakt.
  2. De "Bewaar het beste" regel (Best-Result Tracking):
    Stel dat de AI in de eerste poging een goed antwoord gaf, maar in de tweede poging (na reparatie) een slechter antwoord gaf. Het systeem onthoudt het beste antwoord dat het ooit heeft gezien. Als alle pogingen mislukken, geeft hij toch het beste deelsucces terug, in plaats van helemaal niets.
  3. De "Geen vertrouwen in eigen oordeel" regel:
    De AI mag niet zeggen: "Ik denk dat dit wel goed is." Alleen als de database echt werkt en resultaten teruggeeft, telt het als geslaagd. De AI moet bewijzen dat het werkt, niet alleen beweren dat het werkt.

3. Waarom is dit zo handig?

  • Veiligheid: De AI mag alleen lezen, nooit schrijven of wissen. Het is alsof de bibliothecaris alleen mag kijken in de boeken, maar nooit mag schrijven in de catalogus.
  • Snelheid: Het onthoudt de kaart van de bibliotheek (de schema-cache) voor je volgende vraag. Je hoeft niet elke keer opnieuw de hele bibliotheek te laten inventariseren.
  • Transparantie: Je kunt in real-time meekijken hoe de AI denkt en probeert. Het is alsof je ziet hoe hij krabt aan zijn hoofd, een foutje ziet, en het vervolgens oplost.

4. Wat zeggen de cijfers?

De makers hebben dit getest op twee manieren:

  • De "Oefentoets" (Synthetisch): Hier werd de AI tot 9,3% beter door de zelfheling.
  • De "Echte Wereld" (BIRD Benchmark): Hier, met echte, rommelige data, werd de AI 4,6% beter.

Het interessante is dat niet de "slimste" AI (de grootste) altijd wint. Soms helpt een kleinere, wendbaardere AI (zoals Llama 4 Scout) beter bij het repareren van fouten dan een enorme, trage AI.

Samenvatting

SQL Query Engine is als een slimme tolk die niet alleen vertaalt wat je zegt, maar ook luistert naar de reactie van de ander. Als de ander zegt "Dat bestaat niet", past de tolk zijn vertaling direct aan en probeert het opnieuw, totdat het klopt. Het zorgt ervoor dat je, zelfs als de computer een fout maakt, toch een bruikbaar antwoord krijgt, zonder dat jij als gebruiker iets hoeft te doen.

Het is een openbaar systeem (gratis te gebruiken) dat je kunt draaien op je eigen server, zodat je data veilig blijft en je geen afhankelijkheid hebt van dure cloud-diensten.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →