← Nieuwste papers
💻 computer science

VarParser: Unleashing the Neglected Power of Variables for LLM-based Log Parsing

VarParser is een nieuwe, variabele-gerichte logparsing-methode die de vaak genegeerde variabele delen van logs benut om de nauwkeurigheid, efficiëntie en kosten van LLM-gedreven loganalyse te verbeteren ten opzichte van bestaande, op constanten gerichte benaderingen.

Oorspronkelijke auteurs: Jinrui Sun, Tong Jia, Minghua He, Ying Li

Gepubliceerd 2026-03-13
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Jinrui Sun, Tong Jia, Minghua He, Ying Li

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

VarParser: De Vergeten Kracht van Variabelen in Logboeken

Stel je voor dat je een gigantische berg papierwerk hebt van een grote fabriek. Dit zijn de logboeken (logs) van een computersysteem. Elke dag schrijven miljoenen machines hier duizenden regels op over wat ze doen, wat er misgaat en hoe ze reageren. Voor een ingenieur is het vinden van een specifiek probleem in die berg papierwerk als een naald in een hooiberg zoeken.

Om dit op te lossen, gebruiken we log parsing. Dit is het proces waarbij we die rommelige zinnen omzetten in nette, gestructureerde lijsten.

Het oude probleem: Kijken naar de "Vaste" tekst

Tot nu toe keken slimme programma's (die gebruikmaken van Grote Taalmodellen of LLM's, denk aan een super-intelligente robot) alleen naar de vaste delen van de tekst.

  • De Analogie: Stel je voor dat je een receptboek bekijkt.
    • De vaste tekst is: "Kook de pasta, voeg de saus toe en serveer."
    • De variabele tekst is: "Kook de pasta 3 minuten, voeg 200 gram saus toe en serveer voor 4 personen."

De oude methoden keken alleen naar "Kook de pasta...". Ze zagen dat dit recept vaak terugkwam en dachten: "Ah, dit is hetzelfde recept!" Maar ze negeerden de tijd, het gewicht en het aantal personen.

Dit leidde tot vier grote problemen:

  1. Verkeerde groepen: Omdat ze alleen naar de vaste tekst keken, groepeerden ze verkeerde recepten bij elkaar.
  2. Te veel vragen: De robot moest heel vaak "Hé, wat is dit?" vragen aan de super-intelligente LLM, omdat hij de variabele details niet herkende. Dit kostte veel tijd.
  3. Te duur: Elke vraag aan de robot kost geld. Omdat ze te vaak vroegen, werd het proces heel duur.
  4. Verlies van informatie: Als je alleen de vaste tekst noteert, vergeet je de belangrijke details (zoals "3 minuten"). Als de machine later faalt omdat hij te lang gekookt heeft, weet je niet waarom, want die info is weggegooid.

De nieuwe oplossing: VarParser

De auteurs van dit paper (Jinrui Sun en collega's van de Peking Universiteit) hebben een nieuwe methode bedacht genaamd VarParser. Hun idee is simpel maar krachtig: Kijk niet alleen naar de vaste tekst, maar geef de variabele details de hoofdrol.

Hun methode werkt als een slimme bibliothecaris die niet alleen naar de titel van het boek kijkt, maar ook naar de inhoudsopgave en de specifieke pagina's.

Hier zijn de drie slimme trucs die VarParser gebruikt:

1. Slimmer zoeken (Variabele Bijdrage)

In plaats van willekeurig of op basis van vaste zinnen te zoeken, kijkt VarParser naar de unieke onderdelen (de variabelen).

  • Analogie: Stel je voor dat je in een drukke treinstation zoekt naar mensen die op hetzelfde spoor wachten. De oude methode keek alleen naar de kleur van hun jas (de vaste tekst). VarParser kijkt naar hun reisbestemming (de variabele). Als tien mensen allemaal naar "Peking" reizen, groepeert VarParser ze direct bij elkaar, ongeacht of ze een blauwe of rode jas dragen. Dit maakt het zoeken veel sneller en efficiënter.

2. Een slim geheugen (Het Cache-systeem)

VarParser onthoudt niet alleen de vaste zinnen, maar ook de plekken waar variabelen zitten.

  • Analogie: Stel je voor dat je een vergelijking maakt tussen twee foto's. De oude methode vergelijkte elke pixel. Als er één klein detail anders was (bijvoorbeeld een auto met een ander kenteken), dachten ze: "Dit is een andere foto!" en vroegen ze opnieuw aan de robot.
    VarParser doet het slim: Hij zegt: "Oké, de auto is anders, maar de achtergrond en de mensen zijn hetzelfde. Dit is dus dezelfde foto, alleen met een andere auto." Hij maskert het veranderende deel en vergelijkt de rest. Hierdoor hoeft hij de robot veel minder vaak te vragen om hulp.

3. Slimme voorbeelden geven (Adaptief Leren)

Wanneer de robot toch een vraag moet beantwoorden, geeft VarParser hem de juiste voorbeelden.

  • Analogie: Als je een kind leert om te tellen, geef je hem niet een boek met alleen maar de tekst "Twee appels". Je geeft hem voorbeelden van verschillende dingen die geteld kunnen worden (appels, auto's, ballen).
    VarParser selecteert voorbeelden op basis van de specifieke variabele die hij ziet. Als hij een IP-adres ziet, geeft hij de robot een voorbeeld van een IP-adres, in plaats van een voorbeeld van een hele zin. Dit bespaart veel ruimte en geld, en de robot maakt minder fouten.

Wat levert dit op?

De testresultaten zijn indrukwekkend:

  • Sneller: Het proces gaat veel sneller omdat de robot minder vaak hoeft na te denken.
  • Goedkoper: Omdat er minder vragen gesteld worden, kosten de kosten voor het gebruik van de AI aanzienlijk minder.
  • Beter: De resultaten zijn nauwkeuriger.
  • Meer inzicht: Het belangrijkste voordeel is dat VarParser de variabele informatie bewaart. Ingenieurs zien nu niet alleen "Fout opgetreden", maar ook "Fout opgetreden op schijf 3". Dit geeft hen veel meer inzicht in wat er precies misgaat in hun systemen.

Kortom: VarParser is als het verschil tussen een robot die alleen de titel van een krant leest, en een robot die de hele krant begrijpt, inclusief de kleine details die echt belangrijk zijn voor het verhaal. Door die vergeten details (de variabelen) te gebruiken, wordt het hele systeem slimmer, sneller en goedkoper.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →