← Nieuwste papers
🤖 AI

Is Your LLM Overcharging You? Tokenization, Transparency, and Incentives

Dit artikel toont aan dat het huidige pay-per-token-prijzenmodel voor grote taalmodellen een financieel prikkel creëert voor aanbieders om het aantal tokens verkeerd te rapporteren en gebruikers te veel in rekening te brengen, een kwetsbaarheid die zelfs bij transparantie-eisen blijft bestaan maar kan worden verzacht door over te gaan op een prijsmodel op basis van het aantal karakters dat voor aanbieders winstgevend blijft.

Oorspronkelijke auteurs: Ander Artola Velasco, Stratis Tsirtsis, Nastaran Okati, Manuel Gomez-Rodriguez

Gepubliceerd 2026-05-29
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Ander Artola Velasco, Stratis Tsirtsis, Nastaran Okati, Manuel Gomez-Rodriguez

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een kok huurt om je een maaltijd te bereiden. In de wereld van Large Language Models (LLM's) ben jij de klant en is de cloudprovider de kok. Op dit moment is de manier waarop je voor deze maaltijd betaalt gebaseerd op een zeer specifieke regel: je betaalt voor elk "ingrediënt" (token) dat de kok beweert te hebben gebruikt.

Hier is het probleem: De kok ziet het volledige kookproces, maar jij ziet alleen het eindgerecht. Hierdoor heeft de kok een geheim voordeel.

De "Token"-Truc

In de wereld van het artikel worden woorden opgesplitst in stukjes die "tokens" worden genoemd. Bijvoorbeeld, het woord "Damascus" kan als één groot stuk worden bereid (1 token) of in kleine stukjes worden gehakt zoals "Da", "ma", "s", "cus" (4 tokens).

Het Huidige Systeem (Betaal-per-Token):
Als de kok "Damascus" als één stuk bereidt, rekent hij je 1 token aan. Maar omdat de klant de keuken niet kan zien, zou een oneerlijke kok datzelfde woord stiekem in vier kleine stukjes kunnen hakken en je voor 4 tokens in rekening brengen. Het eten smaakt hetzelfde, de tekst ziet er hetzelfde uit, maar je rekening is verdubbeld.

Het artikel stelt dat het huidige prijsmodel een financieel stimuleringsmiddel creëert voor providers om precies dit te doen: je te veel in rekening brengen door woorden in meer stukjes te splitsen dan nodig is.

De "Recept"-Controle (Transparantie)

Je zou kunnen denken: "Wat als ik de kok vraag mij het recept te laten zien? Als ze 'Damascus' in vier stukjes splitsen, kan ik controleren of dit een normale manier van koken is."

Het artikel zegt dat dit helpt, maar het is geen perfecte oplossing.

  • Het Moeilijke Deel: Het vinden van de langste mogelijke manier om een woord op te splitsen die er nog steeds uitziet als een normaal recept, is wiskundig onmogelijk om perfect op te lossen in korte tijd (het is een NP-moeilijk probleem). Het is als proberen het enige langste pad door een enorm doolhof te vinden zonder verdwaald te raken.
  • Het Gat: De auteurs hebben echter een "slim spiekbriefje" (een algoritme) gebouwd dat niet de perfecte langste weg hoeft te vinden. Het vindt gewoon een voldoende lange weg die er normaal uitziet.
  • Het Resultaat: Hun experimenten tonen aan dat zelfs als de kok het recept moet laten zien, hij dit spiekbriefje nog steeds kan gebruiken om woorden genoeg op te splitsen om extra geld te verdienen, en dat de kosten van het controleren van het recept goedkoper zijn dan het extra geld dat ze verdienen. Dus, ze doen het nog steeds.

De Oplossing: Betaal per "Letter"

Om dit bedrog te stoppen, stelt het artikel een nieuwe manier van betalen voor: Betaal-per-karakter.

In plaats van te betalen voor hoeveel "stukken" (tokens) de kok heeft gebruikt, betaal je voor hoeveel letters er in het eindgerecht staan.

  • Of de kok "Damascus" nu als één stuk of als vier kleine stukjes bereidt, het woord heeft nog steeds 8 letters.
  • Als je 1 cent per letter betaalt, is de rekening altijd 8 cent.
  • De kok kan geen extra geld verdienen door het woord anders op te splitsen, omdat het totale aantal letters nooit verandert.

De "Winstmarge"-Twist

Het artikel erkent dat er een klein nadeel is. Onder het nieuwe systeem kan de winst van de kok licht variëren, afhankelijk van de taal of de specifieke gebruikte woorden (sommige talen hebben van nature minder letters per woordstuk dan andere).

De auteurs bieden echter een eenvoudige oplossing: De kok kan gewoon zijn prijs per letter instellen op basis van het gemiddelde aantal letters dat ze normaal gesproken gebruiken. Op deze manier kunnen ze overstappen op het eerlijke "betaal-per-letter"-systeem zonder hun gemiddelde winst te verliezen, terwijl jij beschermd bent tegen te hoge rekeningen.

Samenvatting

  • Het Probleem: Huidige AI-prijzen laten providers toe om stiekem woorden in meer stukjes te splitsen om je meer in rekening te brengen, en je kunt niet bewijzen dat ze dit hebben gedaan.
  • De "Transparantie"-Oplossing: Vragen om hun werk te laten zien helpt, maar ze kunnen nog steeds slimme manieren vinden om woorden op te splitsen en extra geld te verdienen.
  • De Echte Oplossing: Verander de prijsbepaling naar Betaal-per-Karakter. Omdat het aantal letters in een zin vaststaat, ongeacht hoe de AI het opbreekt, blijft de prijs eerlijk en verdwijnt de prikkel om te bedriegen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →