Auditing Pay-Per-Token in Large Language Models
Dit paper introduceert een auditframework op basis van martingale-theorie dat een vertrouwde derde partij in staat stelt om misrapportage van tokens door LLM-aanbieders met zekerheid op te sporen en valse alarmen te minimaliseren.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
De "Token-Dief" opsporen: Een simpele uitleg van het onderzoek
Stel je voor dat je een taxi neemt. De chauffeur zegt: "De rit kost €1 per kilometer." Maar in werkelijkheid is de rit maar 5 kilometer, terwijl de chauffeur op de meter 10 kilometer heeft laten zien. Je betaalt dubbel, maar je ziet het niet, want je zit achterin en kijkt alleen naar de bestemming, niet naar de meter.
Dit is precies wat er gebeurt bij grote kunstmatige intelligentie (LLM's) zoals die van Google, OpenAI of Meta. Je betaalt per "token" (een stukje tekst, zoals een woord of een letter). De provider (de taxi-chauffeur) ziet precies hoeveel tokens er zijn, maar jij ziet alleen het eindresultaat.
Het probleem: De verleiding om te valsspelen
Omdat de provider meer geld verdient als hij meer tokens rekent, heeft hij een financieel motief om te liegen. Hij kan een simpele zin als "Hallo" op een slimme manier opsplitsen in 10 kleine stukjes in plaats van 1 groot stukje. Voor jou ziet het er hetzelfde uit ("Hallo"), maar de provider rekent je 10 keer af in plaats van 1 keer. Dit noemen de onderzoekers token-misreporting (het verkeerd melden van tokens).
De oplossing: De onafhankelijke controleur
De auteurs van dit paper (Ander Artola Velasco, Stratis Tsirtsis en Manuel Gomez-Rodriguez) hebben een slimme manier bedacht om deze "taxichauffeurs" te controleren. Ze noemen het een auditing framework (een controle-systeem).
Hier is hoe het werkt, vertaald naar alledaagse taal:
1. De "Magische Spiegel" (De Estimator)
Stel je voor dat je een spiegel hebt die precies weet hoe een taxi-chauffeur eerlijk zou rijden.
- De onderzoekers hebben een wiskundig trucje bedacht (een "onbevooroordeelde schatter") dat de provider kan gebruiken om te berekenen: "Als ik eerlijk was, zou deze zin ongeveer 5 tokens kosten."
- Dit is lastig, omdat er vaak meerdere manieren zijn om een zin op te splitsen. Maar hun methode is als een slimme gokker die duizenden keren in zijn hoofd rekent en dan een perfect gemiddelde geeft.
2. De "Gokspel-Methode" (Martingalen)
Nu komt het echte genie van het onderzoek. Ze gebruiken een wiskundig concept dat martingalen heet. Laten we dit vergelijken met een gokspel.
- Het spel: De controleur (de auditor) begint met een potje van €1.
- De beurt: De controleur vraagt een vraag aan de provider. De provider geeft een antwoord en zegt: "Dit kost 10 tokens."
- De check: De controleur gebruikt zijn "magische spiegel" om te berekenen: "Eerlijk zou dit 5 tokens kosten."
- De gok:
- Als de provider eerlijk is (5 tokens gezegd, 5 berekend), blijft het potje €1.
- Als de provider liegt (10 tokens gezegd, 5 berekend), dan wint de controleur geld. Het potje groeit.
- Als de provider per ongeluk minder rekent dan eerlijk zou zijn (zeldzaam), verliest de controleur een beetje geld, maar het potje zakt niet onder nul.
De regel: Als het potje groeit tot een bepaald bedrag (bijvoorbeeld €20, wat overeenkomt met een kans van 5% om fout te alarm te slaan), dan roept de controleur: "GEVANGEN! Je liegt!"
3. Waarom is dit zo sterk?
- Je kunt niet ontsnappen: Of de provider nu slim liegt, dom liegt, of elke keer anders liegt, het potje zal altijd groeien als hij liegt. Het is als een muntje dat op de lange termijn altijd in je richting valt als je een oneerlijke speler bent.
- Snelheid: In hun experimenten zagen ze dat ze een leugenachtige provider al konden betrappen na ongeveer 70 vragen. Dat is heel snel!
- Veiligheid: Als de provider eerlijk is, blijft het potje rond de €1 hangen. Het is extreem onwaarschijnlijk dat je een eerlijke provider per ongeluk veroordeelt (minder dan 1 op de 20 keer).
Samenvatting in één zin
De onderzoekers hebben een wiskundige "val" ontworpen die, net als een slimme gokker, langzaam maar zeker geld verzamelt zolang de provider liegt, en zo snel en betrouwbaar de leugens opspoort dat providers niet meer kunnen profiteren van hun bedrog.
Waarom is dit belangrijk?
Zonder dit soort controle zullen providers waarschijnlijk blijven liegen om meer geld te verdienen, en zullen gebruikers (zowel bedrijven als particulieren) onnodig veel betalen. Dit paper geeft ons de gereedschappen om de markt eerlijk te houden.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.