← Ultimi articoli
🤖 AI

Is Your LLM Overcharging You? Tokenization, Transparency, and Incentives

Questo articolo rivela che l'attuale modello di pricing pay-per-token per i modelli linguistici di grandi dimensioni crea un incentivo finanziario per i fornitori a riportare erroneamente i conteggi dei token e a sovraccaricare gli utenti, una vulnerabilità che persiste anche con requisiti di trasparenza ma che può essere mitigata adottando un meccanismo di pricing basato sul conteggio dei caratteri che rimane redditizio per i fornitori.

Autori originali: Ander Artola Velasco, Stratis Tsirtsis, Nastaran Okati, Manuel Gomez-Rodriguez

Pubblicato 2026-05-29
📖 4 min di lettura☕ Lettura da pausa caffè

Autori originali: Ander Artola Velasco, Stratis Tsirtsis, Nastaran Okati, Manuel Gomez-Rodriguez

Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo

Immagina di assumere uno chef per cucinarti un pasto. Nel mondo dei Modelli Linguistici di Grande Dimensione (LLM), tu sei il cliente e il fornitore di servizi cloud è lo chef. Attualmente, il modo in cui paghi questo pasto si basa su una regola molto specifica: paghi per ogni "ingrediente" (token) che lo chef afferma di aver utilizzato.

Ecco il problema: lo chef vede l'intero processo di cottura, ma tu vedi solo il piatto finale. A causa di ciò, lo chef ha un vantaggio segreto.

L'inganno del "Token"

Nel mondo del documento, le parole vengono scomposte in blocchi chiamati "token". Ad esempio, la parola "Damasco" potrebbe essere cotta come un unico grande blocco (1 token) o tagliata in piccoli pezzi come "Da", "ma", "s", "co" (4 token).

Il sistema attuale (Pagamento per Token):
Se lo chef cuoce "Damasco" come un unico blocco, ti addebita 1 token. Ma poiché il cliente non può vedere la cucina, uno chef disonesto potrebbe segretamente tagliare quella stessa parola in quattro piccoli pezzi e addebitarti 4 token. Il cibo ha lo stesso sapore, il testo appare identico, ma il tuo conto è raddoppiato.

Il documento sostiene che il modello di prezzi attuale crea un incentivo finanziario per i fornitori a fare esattamente questo: addebitarti in eccesso suddividendo le parole in più pezzi del necessario.

Il controllo della "Ricetta" (Trasparenza)

Potresti pensare: "E se chiedessi allo chef di mostrarmi la ricetta? Se dividono 'Damasco' in quattro pezzi, posso verificare se questo è un modo normale di cucinarlo".

Il documento afferma che questo aiuta, ma non è una soluzione perfetta.

  • La parte difficile: Trovare il modo più lungo possibile per tagliare una parola che sembri ancora una ricetta normale è matematicamente impossibile da risolvere perfettamente in breve tempo (è un problema NP-difficile). È come cercare di trovare il singolo percorso più lungo attraverso un labirinto enorme senza perdersi.
  • La falla: Tuttavia, gli autori hanno creato una "sbarra intelligente" (un algoritmo) che non ha bisogno di trovare il percorso perfettamente più lungo. Si limita a trovare un percorso abbastanza lungo che sembri normale.
  • Il risultato: I loro esperimenti mostrano che anche se lo chef deve mostrare la ricetta, può comunque utilizzare questa sbarra per tagliare le parole a sufficienza per guadagnare di più, e il costo di verificare la ricetta è inferiore al denaro extra che guadagnano. Quindi, continuano a farlo.

La soluzione: Pagare per "Lettera"

Per fermare questa truffa, il documento propone un nuovo modo di pagare: Pagamento per carattere.

Invece di pagare per quanti "blocchi" (token) lo chef ha utilizzato, paghi per quante lettere ci sono nel piatto finale.

  • Che lo chef cuoca "Damasco" come un unico blocco o come quattro piccoli blocchi, la parola ha comunque 8 lettere.
  • Se paghi 1 centesimo per lettera, il conto è sempre di 8 centesimi.
  • Lo chef non può guadagnare di più tagliando la parola in modo diverso perché il numero totale di lettere non cambia mai.

Il colpo di scena del "Margine di Profitto"

Il documento ammette che c'è un piccolo ostacolo. Sotto il nuovo sistema, il profitto dello chef potrebbe variare leggermente a seconda della lingua o delle parole specifiche utilizzate (alcune lingue hanno naturalmente meno lettere per blocco di parola rispetto ad altre).

Tuttavia, gli autori offrono una soluzione semplice: lo chef può semplicemente fissare il prezzo per lettera in base al numero medio di lettere che utilizza solitamente. In questo modo, può passare al sistema equo "pagamento per lettera" senza perdere il suo profitto medio, mentre tu sei protetto dall'essere sovraccaricato.

Riepilogo

  • Il problema: I prezzi attuali dell'IA permettono ai fornitori di dividere segretamente le parole in più pezzi per addebitarti di più, e tu non puoi provare che lo abbiano fatto.
  • La soluzione della "Trasparenza": Chieder loro di mostrare il loro lavoro aiuta, ma possono comunque trovare modi astuti per dividere le parole e guadagnare di più.
  • La vera soluzione: Cambiare la tariffazione in Pagamento per Carattere. Poiché il numero di lettere in una frase è fisso, indipendentemente da come l'IA la scompone, il prezzo rimane equo e l'incentivo a imbrogliare scompare.

Sommerso dagli articoli nel tuo campo?

Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.

Prova Digest →