Is Your LLM Overcharging You? Tokenization, Transparency, and Incentives
本論文は、大規模言語モデルの現在のトークン課金モデルが、プロバイダーにトークン数の虚偽報告と利用者への過剰請求を促す財政的インセンティブを生み出しており、この脆弱性は透明性要件が存在しても解消されないが、プロバイダーにとって収益性を維持しつつ文字数ベースの課金メカニズムを採用することで緩和可能であることを明らかにする。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
シェフに料理を頼むと想像してください。大規模言語モデル(LLM)の世界では、あなたは顧客であり、クラウドプロバイダーがシェフです。現在、この料理に対する支払い方法は非常に特定のルールに基づいています:シェフが使ったと主張するすべての「材料」(トークン)に対して支払います。
ここに問題があります。シェフは調理の全過程を見ていますが、あなたは完成した皿しか見ていません。このため、シェフには秘密の優位性があります。
「トークン」のトリック
この論文の世界では、単語は「トークン」と呼ばれる断片に分解されます。例えば、「ダマスカス」という単語は、1 つの大きな断片(1 トークン)として調理されるか、「Da」「ma」「s」「cus」のような小さな断片に刻まれて(4 トークン)調理されるかもしれません。
現在のシステム(トークンごとの支払い):
シェフが「ダマスカス」を 1 つの断片として調理すれば、1 トークン分の料金を請求されます。しかし、顧客は厨房を見ることができないため、不誠実なシェフは同じ単語を秘密裏に 4 つの小さな断片に刻み、4 トークン分の料金を請求できる可能性があります。料理の味は同じ、テキストも同じですが、請求額は倍になります。
この論文は、現在の価格設定モデルが、プロバイダーにまさにこれを行うよう金銭的なインセンティブを与えていると主張しています:必要以上に単語を分割して、過剰に請求することです。
「レシピ」の確認(透明性)
あなたは、「シェフにレシピを見せてもらえばどうだろう?もし彼らが「ダマスカス」を 4 つの断片に分割したら、それが通常の調理方法かどうか確認できる」と考えるかもしれません。
論文によると、これは役立ちますが、完全な解決策ではありません。
- 難しい点: 単語を、正常なレシピに見えるように分割する「最長」の方法を見つけることは、短い時間で完全に解くことが数学的に不可能です(これは NP 困難問題です)。巨大な迷路で迷わずに単一の最長経路を見つけるようなものです。
- 抜け穴: しかし、著者たちは「完璧な」最長経路を見つける必要のない「賢いカンニングペーパー」(アルゴリズム)を構築しました。これは、正常に見える「十分長い」経路を見つけるだけです。
- 結果: 彼らの実験によると、シェフがレシピを見せなければならないとしても、彼らは依然としてこのカンニングペーパーを使って単語を分割し、追加の利益を得ることができます。また、レシピを確認するコストは、彼らが得る追加の利益よりも安価です。したがって、彼らは依然としてそれを行います。
解決策:「文字」ごとに支払う
この不正行為を止めるため、この論文は新しい支払い方法を提案しています:文字ごとの支払いです。
シェフが使用した「断片」(トークン)の数ではなく、完成した皿に含まれる文字の数に対して支払います。
- シェフが「ダマスカス」を 1 つの断片として調理しても、4 つの小さな断片として調理しても、その単語には依然として 8 文字あります。
- 文字 1 文字あたり 1 セント支払う場合、請求額は常に 8 セントです。
- 文字の総数は変わらないため、シェフは単語の分割方法を変えて追加の利益を得ることはできません。
「利益率」のひねり
この論文は、小さな欠点があることを認めています。新しいシステムの下では、言語や使用される特定の単語によってシェフの利益がわずかに変動する可能性があります(一部の言語は、他の言語に比べて単語の断片あたりの文字数が自然に少ないためです)。
しかし、著者たちは簡単な解決策を提示しています。シェフは、通常使用する文字数の平均に基づいて、文字あたりの価格を設定するだけです。これにより、彼らは平均的な利益を失うことなく公平な「文字ごとの支払い」システムに移行でき、あなたは過剰請求から守られます。
まとめ
- 問題: 現在の AI の価格設定により、プロバイダーは単語を秘密裏により多くの断片に分割して、より多く請求することができ、あなたがそれを証明することはできません。
- 「透明性」による修正: 彼らに作業内容を見せるように求めることは役立ちますが、彼らは依然として単語を分割して追加の利益を得る巧妙な方法を見つけることができます。
- 真の解決策: 価格設定を文字ごとの支払いに変更します。文の文字数は固定されているため、AI がどのように分割しても価格は公平に保たれ、不正をするインセンティブは消えます。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。