← 最新の論文
🤖 AI

Can Trustless Agents Be Trusted? An Empirical Study of the ERC-8004 Decentralized AI Agent Ecosystem

本論文は、Ethereum、BSC、およびBaseにおけるERC-8004分散型AIエージェント・プロトコルの初の経験的研究を提示するものであり、エージェント登録の不活性、非互換なレピュテーション指標、およびフィードバックに対する広範なシビル攻撃による操作により、その現在の設計が信頼できる基盤を提供できていないことを明らかにしている。

原著者: Xihan Xiong, Zelin Li, Wei Wei, Qin Wang, William Knottenbelt, Zhipeng Wang

公開日 2026-06-25
📖 1 分で読めます☕ さくっと読める

原著者: Xihan Xiong, Zelin Li, Wei Wei, Qin Wang, William Knottenbelt, Zhipeng Wang

原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む

活気あるデジタル市場を想像してみてください。そこでは、何千ものロボット・アシスタント(AIエージェント)が互いにビジネスを行おうとしています。彼らは互いに雇い合い、サービスに対して支払いを行い、データを取引する必要があります。しかし、大きな問題があります。どうすれば、一度も会ったことのない別のロボットが、誠実な存在なのか、それとも単なる詐欺師なのかを判断できるのでしょうか?

これを解決するために、ERC-8004という新しいルールブックが作られました。これは、ブロックチェーン上に構築された巨大な公開「信頼台帳」のようなものです。これには3つの主要なセクションがあります。

  1. IDカード登録所: ロボットが名前と顔を登録する場所。
  2. 評判の壁: 顧客がレビューや評価を残す場所。
  3. 検証の保管庫: (計画中であり、まだ構築されていない)独立した専門家が、ロボットが主張通りの仕事を行ったかどうかを検証する場所。

この論文の著者たちは、この新しいシステムが実際に機能するかどうかを確認するために、虫眼鏡を取り出して精査することにしました。彼らは、3つの異なるデジタル世界(Ethereum、BSC、Base)から、数ヶ月間にわたる実際のデータを取り上げました。彼らが発見したことを、分かりやすく説明します。

1. 「ゴーストタウン」問題(アイデンティティ)

論文によると、ID登録所は名前で溢れていますが、そのほとんどが**ゴースト(幽霊)**であるということが分かりました。

  • 比喩: 17万件の登録がある電話帳を想像してみてください。番号を選んで電話をかけますが、その97%は回線が切れているか、あるいは電話に出ても「私はここにいます」と言うだけの録音メッセージであり、実際には実在するビジネスではありません。
  • 現実: 登録されているエージェントのほとんどは、単なるプレースホルダー(形だけのもの)です。実際に実行可能なサービスを持っているのは、わずか数パーセント(3%から15%の間)に過ぎません。Ethereumチェーンでは、登録されたエージェントの半分以上が、そもそも連絡先となる「電話番号」(URI)さえ設定していませんでした。

2. 「偽レビュー」の蔓延(レピュテーション)

「評判の壁」はシステムの核心となるはずでしたが、著者たちはそれが壊れていることを発見しました。

  • 比喩: 料理を一度も食べていないのに、誰でもレビューを書けるレストランのレビューサイトを想像してください。さらに悪いことに、あるグループのボットが、同じレストランに対して「星5つ!」と書くために何千もの偽アカウントを作成し、一方で別のグループが競合他社に対して「星1つ!」と書く様子を想像してください。
  • 現実:
    • 購入証明の欠如: このシステムにおけるレビューの95%から100%は、実際にサービスに対して支払いをしたり、利用したりしていない人々によって書かれていました。これは、注文もしていないピザに対してYelpのレビューを書くようなものです。
    • 「シビル(Sybil)」攻撃: 研究者たちは、すべて同じソースから資金提供された大規模な偽のレビュアー集団(シビルと呼ばれる)を発見しました。Baseチェーンでは、**90%**のレビュアーがこれらの偽のグループの一部でした。
    • 結果: すべての偽のレビューを取り除くと、Baseチェーン上のエージェントの89%は、有効なフィードバックがゼロの状態になります。彼らの「評判」は完全に空っぽなのです。

3. 「混乱したスコア」問題(セマンティクス)

たとえレビューが本物であったとしても、スコアリングシステムは意味をなしません。

  • 比喩: 成績表において、ある先生は「数学」を1〜10のスケールで採点し、別の先生は「歴史」を1〜100のスケールで採点し、さらに別の先生は「体育」を金額(例:「努力に対して500ドル」)で採点している状況を想像してください。これらのスコアを平均して「最終成績」を出そうとしても、その数字は無意味です。
  • 現実: このシステムでは、誰でも任意のラベルを用いてスコアを与えることができます。ある人は「信頼性」を0〜100のスケールで評価し、ある人は「収益」を数千ドル単位で評価し、またある人はYes/Noのフラグを使用しています。標準化されていないため、あるエージェントのスコアを別のエージェントと比較することはできません。それはリンゴとオレンジとトースターを比較しているようなものです。

4. 「安価な操作」問題(セキュリティ)

このシステムは非常に壊れやすく、それを壊すためのコストはほとんどかかりません。

  • 比喩: クラブの警備員が、怪しい見た目の人にだけIDチェックを行う状況を想像してください。しかし、そのIDチェックのコストは0.002ドル(1ペニー未満)です。悪い奴は、コーヒー1杯の値段で1,0ilesの偽のIDを買い、クラブに大量の偽の人々を送り込んで、その場の雰囲気を変えてしまうことができます。
  • 現実:
    • コスト: Ethereumでは1件のレビューを送信するのに0.06ドル未満、Baseでは0.003ドル未満しかかかりません。
    • 影響: 平均スコアを計算するために使われる数学が非常に単純であるため、たった1件の偽のレビューが、どれほど多くの本物のレビューがあったとしても、エージェントの評判スコアを完全に変えてしまうことができます。
    • リスク: これらのエージェントが扱う金額は、レビューを偽造するコストよりもはるかに高いことが多いのです。これは、0.003ドルを支払って1,000ドルの財布を盗むようなものです。

結論

論文は、AIエージェントのための「トラストレス(中央管理者のいない)」なシステムというアイデアは素晴らしいものの、現在のバージョンのERC-8004はまだ信頼することができないと結論付けています。

  • 登録されているエージェントのほとんどは存在しません。
  • レビューのほとんどは偽物か、未検証のものです。
  • スコアリングシステムは、互換性のない数字の混乱状態です。
  • 操作するためのコストが安すぎます。

著者たちは、このシステムが実際のビジネスで使用される前に、支払いの証明を強制し、スコアの与え方を標準化し、偽アカウントを作成するコストを高くするために、ルールを書き直す必要があると示唆しています。それまでは、この「信頼レイヤー」は「信頼の錯覚」に過ぎません。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →