From Multi-Agent Systems and the Semantic Web to Agentic AI: A Unified Narrative of the Web of Agents
本論文は 1990 年から 2026 年までの「エージェント・ウェブ」の進化を統合された物語として提示し、プラットフォーム調整からデータ注釈、そして最終的にモデル解釈へと至る「意味的・努力の移行」が 3 つの明確な世代を定義すると論じるとともに、持続的な課題とアジェンティック AI の将来の方向性を特定するための比較枠組み、システム分類、および最近の制度的収束の分析を提供する。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
インターネットを静的な本(ドキュメント)の図書館ではなく、互いに会話し、取引を行い、あなたの代わりに物事を成し遂げる自律的な労働者(エージェント)で賑わう活気ある都市として想像してみてください。この論文は、そのような未来の都市を「エージェントのウェブ(Web of Agents)」と呼びます。
ルクセンブルク大学の研究チームである著者たちは、私たちがこの都市を構築しようとしてからすでに 30 年が経過していると主張しています。彼らは、これらの試みの歴史を 3 つの明確な「世代」を通じて辿り、システムの「頭脳」を異なる場所へ移し続けてきた過程を示しつつ、そのたびに新たな問題が生じてきたことを明らかにしています。
以下に、創造的なアナロジーを用いて、シンプルに語られる「エージェントのウェブ」の物語を記します。
3 つの世代:「頭脳」の移動
この論文は、エージェント技術の歴史とは、会話の「意味(セマンティクス)」をどこに置くかを決定してきた物語であると論じています。
第 1 世代:「厳格なクラブ」(1995 年~2005 年)
- アイデア: 特定の制服を着用し、入会には非常に形式的で硬直した言語(ラテン語など)を話さなければならない高級カントリークラブを想像してください。
- 仕組み: これは**マルチエージェントシステム(MAS)**の時代でした。研究者たちは、厳格なルールを強制する複雑なプラットフォーム(クラブの管理者のようなもの)を構築しました。エージェントは、特定の「発話行為」プロトコル(非常に特定の形で「要求します」や「約束します」と言うなど)に従わなければなりませんでした。
- 問題点: インターネットはカントリークラブではなく、混沌としたオープンな屋外市場のようなものです。「クラブのルール」は、オープンなウェブには重すぎ、複雑すぎました。この技術は閉鎖された実験室内では機能しましたが、インターネットの残りの部分と接続するには失敗しました。
- 教訓: オープンなウェブに、プライベートなクラブのように振る舞わせることはできません。
第 2 世代:「注釈付き図書館」(2001 年~2012 年)
- アイデア: エージェント同士が言語で合意できないなら、図書館の本に誰にでも理解できるように明確にラベルを付けましょう。
- 仕組み: これはセマンティックウェブの時代でした。エージェントを賢くする代わりに、研究者たちはデータを賢くしようとしました。機械がコンテンツの意味を理解できるように、すべてのウェブページに複雑なタグ(オントロジー)を追加しようとしたのです。
- 問題点: 作業量が膨大すぎました。インターネット全体を手動でラベル付けすることは、世界中のすべての本にあるすべての単語の辞書を書こうとするようなものです。費用がかかりすぎ、システムも脆すぎました(ラベルが少し間違っているだけで、全体が破綻しました)。
- 教訓: 人間にインターネット全体を手動でラベル付けさせることはできません。
第 3 世代:「賢いインターン」(2020 年代~現在)
- アイデア: 本にラベルを付けたり、特定の言語を強制したりするのをやめましょう。代わりに、何でも読み、文脈を理解し、その場で物事を解決できる超優秀なインターンを雇いましょう。
- 仕組み: これは現在のLLM(大規模言語モデル)エージェントの時代です。「意味」はもはや AI モデルそのものの中にあります。AI は事前にラベル付けされたデータを必要としません。その学習に基づいて自然言語を理解し、どのツールを使用すべきかを判断します。
- 結果: ついに成功しました!AI が柔軟であるため、私たちはようやく「エージェントのウェブ」を構築できるようになりました。
- 欠点: AI は厳格なルールに従うのではなく、パターンに基づいて「推測」して意味を解釈するため、なぜそれがその行動をとったのかを常に証明することはできません。柔軟性はありますが、完全な検証可能性はありません。
新しい「都市インフラ」(2024 年~2026 年)
この論文は、現在(2024 年末から 2026 年にかけて)起きている巨大な転換点を強調しています。初めて、これらのエージェントが実際にビジネスを行えるようにする「配管」が設置されつつあります。
- プロトコル(電話回線): **MCP(Model Context Protocol)やA2A(Agent-to-Agent)**などの新しい標準が立ち上げられています。
- アナロジー: MCPをユニバーサル電源コンセントだと考えてください。どんなツールを持っていても、AI に接続できます。
- アナロジー: A2Aをユニバーサル電話番号システムだと考えてください。これにより、誰が作成したエージェントであっても、エージェント A がエージェント B に電話をかけることができます。
- 決済システム(財布): 長年、エージェントは支払いを行うことができませんでした。現在、Visa、Mastercard、Stripeなどの巨人が、エージェント専用の決済インフラを構築しています。
- アナロジー: 以前、エージェントは話すことはできてもお金を持たない子供のような存在でした。現在、彼らには利用限度額付きのクレジットカードが与えられています。
- ルール(警察): 政府(EU など)や安全団体は、これらのエージェントが暴走しないよう、彼らに特化した法律の策定を開始しています。
7 つの「教訓」と「課題」
著者たちは、この 30 年間の旅から 7 つの重要な教訓をまとめています(summarize)。主なものは以下の通りです。
- すべてが適合しなければならない: 電話回線(プロトコル)や決済システム(経済)が機能していなければ、優れた頭脳(AI)だけでは不十分です。すべての部分が整合している必要があります。
- 「頭脳」の移動: 私たちは「頭脳」をプラットフォーム(第 1 世代)からデータ(第 2 世代)へ、そしてモデル(第 3 世代)へと移動させてきました。移動するたびに柔軟性は高まりましたが、安全性の保証は一部失われました。
- お金が重要: セマンティックウェブが失敗したのは、その作業を支払うためのビジネスモデルが誰も持っていなかったからです。現在、決済ネットワークがこの問題を修正するために参入しています。
- 「信頼」の罠: エージェントを見つけるたびに、私たちは中央集権的な「電話帳」(レジストリ)を構築してきました。これらは大規模では常に失敗します。私たちは、ピアツーピアネットワークのような、分散型でエージェントを見つける方法が必要です。
- 「ブラックボックス」問題: 現代の AI は自ら物事を判断するため、それが正しいことをしているかどうかを常に検証できません。次のステップは、柔軟性を失うことなく AI の行動を検証できるようにするために、「署名付き契約」を追加することです。
- 「同意」のパズル: エージェント A がエージェント B に何かを依頼し、エージェント B がエージェント C に依頼する場合、実際に誰が許可を与えたのでしょうか?許可を継承するためのより良いルールが必要です。
- 規制が追いついている: 技術が完成してから数年後ではなく、技術が構築されている最中に法律が策定されるのは、これが初めてです。
未来:「検証済み契約」の時代?
この論文は、第 4 段階が到来すると予測しています。私たちは現在、「柔軟だが未検証」の段階にいます。未来はおそらく、柔軟な AIを署名付き契約で包み込んだような組み合わせになるでしょう。
- アナロジー: 何でも描くことを許された非常に創造的な芸術家(AI)を想像してください。ただし、すべての絵画の終わりに、ルールを破らなかったことを証明する法的文書に署名しなければなりません。これにより、創造性と安全性という両方の利点が得られます。
まとめ
この論文は結論として、「エージェントのウェブ」はもはや SF の夢ではないと述べています。技術(AI)、ツール(プロトコル)、資金(決済)、そしてルール(規制)がついに統合されつつあります。現在の課題は、より賢いエージェントを構築することではなく、それらがすべて一緒に生活し、働くことができる、信頼性が高く、安全で、経済的に持続可能な都市を構築することです。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。