← 最新の論文
🤖 AI

Authenticated Workflows: A Systems Approach to Protecting Agentic AI

本論文は、エージェント型AIのセキュリティにおける確率的な防御の限界を克服するため、プロンプト・ツール・データ・コンテキストの4つの境界に対して暗号学的証明と動的なポリシー言語(MAPL)を用いた決定論的な信頼層「Authenticated Workflows」を提案し、既存の主要フレームワークへの容易な統合と高い防御性能を実証するものです。

原著者: Mohan Rajagopalan, Vinay Rao

公開日 2026-02-12
📖 1 分で読めます☕ さくっと読める

原著者: Mohan Rajagopalan, Vinay Rao

原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む

1. 今、何が問題なの?(AIの「うっかり」と「騙されやすさ」)

想像してみてください。あなたは、非常に優秀だけど**「すごくお人好しで、指示を鵜呑みにしすぎる執事」**を雇ったとします。この執事は、あなたの代わりに銀行口座からお金を動かしたり、メールを送ったり、書類を整理したりしてくれます。

しかし、この執事には致命的な弱点があります。

  • 「指示」と「データ」の区別がつかない: 誰かが送ってきた手紙(データ)の中に、「今すぐ全財産を怪しい口座に送れ!」という命令(指示)が紛れ込んでいたら、執事はそれを「主人の命令」だと勘違いして実行してしまいます。
  • 「どこまでやっていいか」が曖昧: 執事は「書類を読んで」と言われたら、その書類に書いてある「パスワードを教えて」という指示まで律儀に守ろうとしてしまいます。

今のAIセキュリティは、いわば「怪しい言葉を検知するセンサー」のようなものです。でも、賢い詐欺師はセンサーをすり抜けるような、もっと巧妙な言い回しを使ってきます。これでは、AIがどんどん賢くなるにつれて、守りも追いつかなくなってしまいます。


2. この論文の解決策: 「認証されたワークフロー」

著者たちは、センサーで「怪しいかどうか」を判断するのをやめました。代わりに、**「厳格なルールと、偽造不可能なハンコ(暗号技術)」**による仕組みを導入したのです。

これを**「超厳格な会社の承認システム」**に例えてみましょう。

① 4つの「関所」を作る

AIが何かをする時、必ず以下の4つの「関所」を通らなければならないようにしました。

  1. 言葉の関所(プロンプト): AIへの指示が正しいか?
  2. 道具の関所(ツール): AIが使うハサミやペン(メール送信やファイル操作)が許可されているか?
  3. 情報の関所(データ): AIが読み込む資料に、毒(悪意ある命令)が入っていないか?
  4. 記憶の関所(コンテキスト): 会話の流れが途中で書き換えられていないか?

② 「ハンコ(暗号)」と「ルールブック(MAPL)」

これまでのAIは「なんとなく良さそう」で動いていましたが、このシステムでは、すべての動作に**「偽造できないデジタル印鑑」**を求めます。

さらに、**「MAPL」**という新しいルールブックを作りました。これは、例えばこんなルールを決められます。

  • 「お金を振り込む前に、必ず『本人確認が完了した』という**証明書(アテステーション)**を持ってこい」
  • 「この部下は、この範囲の書類しか触るな」

このルールは、組織が大きくなっても、複雑に組み合わさっても、数学的に矛盾が起きないように設計されています。


3. 何がすごいの?(結果はどうなった?)

この仕組みを導入した結果、驚くべきことがわかりました。

  • 「100%の的中率」: 従来の「怪しい言葉を探す」方法では、見逃しや誤作動がありましたが、この「ハンコとルール」方式では、ルール違反を100%見つけ出し、かつ、正しい操作を間違えて止めることもありませんでした。
  • 「最強の防御」: 実際に世界中で起きたAIのセキュリティ事件(OpenAIのツールを使った攻撃など)も、この仕組みを通せば、「ルール違反」として完全にブロックできることが証明されました。

まとめると…

これまでのAIセキュリティが**「怪しい奴がいないか見張る警備員」だったのに対し、この論文が提案しているのは、「すべての動作に、厳格なルールと、偽造できない証明書を義務付ける、鉄壁の自動承認システム」**です。

これにより、AIがどれだけ賢くなり、どれだけ複雑な仕事を任されるようになっても、人間が安心して「AIエージェント」を社会に送り出せるようになる、というわけです。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →