← 最新の論文
💻 computer science

The OpenHands Software Agent SDK: A Composable and Extensible Foundation for Production Agents

本論文では、柔軟性、セキュリティ、信頼性、そして人間との対話性を備え、既存の SDK とは異なりネイティブなサンドボックス実行やモデル非依存のルーティングなどを統合した、ソフトウェア開発エージェントの構築・展開のための新しい構成可能かつ拡張可能な基盤「OpenHands Software Agent SDK」を提案し、その有効性を実証しています。

原著者: Xingyao Wang, Simon Rosenberg, Juan Michelini, Calvin Smith, Hoang Tran, Engel Nyst, Rohit Malhotra, Xuhui Zhou, Valerie Chen, Robert Brennan, Graham Neubig

公開日 2026-04-23
📖 1 分で読めます☕ さくっと読める

原著者: Xingyao Wang, Simon Rosenberg, Juan Michelini, Calvin Smith, Hoang Tran, Engel Nyst, Rohit Malhotra, Xuhui Zhou, Valerie Chen, Robert Brennan, Graham Neubig

原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む

この論文は、**「OpenHands ソフトウェアエージェント SDK」**という新しいツールキットの紹介です。

一言で言うと、**「AI にプログラミングをさせたい人たちのための、最強の『土台』と『工具箱』」**が完成したというお話しです。

これまでの AI エージェント(自律型 AI)は、実験室ではうまく動いても、実際にビジネスで使おうとすると「壊れやすい」「扱いにくい」「セキュリティが甘い」といった問題がありました。この論文は、その問題を解決し、誰でも安心して本格的な AI エージェントを作れるようにした「新しい設計図」を提案しています。

わかりやすくするために、いくつかの比喩を使って説明しましょう。


1. 以前のバージョン(V0):「巨大で重たいワンルームマンション」

以前のシステム(OpenHands V0)は、すべての機能(AI の頭脳、道具、部屋、セキュリティ、通信など)が一つの巨大な箱に詰め込まれていました。

  • 問題点:
    • 柔軟性がない: 「家の外で作業したい(ローカル実行)」と思ったら、箱全体を改造しないといけない。
    • 壊れやすい: 箱のどこかが壊れると、全体が止まってしまう。
    • セキュリティ: 常に「隔離された部屋(サンドボックス)」に入れないと動かない設定で、少しの作業でも重い箱を運ばなければならなかった。

2. 新しいバージョン(V1):「モジュール式の高級ホテル」

今回発表された新しい SDK(V1)は、**「必要なものだけを取り出して組み立てられる」**ように設計されました。まるでレゴブロックや、高級ホテルの客室のようなイメージです。

🏗️ 4 つの主要な「部屋(パッケージ)」

このシステムは、4 つの独立した部品(パッケージ)でできています。

  1. SDK(心臓部): AI の思考プロセスや会話の管理をする「頭脳」。
  2. Tools(道具箱): ファイル操作やコード実行などの「道具」。
  3. Workspace(作業場): AI が実際に作業する「部屋」。
  4. Server(受付係): 遠隔地から AI を操作するための「窓口」。

✨ すごいところ:

  • 実験室(ローカル)から工場(クラウド)へシームレス:
    • 最初は自分のパソコン(実験室)で AI に作業させて、すぐに「はい、この作業を本社のサーバー(工場)で本番運用してください」と切り替えるだけで済みます。コードを書き直す必要はありません。
    • 比喩: 自宅でレシピを試し作りにした料理が、そのまま高級レストランの厨房で提供されるような感覚です。

🛡️ 安全性の進化:「自動ドアと警備員」

  • サンドボックスは「オプション」:
    • 以前は「常に隔離された部屋」に入らないと動かなかったが、今は「危険な作業をする時だけ隔離部屋に入る」ように設定できます。
    • 比喩: 普段は自由に庭で遊ばせ、火事や危険な作業をする時だけ「防火服とヘルメット」を着せるようなものです。
  • セキュリティ分析:
    • AI が「危険なコマンド(例:大切なファイルを消す)」を出そうとすると、**「警備員(セキュリティアナライザー)」**がそれをチェックし、「本当に実行していいですか?」と人間に確認します。

📝 記憶の仕組み:「イベントの日記」

  • イベントソーシング:
    • AI の行動を「現在の状態」で覚えるのではなく、**「何をしたかという日記(イベント)」**をすべて記録します。
    • 比喩: 迷路に迷った時、現在の位置だけ覚えていても「どうやってここに来たか」がわからないと戻れません。でも、「左に曲がった、右に曲がった」という日記があれば、いつでも最初からやり直せます。
    • これにより、システムがクラッシュしても、数ミリ秒で直前まで完全に復元できます。

🚀 なぜこれが重要なのか?(実証データ)

この新しい設計がどれほど優れているか、実際に 15 日間、本番環境でテストしました。

  • 故障の激減: 以前のシステム(V0)に比べて、システム自体が原因で失敗するケースが61% も減りました
    • 以前は「通信エラー」や「部屋が準備できない」といったバグが多かったのが、V1 ではほぼゼロになりました。
  • 性能は維持: 設計を大きく変えても、AI の「頭脳力(プログラミング能力)」は落ちず、むしろ新しい機能(拡張された思考など)に対応できるようになりました。
  • コスト: 記録を取るためのオーバーヘッド(手間)は、AI が考える時間の0.001 秒以下と、ほぼ無視できるレベルです。

🌟 まとめ:この SDK がもたらす未来

この論文は、**「AI エージェントを本格的にビジネスで使うための、信頼できる土台」**が完成したことを宣言しています。

  • 研究者は、新しい AI のアイデアを素早く試せる。
  • 開発者は、自分のアプリに AI を簡単に組み込める。
  • 企業は、安全で安定した AI を大規模に導入できる。

まるで、**「AI という強力なエンジン」を、誰でも安全に、好きな車(アプリ)に搭載できるようにした「標準的なシャシー(車台)」**が完成したようなものです。これにより、これからの AI 開発は、難しい基礎工事から解放され、もっとクリエイティブな応用へと進んでいくでしょう。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →